Qwen3.7-Plus의 기술 사양
| 항목 | 사양 |
|---|---|
| 모델명 | Qwen3.7-Plus |
| 제공사 | Alibaba Cloud (Qwen Team) |
| API 모델 ID | qwen3.7-plus |
| 모델 유형 | 멀티모달 에이전트 모델 |
| 입력 유형 | 텍스트, 이미지, 비디오 |
| 출력 유형 | 텍スト |
| 컨텍스트 윈도우 | 최대 1,000,000 토큰 |
| 최대 입력 토큰 수 | ~991.8K |
| 최대 출력 토큰 수 | ~65.5K |
| 핵심 강점 | 비전-언어 추론, 코딩, GUI 상호작용, 에이전트 워크플로 |
| 내장 기능 | 함수 호출, 구조화된 출력, 캐시, 웹 검색, 배치 API |
| API 호환성 | DashScope / Model Studio를 통한 OpenAI 호환 |
Qwen3.7-Plus란?
Qwen3.7-Plus는 Alibaba의 Qwen 3.7 세대에서 균형 잡힌 멀티모달 플래그십 모델이다. 한편 Qwen3.7-Max가 순수 텍스트 추론과 장기 지향 코딩에 집중하는 반면, Qwen3.7-Plus는 이미지와 비디오에 대한 네이티브 이해를 통해 이러한 역량을 확장하여 단일 모델 안에서 시각 및 텍스트 정보를 종합적으로 추론할 수 있게 한다.
이 모델은 멀티모달 인터랙티브 하이브리드 에이전트라는 개념을 중심으로 설계되었다. 스크린샷을 해석하고, 차트를 분석하며, 인터페이스를 이해하고, 시각적 참조로부터 코드를 생성하고, 도구를 사용해 다단계 작업을 완료할 수 있다. 이는 시각적 컨텍스트가 중요한 AI 에이전트, GUI 자동화, 생산성 워크플로에서 특히 매력적이다.
Qwen3.7-Plus의 주요 기능
- 텍스트, 이미지, 비디오를 단일 추론 파이프라인에서 지원하는 네이티브 멀티모달 입력.
- 최대 1M 토큰 컨텍스트 윈도우로 대규모 코드베이스 분석과 장문 문서 워크플로를 지원.
- 하이브리드 GUI + CLI 에이전트 기능으로 화면을 이해하고 소프트웨어 환경과 상호작용 가능.
- 함수 호출, 구조화된 출력, 외부 도구 통합을 포함한 고급 코딩 및 도구 사용.
- 차트, 문서, 스크린샷에 대한 시각적 이해로 비즈니스, 엔지니어링, UI 작업에 유용.
- OpenAI 호환 API 엔드포인트로 기존 LLM 인프라에서 비교적 쉽게 마이그레이션 가능.
Qwen3.7-Plus의 벤치마크 성능
공개 벤치마크 보고 및 서드파티 평가 플랫폼에 따르면, Qwen3.7-Plus는 최전선 수준의 멀티모달 및 에이전트 성능을 제공한다:
- Artificial Analysis Intelligence Index: 53.3.
- GPQA Diamond: 약 90.0%.
- IFBench: 약 78.0%.
- AA Long Context Reasoning (AA-LCR): 약 65.0%.
- Terminal-Bench Hard: 약 **47.0%**로 강력한 에이전트형 코딩 역량을 반영.
또한 Alibaba는 Qwen3.7-Plus가 에이전트 및 코딩 벤치마크에서 선도적인 상용 모델들과 경쟁력 있는 성능을 보이며, 특히 멀티모달 과제와 UI 상호작용에서 강점을 보인다고 보고한다.
Qwen3.7-Plus vs Qwen3.7-Max vs Claude Opus 4.6
| 기능 | Qwen3.7-Plus | Qwen3.7-Max | Claude Opus 4.6 |
|---|---|---|---|
| 입력 모달리티 | 텍스트, 이미지, 비디오 | 텍스트 전용 | 텍스트, 이미지 |
| 컨텍스트 윈도우 | 최대 1M 토큰 | 1M 토큰 | 대용량 컨텍스트 |
| 시각 이해 | 탁월 | 미지원 | 강함 |
| 에이전트/GUI 상호작용 | 네이티브 중심 | 제한적 | 우수 |
| 장기 지향 텍스트 추론 | 매우 강함 | Qwen 제품군 최고 | 우수 |
| 최적 사용 사례 | 멀티모달 에이전트 및 생산성 | 코딩, 수학, 심층 추론 | 엔터프라이즈 추론 및 코딩 |
스크린샷, UI 자동화, 시각적 디버깅, 멀티모달 워크플로가 포함된 프로젝트에는 일반적으로 Qwen3.7-Plus가 더 적합하다. 순수 텍스트 기반 추론이나 리포지토리 규모의 코딩에는 Qwen3.7-Max가 여전히 더 강력한 선택지다.
한계
- Qwen3.7-Plus는 현재 프리뷰 단계의 상용 모델로 제공되며, 정식 출시 전 일부 기능이 변경될 수 있다.
- 함수 호출 및 일부 에이전트 도구 기능은 아직 순차적으로 출시 중이다.
- 순수 텍스트 중심의 고난도 추론 작업에서는 Qwen3.7-Max가 다소 더 나은 성능을 보일 수 있다.
- 대부분의 대규모 멀티모달 모델과 마찬가지로, 프로덕션 배포 전에 자체 이미지 및 UI 데이터셋으로 성능을 검증해야 한다.
대표적 활용 사례
- 브라우저, GUI, 터미널 상호작용을 결합한 AI 에이전트.
- 스크린샷 및 UI 캡처를 통한 소프트웨어 디버깅.
- 문서, 차트, 대시보드 분석.
- 목업 또는 다이어그램에서 코드를 생성하는 비주얼 코딩 도우미.
- 텍스트와 이미지 입력이 혼합된 엔터프라이즈 생산성 워크플로.
- 웹 검색과 시각적 이해를 결합한 멀티모달 연구 보조.