Qwen3.7-Plus의 기술 사양
| 항목 | 사양 |
|---|---|
| 모델 이름 | Qwen3.7-Plus |
| 제공사 | Alibaba Cloud (Qwen Team) |
| API 모델 ID | qwen3.7-plus |
| 모델 유형 | 멀티모달 에이전트 모델 |
| 입력 유형 | 텍스트, 이미지, 비디오 |
| 출력 유형 | 텍스트 |
| 컨텍스트 윈도우 | 최대 1,000,000 토큰 |
| 최대 입력 토큰 | ~991.8K |
| 최대 출력 토큰 | ~65.5K |
| 핵심 강점 | 비전-언어 추론, 코딩, GUI 상호작용, 에이전트 워크플로 |
| 내장 기능 | 함수 호출, 구조화된 출력, 캐시, 웹 검색, 배치 API |
| API 호환성 | DashScope / Model Studio를 통한 OpenAI 호환 |
Qwen3.7-Plus란?
Qwen3.7-Plus는 Alibaba의 Qwen 3.7 세대에서 균형 잡힌 멀티모달 플래그십 모델이다. Qwen3.7-Max가 순수 텍스트 추론과 장기 지향 코딩에 집중하는 반면, Qwen3.7-Plus는 네이티브 이미지 및 비디오 이해를 통해 이러한 역량을 확장하여 단일 모델 내에서 시각 및 텍스트 정보를 아우르는 추론을 가능하게 한다.
이 모델은 멀티모달 상호작용 하이브리드 에이전트라는 개념을 중심으로 설계되었다. 스크린샷을 해석하고, 차트를 분석하며, 인터페이스를 이해하고, 시각적 참고 자료로부터 코드를 생성하고, 도구를 사용해 다단계 작업을 수행할 수 있다. 이는 시각적 컨텍스트가 중요한 AI 에이전트, GUI 자동화, 생산성 워크플로에 특히 매력적이다.
Qwen3.7-Plus의 주요 기능
- 텍스트, 이미지, 비디오를 통합 추론 파이프라인에서 지원하는 네이티브 멀티모달 입력.
- 최대 1M 토큰의 컨텍스트 윈도우로, 대규모 코드베이스 분석과 장문 문서 워크플로를 지원.
- 하이브리드 GUI + CLI 에이전트 기능으로 화면을 이해하고 소프트웨어 환경과 상호작용 가능.
- 함수 호출, 구조화된 출력, 외부 도구 통합 등 고급 코딩 및 도구 사용 기능.
- 차트, 문서, 스크린샷에 대한 시각적 이해로, 비즈니스, 엔지니어링, UI 작업에 유용.
- OpenAI 호환 API 엔드포인트로 기존 LLM 인프라에서 비교적 쉽게 마이그레이션 가능.
Qwen3.7-Plus의 벤치마크 성능
공개 벤치마크 보고 및 제3자 평가 플랫폼에 따르면, Qwen3.7-Plus는 최전선 수준의 멀티모달 및 에이전트 성능을 제공한다.
- Artificial Analysis Intelligence Index: 53.3.
- GPQA Diamond: 약 90.0%.
- IFBench: 약 78.0%.
- AA Long Context Reasoning (AA-LCR): 약 65.0%.
- Terminal-Bench Hard: 약 **47.0%**로, 강력한 에이전트형 코딩 역량을 반영.
Alibaba는 또한 Qwen3.7-Plus가 에이전트 및 코딩 벤치마크에서 선도적 독점 모델들과 경쟁력 있는 성능을 보이며, 특히 멀티모달 작업과 UI 상호작용에서 강점을 보인다고 보고한다.
Qwen3.7-Plus vs Qwen3.7-Max vs Claude Opus 4.6
| 기능 | Qwen3.7-Plus | Qwen3.7-Max | Claude Opus 4.6 |
|---|---|---|---|
| 입력 모달리티 | 텍스트, 이미지, 비디오 | 텍스트만 | 텍스트, 이미지 |
| 컨텍스트 윈도우 | 최대 1M 토큰 | 1M 토큰 | 대용량 컨텍스트 |
| 비전 이해 | 탁월 | 미지원 | 강함 |
| 에이전트/GUI 상호작용 | 네이티브 중점 | 제한적 | 우수 |
| 장기 지향 텍스트 추론 | 매우 강함 | Qwen 제품군 최고 | 탁월 |
| 최적 사용 사례 | 멀티모달 에이전트 및 생산성 | 코딩, 수학, 심층 추론 | 엔터프라이즈 추론 및 코딩 |
스크린샷, UI 자동화, 시각적 디버깅, 멀티모달 워크플로가 포함된 프로젝트에는 일반적으로 Qwen3.7-Plus가 더 적합하다. 순수 텍스트 기반의 추론 또는 리포지토리 규모 코딩에는 Qwen3.7-Max가 더 강력한 선택지로 남는다.
한계
- Qwen3.7-Plus는 현재 프리뷰 단계의 독점 모델로 공개되어 있으며, 안정적 릴리스 이전에 일부 기능이 변경될 수 있다.
- 함수 호출 및 일부 에이전트 도구 기능은 아직 순차적으로 배포 중이다.
- 순수 텍스트 중심의 고난도 추론 작업에는 Qwen3.7-Max가 다소 더 나은 성능을 낼 수 있다.
- 대부분의 대규모 멀티모달 모델과 마찬가지로, 프로덕션 배포 전에 자체 이미지 및 UI 데이터셋에서 성능을 검증해야 한다.
대표적 활용 사례
- 브라우저, GUI, 터미널 상호작용을 결합한 AI 에이전트.
- 스크린샷 및 UI 캡처 기반 소프트웨어 디버깅.
- 문서, 차트, 대시보드 분석.
- 목업 또는 다이어그램에서 코드를 생성하는 시각적 코딩 어시스턴트.
- 텍스트와 이미지가 혼합된 입력을 다루는 엔터프라이즈 생산성 워크플로.
- 웹 검색과 시각적 이해를 결합한 멀티모달 리서치 어시스턴트.