요약 Qwen3.8 Max Preview는 Alibaba의 Token Plan 생태계와 지원되는 Qoder 제품을 통해 조기 테스트가 가능하지만, 표준 Model Studio 종량제 API 가격은 아직 공개되지 않았습니다. 프로덕션 워크로드에서는 Qwen3.7 Max가 더 안전한 기준선이며, Qwen3.8은 통제된 평가에 더 적합합니다.
Qwen3.8 Max Preview는 Alibaba의 Qwen3.8 세대에 속한 최신 플래그십 프리뷰입니다. 개발자는 Qwen Code와 Qoder 등 지원 제품을 통해 이미 테스트할 수 있지만, 표준 API 가격, 레이트 리밋, 지역별 제공, 안정적인 버전 관리 등 핵심 프로덕션 세부사항은 아직 미완성입니다.
이미 Qwen3.7 Max를 사용하는 팀에게 핵심 질문은 분명합니다: Qwen3.8 Max API는 프로덕션에 준비되었는가, 비용은 얼마인가, 그리고 마이그레이션 가치가 있는가?
이 가이드는 현재 접근 방법, Qoder Credit 가격, 확인된 사양, 그리고 Qwen3.8 Max Preview를 Qwen3.7 Max와 비교 평가하는 방법 등 이러한 의사결정에 초점을 맞춥니다.
Qwen의 공식 Qwen3.8 티저는 2.4T 파라미터 수와 오픈 웨이트 공개 계획을 강조합니다. 호스팅된 qwen3.8-max-preview는 이미 일부 지원 제품에서 사용 가능하며, 더 넓은 오픈 웨이트 공개는 아직 예정 단계입니다.
출처*:* X의 Qwen
Qwen3.8 Max API 가격
2026년 7월 20일 기준, Alibaba는 Qwen3.8 Max의 백만 입력/출력 토큰당 표준 가격을 아직 공개하지 않았습니다.
따라서 개발자는 Qwen3.8이 Qwen3.7 Max 가격을 재사용한다고 가정하거나, Qoder Credits가 직접 API 토큰 비용과 동일하다고 보거나, 일반 제공 이후에도 qwen3.8-max-preview 모델 ID가 변경되지 않을 것이라고 가정하는 것을 피해야 합니다.
Qwen3.8 Max Preview 한눈에 보기
| 항목 | 2026년 7월 20일 기준 상태 |
|---|---|
| 모델 ID | qwen3.8-max-preview |
| 출시 단계 | 프리뷰 |
| 보고된 총 파라미터 | 2.4조 |
| 현재 액세스 경로 | Alibaba Token Plan 생태계 및 지원되는 Qoder 제품 |
| 표준 Model Studio 가격 | 아직 미공개 |
| Qoder 표준 Credit 비율 | 0.5x |
| Qoder 프로모션 비율 | 일반 시간대 0.05x; 오프피크 0.01x |
| 컨텍스트 윈도우 | Qwen Code 통합 메타데이터를 통해 1,000,000 토큰 |
| Thinking 모드 | Qwen Code 통합 메타데이터에서 활성화됨 |
| 이미지 및 비디오 입력 | Qwen Code 통합 메타데이터에서 활성화됨 |
| 오픈 웨이트 | 곧 공개 예정으로 발표됨 |
| 현재 최적 용도 | 통제된 평가 |
핵심 구분점은 신규로 발표된 모델 세대인 Qwen3.8과, 현재 지원 제품에 나타나는 프리뷰 라우트인 qwen3.8-max-preview 사이의 차이입니다.
Qwen의 공식 발표는 Qwen3.8이 2.4조 파라미터 모델이며 오픈 웨이트 공개가 계획되어 있다고 설명합니다. 별도로 Qwen Code는 Token Plan 통합에 qwen3.8-max-preview를 추가했습니다.
Qwen3.8 Max Preview에 대해 확인된 사항은 무엇인가?
Qwen3.8이 아직 프리뷰 단계이므로, 공식 발표와 통합 메타데이터를 구분해서 보는 것이 유용합니다.
| 주장 | 근거 수준 | 현재 상태 |
|---|---|---|
| 총 2.4T 파라미터 | 공식 발표 | Qwen 팀이 보고함 |
| qwen3.8-max-preview 모델 ID | 공식 통합 | Qwen Code Token Plan에 추가됨 |
| 1,000,000-토큰 컨텍스트 | 통합 메타데이터 | Qwen Code에서 구성됨 |
| Thinking 모드 | 통합 메타데이터 | Qwen Code에서 활성화됨 |
| 이미지 및 비디오 입력 | 통합 메타데이터 | Qwen Code에서 활성화됨 |
| 오픈 웨이트 공개 | 공식 의지 | 곧 공개 예정으로 발표됨 |
| 표준 API 토큰 가격 | 미확정 | 아직 공개 목록에 없음 |
| 아키텍처와 활성 파라미터 | 미확정 | 아직 공식 문서화되지 않음 |
| 독립 벤치마크 컨센서스 | 제한적 | 안정적 결론을 내리기엔 시기상조 |
Qwen Code의 구성은 1M 컨텍스트 윈도우, Thinking 모드, 멀티모달 입력 지원에 대한 유용한 근거를 제공합니다. 다만, Alibaba가 완전한 Model Studio 모델 카드를 공개하기 전까지는 이러한 사항이 여전히 통합 수준의 사양임을 유의해야 합니다.
여기서 "Thinking mode"는 무엇을 의미하나요? Qwen Code는
qwen3.8-max-preview에 대해 추론 동작을 활성화합니다. 더 넓은 API 생태계에서는 이러한 기능을 갖춘 모델을 종종 추론 모델로 설명하며, 최종 응답을 생성하기 전에 추가 연산을 사용할 수 있습니다. 표준 Qwen3.8 Max API에 대한 추론/Thinking 토큰의 최종 정산 및 가격은 아직 문서화되지 않았습니다.
Qwen3.8 Max Preview에 액세스하는 방법
현재 확인된 액세스 경로는 다음과 같습니다:
- Alibaba의 Token Plan 생태계
- Qwen Code
- Qoder Desktop
- Qoder JetBrains Plugin
- Qoder CLI
- Qoder Cloud Agents
- Qoder Web 및 Mobile 제품
Qwen Code 공식 저장소는 Token Plan 통합에 qwen3.8-max-preview를 포함하고 있으며, Qoder의 출시 문서는 지원되는 Qoder 제품 전반에서 해당 모델을 나열합니다.
직접 API 통합을 구축하는 개발자는 프리뷰를 프로덕션 시스템에 사용하기 전에 정확한 모델 ID, 엔드포인트 호환성, 지역 제공 여부, 레이트 리밋, 컨텍스트 제한, 과금 동작을 반드시 확인해야 합니다.
Qoder Qwen3.8 가격: 0.05x와 0.01x는 무엇을 의미하나요?
Qoder는 현재 Qwen3.8 Max Preview에 대해 프로모션 할인을 제공하고 있습니다.
| 기간 | Qwen3.8 Max Preview Credit 비율 | 0.5x 표준 비율 대비 할인 |
|---|---|---|
| 일반 시간대 | 0.05x | 90% 할인 |
| 오프피크 시간대 | 0.01x | 98% 할인 |
프로모션은 2026년 7월 19일에 시작되었으며, 종료일은 현재 TBD로 표시되어 있습니다.
Qoder는 오프피크 시간을 22:00–08:00 싱가포르 시간 (UTC+8) 으로 정의합니다. 2026년 7월 미국 서머타임 기간 동안 이는 대략 다음과 같습니다:
- 오전 10:00–오후 8:00 EDT
- 오전 7:00–오후 5:00 PDT
Qoder Credits는 API 토큰 가격이 아닙니다
Qoder Credits는 제품 수준의 리소스 단위입니다. 소비량은 모델, 토큰 사용량, 에이전트 또는 서브 에이전트 워크플로가 트리거하는 호출 수에 따라 달라질 수 있습니다.
다음 계산은 유효합니다:
discounted workflow credits =
base workflow credits × applicable Qoder multiplier
하지만 다음은 아닙니다:
Qwen3.8 API token price =
0.05 × an assumed price per million tokens
Qoder를 통해 모델을 평가하는 팀에는 다음 지표가 더 유용합니다:
credits per successful task =
total Credits consumed / successful tasks
이는 Credits를 API 토큰 가격으로 잘못 변환하지 않고 워크플로를 완료하는 실제 비용을 반영합니다.
Qwen3.8 Max Preview vs Qwen3.7 Max
이미 Qwen3.7 Max를 사용하는 개발자에게 실질적인 질문은 프리뷰가 이를 대체할 준비가 되었는지 여부입니다.
| 항목 | Qwen3.7 Max | Qwen3.8 Max Preview |
|---|---|---|
| 출시 상태 | 검증된 프로덕션 모델 | 프리뷰 |
| 표준 종량제 가격 | 공개됨 | 아직 미공개 |
| 지역 배포 | 문서화됨 | 아직 완전 문서화 전 |
| 버전 관리된 모델 ID | 제공됨 | GA에 대해 아직 문서화 전 |
| 컨텍스트 캐싱 | 문서화됨 | 프로덕션 규칙 대기 중 |
| 배치 지원 | 지원 라우트에서 제공 | 아직 문서화 전 |
| 비용 모델링 | 예측 가능 | 제한적 |
| 현재 최적 용도 | 프로덕션 | 평가 |
Alibaba Cloud는 지역별 배포 범위에 따라 Qwen3.7 Max 가격을 문서화하고 있습니다. 가격과 프로모션은 지역에 따라 달라질 수 있으므로, 공식 Model Studio 가격 페이지를 확인하세요.
CometAPI를 사용하는 팀에는 Qwen3.7 Max API가 향후 Qwen3.8 워크로드 평가를 위한 실질적인 프로덕션 기준선을 제공합니다.
더 가볍거나 비용 민감한 사용 사례에는 Qwen3.7 Plus도 비교 지점이 됩니다.
지금 Qwen3.7 Max 사용자는 Qwen3.8로 업그레이드해야 할까요?
실용적인 접근은 다음과 같습니다:
지금 Qwen3.8 Max Preview를 테스트하되, 품질 향상이 운영 및 비용의 트레이드오프를 정당화할 때만 마이그레이션하세요.
다음 경우 Qwen3.8 Max Preview를 테스트하세요:
- 워크로드에 어려운 코딩 또는 에이전트 작업이 포함됨
- 추론 집약적 워크플로를 평가 중
- 장문 컨텍스트 또는 멀티모달 기능이 필요함
- 프리뷰 단계의 동작 변경을 수용 가능
- 자동화된 테스트 또는 휴먼 리뷰 루브릭을 보유
다음 경우 프로덕션에서는 Qwen3.7 Max를 유지하세요:
- 예측 가능한 토큰 비용이 필요함
- 지역 배포가 중요함
- 안정적인 모델 ID와 버전 관리가 필요함
- 아키텍처가 문서화된 캐싱 또는 배치 동작에 의존함
- 기존 Qwen3.7 Max 성능이 요구 사항을 이미 충족함
보고된 2.4T 파라미터 수만으로 마이그레이션을 결정해서는 안 됩니다.
프로덕션 AI 시스템에서는 보통 총 파라미터 수보다도 해결률, 지연 시간, 재시도, 휴먼 수정 시간, 성공 작업당 비용이 더 유용합니다.
Qwen3.8 Max Preview 평가 방법
출시 주장이나 단일 벤치마크에 의존하기보다, 실제 워크로드를 기반으로 소규모 평가 세트를 구축하세요.
실용적인 시작점은 20–30개의 대표 작업입니다.
| 워크로드 | 예시 작업 | 측정 항목 |
|---|---|---|
| 리포지토리 코딩 | 다중 파일 수정, 리팩터링, 테스트 | 패스율, 재시도, 도구 호출 |
| 풀스택 개발 | 기능 구현 | 완성도, 수정 시간 |
| 데이터 분석 | CSV, 표, 스크립트 | 정확도, 추론, 산출물 품질 |
| 오피스 워크플로 | 문서와 스프레드시트 | 완결성, 휴먼 편집 |
| 장문 컨텍스트 작업 | 대규모 리포지토리 또는 문서 | 회상율, 일관성 |
| 추론 작업 | 다단계 기술 문제 | 정확도, 지연 |
| 일상적 코딩 | 간단한 수정 | 더 큰 모델이 가치를 추가하는지 여부 |
각 작업에 대해 다음을 기록하세요:
- 성공/실패
- 모델 및 도구 호출
- 재시도 횟수
- 엔드 투 엔드 지연
- 입력 및 출력 토큰
- 노출되는 경우 추론 토큰
- 사용된 Qoder Credits
- 휴먼 수정 시간
Qwen3.7 Max의 경우:
cost per successful task =
total API cost / successful tasks
Qoder를 통한 Qwen3.8 Max Preview의 경우:
credits per successful task =
total Credits consumed / successful tasks
표준 Qwen3.8 API 가격이 제공되면 동일한 평가를 다시 실행하고 다음을 비교하세요:
품질 × 지연 × 신뢰성 × 비용
이는 벤치마크 점수만보다 더 유용한 마이그레이션 시그널을 제공합니다.
개발자가 다음으로 주목해야 할 사항
- 공식 Model Studio 모델 카드
- 입력, 출력, 캐시된 입력, 추론 토큰 가격
- 지역별 API 제공 및 레이트 리밋
- 안정적인 모델 ID와 버전 관리
- 컨텍스트 캐시와 배치 지원
- 오픈 웨이트 저장소와 라이선스
- 아키텍처와 활성 파라미터 세부사항
- 독립적인 코딩, 에이전트, 멀티모달, 지연, 효율성 벤치마크
FAQ
Qwen3.8 Max API를 사용할 수 있나요?
Qwen3.8 Max Preview는 Alibaba의 Token Plan 생태계와 지원되는 Qoder 제품을 통해 접근할 수 있습니다. 완전한 일반 제공 Model Studio API 오퍼링은 아직 공개적으로 문서화되지 않았습니다.
Qwen3.8 Max API 비용은 얼마인가요?
백만 토큰당 표준 가격은 아직 공개되지 않았습니다. Qoder는 현재 0.05x와 0.01x의 프로모션 Credit 비율을 제공하지만, 이는 일반 API 토큰 가격이 아닌 Qoder Credits입니다.
Qwen3.8 Max Preview는 1M 컨텍스트 윈도우를 제공하나요?
Qwen Code의 Token Plan 통합 메타데이터는 qwen3.8-max-preview에 대해 1,000,000-토큰 컨텍스트 윈도우를 구성합니다. Alibaba가 최종 문서를 공개할 때 엔드포인트별 프로덕션 제한을 반드시 확인해야 합니다.
OpenAI 호환 API를 통해 Qwen3.8 Max를 사용할 수 있나요?
최종 OpenAI 호환 API 계약을 갖춘 폭넓게 문서화된 프로덕션 Qwen3.8 Max 엔드포인트는 아직 공개되지 않았습니다. 통합 전에 정확한 프리뷰 엔드포인트와 지원 매개변수를 확인하세요.
Qwen3.7 Max를 Qwen3.8 Max Preview로 대체해야 하나요?
대다수의 프로덕션 시스템에는 아직 이릅니다. Qwen3.7 Max를 안정적인 기준선으로 사용하고, Qwen3.8 Max Preview는 가격과 프로덕션 동작이 더 잘 문서화될 때까지 평가하세요.
CometAPI에서 Qwen3.8을 준비하세요
Qwen3.8 Max 지원은 곧 CometAPI에 추가될 예정입니다. 제공되면 팀은 CometAPI의 통합 API 워크플로를 통해 모델을 테스트하고 기존 프로덕션 모델과 직접 비교할 수 있습니다.
대기하는 동안, **Kimi K3 **는 고급 코딩, 추론 및 에이전트 워크플로에 대한 실용적인 대안이 될 수 있습니다. 팀은 오늘 Kimi K3로 평가 기준선을 구축한 다음, Qwen3.8 Max가 제공되면 동일한 작업을 재실행할 수 있습니다.
이미 Qwen 제품군을 사용하는 팀에게는 Qwen3.7 Max API가 모델 세대 간 품질, 지연, 비용 향상을 측정하는 유용한 기준점으로 남아 있습니다.
또한 최신 모델 제공 현황은 CometAPI Model Catalog에서 확인할 수 있습니다.
