TL;DR Qwen3.8 Max Preview está disponible para pruebas tempranas a través del ecosistema Token Plan de Alibaba y los productos Qoder compatibles, pero aún no se han publicado los precios estándar de API de pago por uso de Model Studio. Para cargas de producción, Qwen3.7 Max sigue siendo la base más segura, mientras que Qwen3.8 es más adecuado para evaluaciones controladas.
Qwen3.8 Max Preview es la última vista previa insignia asociada con la generación Qwen3.8 de Alibaba. Los desarrolladores ya pueden probarla a través de productos compatibles como Qwen Code y Qoder, mientras que detalles clave de producción —incluidos precios estándar de API, límites de tasa, disponibilidad regional y versionado estable— siguen incompletos.
Para equipos que ya usan Qwen3.7 Max, las preguntas clave son directas: ¿La API de Qwen3.8 Max está lista para producción, cuánto cuesta y vale la pena migrar?
Esta guía se centra en esas decisiones, incluidos los métodos de acceso actuales, la tarificación de Créditos de Qoder, las especificaciones confirmadas y cómo evaluar Qwen3.8 Max Preview frente a Qwen3.7 Max.
El teaser oficial de Qwen3.8 de Qwen destaca el recuento de 2.4T parámetros y el lanzamiento de pesos abiertos previsto. El servicio alojado qwen3.8-max-preview ya está disponible a través de productos seleccionados, mientras que el lanzamiento más amplio de pesos abiertos aún está por llegar.
Fuente*:* Qwen en X
Precios de la API de Qwen3.8 Max
A 20 de julio de 2026, Alibaba no ha publicado un precio estándar por millón de tokens de entrada o salida para Qwen3.8 Max.
Por lo tanto, los desarrolladores deben evitar asumir que Qwen3.8 reutilizará los precios de Qwen3.7 Max, que los Créditos de Qoder equivalen a costes directos de tokens de API o que el ID de modelo qwen3.8-max-preview permanecerá sin cambios tras la disponibilidad general.
Qwen3.8 Max Preview de un vistazo
| Elemento | Estado a 20 de julio de 2026 |
|---|---|
| ID del modelo | qwen3.8-max-preview |
| Etapa de lanzamiento | Vista previa |
| Parámetros totales reportados | 2.4 billones |
| Acceso actual | Ecosistema Token Plan de Alibaba y productos de Qoder compatibles |
| Precios estándar de Model Studio | Aún no publicado |
| Tasa de Créditos estándar de Qoder | 0.5x |
| Tasa promocional de Qoder | 0.05x horas regulares; 0.01x fuera de pico |
| Ventana de contexto | 1,000,000 tokens mediante metadatos de integración de Qwen Code |
| Modo de pensamiento | Habilitado en los metadatos de integración de Qwen Code |
| Entrada de imagen y video | Habilitada en los metadatos de integración de Qwen Code |
| Pesos abiertos | Anunciado como próximamente |
| Mejor uso hoy | Evaluación controlada |
La distinción clave es entre Qwen3.8, la nueva generación de modelos anunciada, y qwen3.8-max-preview, la ruta de vista previa que actualmente aparece en productos compatibles.
El anuncio oficial de Qwen describe Qwen3.8 como un modelo de 2.4 billones de parámetros y afirma que está previsto un lanzamiento de pesos abiertos. Qwen Code añadió por separado qwen3.8-max-preview a su integración del Token Plan.
¿Qué está confirmado sobre Qwen3.8 Max Preview?
Dado que Qwen3.8 aún está en vista previa, conviene separar los anuncios oficiales de los metadatos de integración.
| Afirmación | Nivel de evidencia | Estado actual |
|---|---|---|
| 2.4T de parámetros totales | Anuncio oficial | Informado por el equipo de Qwen |
| ID del modelo qwen3.8-max-preview | Integración oficial | Añadido al Token Plan de Qwen Code |
| Contexto de 1,000,000 tokens | Metadatos de integración | Configurado en Qwen Code |
| Modo de pensamiento | Metadatos de integración | Habilitado en Qwen Code |
| Entrada de imagen y video | Metadatos de integración | Habilitada en Qwen Code |
| Lanzamiento de pesos abiertos | Intención oficial | Anunciado como próximamente |
| Precios estándar de tokens de API | Desconocido | Aún no listado públicamente |
| Arquitectura y parámetros activos | Desconocido | Aún no documentado públicamente |
| Consenso de benchmarks independientes | Limitado | Demasiado pronto para una conclusión estable |
La configuración de Qwen Code proporciona evidencia útil para la ventana de contexto de 1M, el modo de pensamiento y la compatibilidad de entrada multimodal. Sin embargo, siguen siendo especificaciones a nivel de integración hasta que Alibaba publique una ficha de modelo completa en Model Studio.
¿Qué significa «Thinking mode» aquí? Qwen Code habilita el comportamiento de pensamiento para
qwen3.8-max-preview. En el ecosistema de API más amplio, a los modelos con esta capacidad a menudo se les describe como modelos de razonamiento, donde se puede usar cómputo adicional antes de generar una respuesta final. La contabilización y los precios finales de tokens de razonamiento o pensamiento aún no se han documentado para una API estándar de Qwen3.8 Max.
Cómo acceder a Qwen3.8 Max Preview
Las rutas de acceso confirmadas incluyen:
- Ecosistema Token Plan de Alibaba
- Qwen Code
- Qoder Desktop
- Qoder JetBrains Plugin
- Qoder CLI
- Qoder Cloud Agents
- Productos web y móviles de Qoder
El repositorio oficial de Qwen Code incluye qwen3.8-max-preview en su integración del Token Plan, mientras que la documentación de lanzamiento de Qoder lista el modelo en los productos de Qoder compatibles.
Los desarrolladores que construyan integraciones directas de API deben confirmar el ID de modelo exacto, la compatibilidad del endpoint, la disponibilidad regional, los límites de tasa, los límites de contexto y el comportamiento de facturación antes de usar la vista previa en sistemas de producción.
Precios de Qwen3.8 en Qoder: ¿Qué significan 0.05x y 0.01x?
Qoder ofrece actualmente un descuento promocional para Qwen3.8 Max Preview.
| Periodo | Tasa de Créditos de Qwen3.8 Max Preview | Descuento vs. tasa estándar de 0.5x |
|---|---|---|
| Horas regulares | 0.05x | 90% de descuento |
| Horas fuera de pico | 0.01x | 98% de descuento |
La promoción comenzó el 19 de julio de 2026, con fecha de finalización actualmente en TBD.
Qoder define su periodo fuera de pico como 22:00–08:00 hora de Singapur (UTC+8). Durante el horario de verano de EE. UU. en julio de 2026, esto corresponde aproximadamente a:
- 10:00 AM–8:00 PM EDT
- 7:00 AM–5:00 PM PDT
Los Créditos de Qoder no son precios de tokens de API
Qoder Credits es una unidad de recursos a nivel de producto. El consumo puede variar según el modelo, el uso de tokens y el número de llamadas activadas por flujos de trabajo de agente o subagente.
Este cálculo es válido:
discounted workflow credits =
base workflow credits × applicable Qoder multiplier
Pero este no:
Qwen3.8 API token price =
0.05 × an assumed price per million tokens
Para equipos que evalúan el modelo a través de Qoder, una métrica más útil es:
credits per successful task =
total Credits consumed / successful tasks
Esto refleja el coste real de completar un flujo de trabajo sin convertir incorrectamente Créditos en precios de tokens de API.
Qwen3.8 Max Preview vs Qwen3.7 Max
Para desarrolladores que ya usan Qwen3.7 Max, la pregunta práctica es si la vista previa está lista para reemplazarlo.
| Dimensión | Qwen3.7 Max | Qwen3.8 Max Preview |
|---|---|---|
| Estado de lanzamiento | Modelo de producción establecido | Vista previa |
| Precios estándar de pago por uso | Publicado | Aún no publicado |
| Despliegue regional | Documentado | Aún no totalmente documentado |
| IDs de modelo versionados | Disponibles | Aún no documentados para GA |
| Caché de contexto | Documentado | Reglas de producción pendientes |
| Compatibilidad con lotes | Disponible en las rutas compatibles | Aún no documentado |
| Modelado de costos | Predecible | Limitado |
| Mejor uso hoy | Producción | Evaluación |
Alibaba Cloud documenta los precios de Qwen3.7 Max en diferentes ámbitos de despliegue. Los precios y promociones pueden variar por región, por lo que los desarrolladores deben consultar la página de precios de Model Studio oficial.
Para equipos que usan CometAPI, la API de Qwen3.7 Max proporciona una base práctica de producción para evaluar futuras cargas de Qwen3.8.
Para casos de uso más ligeros o sensibles al coste, Qwen3.7 Plus ofrece otro punto de comparación.
¿Deberían los usuarios de Qwen3.7 Max actualizar a Qwen3.8 ahora?
El enfoque práctico es:
Prueba Qwen3.8 Max Preview ahora, pero migra solo cuando sus ganancias de calidad justifiquen las compensaciones operativas y de coste.
Prueba Qwen3.8 Max Preview si:
- Tu carga incluye tareas de programación o de agentes difíciles.
- Estás evaluando flujos con mucho razonamiento.
- Necesitas capacidades de contexto largo o multimodales.
- Puedes tolerar cambios de comportamiento propios de una vista previa.
- Cuentas con pruebas automatizadas o rúbricas de revisión humana.
Mantén Qwen3.7 Max en producción si:
- Necesitas costes de tokens predecibles.
- El despliegue regional es importante.
- Se requieren IDs de modelo y versionado estables.
- Tu arquitectura depende de un comportamiento documentado de caché o lotes.
- El rendimiento actual de Qwen3.7 Max ya cumple los requisitos.
El conteo reportado de 2.4T parámetros no debería por sí solo determinar la migración.
Para sistemas de IA de producción, la tasa de resolución, la latencia, los reintentos, el tiempo de corrección humana y el coste por tarea exitosa suelen ser más útiles que el recuento total de parámetros.
Cómo evaluar Qwen3.8 Max Preview
En lugar de basarte en afirmaciones de lanzamiento o en un único benchmark, crea un pequeño conjunto de evaluación basado en tus cargas reales.
Un punto de partida práctico es 20–30 tareas representativas.
| Carga de trabajo | Tareas de ejemplo | Qué medir |
|---|---|---|
| Programación en repositorios | Correcciones en múltiples archivos, refactorización, pruebas | Tasa de aciertos, reintentos, llamadas a herramientas |
| Desarrollo full-stack | Implementación de funcionalidades | Calidad de la entrega, tiempo de corrección |
| Análisis de datos | CSV, tablas, scripts | Precisión, razonamiento, calidad de artefactos |
| Flujos de oficina | Documentos y hojas de cálculo | Integridad, ediciones humanas |
| Tareas de contexto largo | Repositorios o documentos grandes | Recuerdo, consistencia |
| Tareas de razonamiento | Problemas técnicos de múltiples pasos | Precisión, latencia |
| Programación rutinaria | Correcciones simples | Si el modelo más grande aporta valor |
Para cada tarea, registra:
- Acierto o fallo
- Llamadas de modelo y herramientas
- Reintentos
- Latencia de extremo a extremo
- Tokens de entrada y salida
- Tokens de razonamiento cuando estén expuestos
- Créditos de Qoder consumidos
- Tiempo de corrección humana
Para Qwen3.7 Max:
cost per successful task =
total API cost / successful tasks
Para Qwen3.8 Max Preview a través de Qoder:
credits per successful task =
total Credits consumed / successful tasks
Una vez que los precios estándar de la API de Qwen3.8 estén disponibles, vuelve a ejecutar la misma evaluación y compara:
calidad × latencia × fiabilidad × coste
Eso ofrece una señal de migración más útil que los puntajes de benchmarks por sí solos.
Qué deberían observar los desarrolladores a continuación
Los avances más importantes de Qwen3.8 a seguir son:
- Ficha oficial del modelo en Model Studio.
- Precios de tokens de entrada, salida, entrada en caché y de razonamiento.
- Disponibilidad regional de la API y límites de tasa.
- IDs de modelo estables y versionado.
- Compatibilidad con Context Cache y Batch.
- Repositorio de pesos abiertos y licencia.
- Detalles de arquitectura y parámetros activos.
- Benchmarks independientes de programación, agentes, multimodalidad, latencia y eficiencia.
Preguntas frecuentes
¿Está disponible la API de Qwen3.8 Max?
Qwen3.8 Max Preview es accesible a través del ecosistema Token Plan de Alibaba y los productos Qoder compatibles. Una oferta completa de API de Model Studio con disponibilidad general aún no se ha documentado públicamente.
¿Cuánto cuesta la API de Qwen3.8 Max?
Aún no se han publicado precios estándar por millón de tokens. Qoder ofrece actualmente tasas de Créditos promocionales de 0.05x y 0.01x, pero estos son Créditos de Qoder y no precios generales de tokens de API.
¿Qwen3.8 Max Preview tiene una ventana de contexto de 1M?
Los metadatos de la integración del Token Plan de Qwen Code configuran una ventana de contexto de 1,000,000 tokens para qwen3.8-max-preview. Los límites específicos de producción por endpoint deben confirmarse cuando Alibaba publique la documentación final.
¿Puedo usar Qwen3.8 Max a través de una API compatible con OpenAI?
Aún no se ha publicado un endpoint de producción ampliamente documentado de Qwen3.8 Max con un contrato final de API compatible con OpenAI. Los desarrolladores deben verificar el endpoint de vista previa exacto y los parámetros admitidos antes de la integración.
¿Debería reemplazar Qwen3.7 Max con Qwen3.8 Max Preview?
Para la mayoría de los sistemas de producción, aún no. Usa Qwen3.7 Max como base estable y evalúa Qwen3.8 Max Preview hasta que sus precios y comportamiento de producción estén mejor documentados.
Prepárate para Qwen3.8 en CometAPI
La compatibilidad con Qwen3.8 Max llegará pronto a CometAPI. Una vez disponible, los equipos podrán probar el modelo a través del flujo de trabajo de API unificado de CometAPI y compararlo directamente con los modelos de producción existentes.
Mientras tanto, **Kimi K3 **puede servir como una alternativa práctica para programación avanzada, razonamiento y flujos de trabajo con agentes. Los equipos pueden empezar a construir su línea base de evaluación con Kimi K3 hoy y luego volver a ejecutar las mismas tareas en Qwen3.8 Max cuando esté disponible.
Para equipos que ya usan la familia Qwen, la API de Qwen3.7 Max sigue siendo un punto de referencia útil para medir mejoras de calidad, latencia y coste entre generaciones de modelos.
También puedes explorar el Catálogo de Modelos de CometAPI para conocer la disponibilidad más reciente de modelos.
