Gemini 3.6 Flash and 3.5 Flash Lite are now live on CometAPI →

Próximamente

Q

Qwen3.8-Max

Entrada:$60/M
Salida:$240/M
Publicado:Jul 19, 2026

Qwen3.8-Max-Preview es una versión preliminar del gran modelo de lenguaje insignia de Alibaba, lanzada el 19 de julio de 2026. Tiene 2.4T de parámetros, adopta la arquitectura MoE, admite cambiar entre modos de razonamiento y de inferencia rápida, puede manejar diversos formatos de contenido y ofrece un rendimiento excelente en escenarios como la ingeniería de software, el trabajo de oficina profesional y el razonamiento lógico complejo, solo por detrás de Fable 5 de Anthropic.

Nuevo
Uso comercial

Qué es Qwen3.8 Max

Qwen3.8 Max es el nuevo modelo de lenguaje grande (LLM) insignia de Alibaba. Está diseñado para competir con los modelos de frontera más potentes en programación, razonamiento, flujos de trabajo de agentes y tareas multimodales (texto, imágenes, documentos y video).

Innovaciones frente a Qwen anteriores:

  • Salto de parámetros de cientos de miles de millones a billones.
  • Mayor énfasis en el “cowork” profesional (programación + automatización de oficina).
  • Compromiso de pesos abiertos para el modelo completo (ruptura con cierto historial de código cerrado en la gama Max).

Características e innovaciones clave de Qwen3.8-Max

  • 2.4 billones de parámetros totales (según el proveedor; la proporción de parámetros activos/MoE aún no se ha revelado por completo).
  • Capacidades multimodales: Primer modelo Qwen >1T parámetros con soporte nativo para texto, imágenes, video y documentos.
  • Fortalezas específicas: Desarrollo de software full‑stack, programación agéntica, razonamiento de largo contexto, análisis de datos y flujos de trabajo de oficina. Se basa en los éxitos de sus predecesores en benchmarks como SWE-Bench, GPQA y LiveCodeBench.
  • Razonamiento y capacidades agénticas mejoradas: Mejoras en comprensión de largo contexto, uso de herramientas y flujos de trabajo de múltiples pasos. Fuerte en tareas profesionales según afirma Alibaba.
  • Compatibilidad con API: Soporte de protocolos de OpenAI y Anthropic que facilita la integración — sustituya endpoints con cambios mínimos de código.
  • Optimizaciones de eficiencia: Activación dispersa + infraestructura de Alibaba Cloud para menor latencia/coste a escala.
AspectoQwen3.8-Max (Preview)Qwen3.7-MaxKimi K3 (Moonshot)
Parámetros2.4T~1T+ (anterior)2.8T
MultimodalSí (img/video/docs)Limitado/centrado en textoSí (visión/3D nativo)
Ventana de contextoAmplia (multimodal)262K+1M tokens
FortalezasAgéntico, programación, productividad, multimodalAgentes de largo horizonte, razonamientoPesos abiertos, arenas de programación, razonamiento
Benchmarks (Ejemplos)Fuerte en KingBench (~2.º), líder internoGPQA 92.4, SWE-Pro 60.6Lidera muchos (Frontend Arena), competitivo en general
Precios (aprox. API)Vista previa ~10% del estándarCompetitivo (~$1-5/M combinado)$3 entrada / $15 salida por 1M
AccesoVista previa en Alibaba + CometAPIAlibaba + CometAPIAPI ahora, pesos abiertos pronto
Ideal paraFlujos de trabajo empresariales multimodalesAndamiajes de agentes, desarrolloAlojamiento propio, personalización

Innovaciones de Qwen 3.8 Max que impulsan impacto real y casos de uso

  • Programación y desarrollo: Superior en full‑stack, corrección de errores, mejoras en Terminal-Bench.
  • Empresarial: Análisis de datos, automatización de oficina mediante Qoder.
  • Aplicaciones multimodales: Comprensión de imágenes/video para creatividad/herramientas.
  • Agentes: El contexto largo permite agentes complejos con estado.

Consejo de integración con CometAPI: Use el endpoint unificado de CometAPI para enrutar el tráfico de forma dinámica — p. ej., con conmutación por error de Qwen 3.8 a Qwen 3.7 o Claude según costo/rendimiento. Reduce el riesgo del proveedor y optimiza el gasto.

Limitaciones y consideraciones potenciales de Qwen 3.8 Max

Factores regulatorios/geopolíticos (controles de EE. UU.). 3.8 a Qwen 3.7 o Claude según costo/rendimiento. Reduce el riesgo del proveedor y optimiza el gasto.

Etapa de vista previa: sin benchmarks independientes completos.

Parámetros activos no divulgados → incertidumbre de costo/latencia.

Autoalojamiento desafiante a escala completa.

¿Por qué usar Qwen3.8 Max en CometAPI?

CometAPI es una plataforma/agregador unificado de APIs de IA que da a los desarrolladores acceso a 500+ modelos (de OpenAI, Anthropic, Google, Alibaba/Qwen, DeepSeek, etc.) mediante un único endpoint compatible con OpenAI. Esto evita gestionar múltiples claves de API, cuentas de facturación e integraciones.

Razones para elegir Qwen3.8 Max específicamente vía CometAPI (o agregadores similares):

Comodidad y acceso unificado — Cambie entre Qwen3.8 Max y otros modelos top (p. ej., Claude, GPT, Grok, Kimi) con una sola clave de API y una interfaz consistente. Ideal para pruebas, comparaciones A/B o apps en producción que necesitan modelos de respaldo.

Precios competitivos/con descuento — El acceso en vista previa en Alibaba ya está descontado (p. ej., 90% menos o más durante promociones). Agregadores como CometAPI suelen ofrecer tarifas atractivas, descuentos por volumen o niveles gratuitos frente a los precios directos del proveedor.

Amigable para desarrolladores en producción:

  • Integración sencilla en herramientas como Cursor, Cline, Claude Code, agentes o apps personalizadas.
  • Bueno para tareas de alto rendimiento donde su escala (razonamiento, contexto largo, multimodalidad, programación) destaca.
  • Fiabilidad y tiempo de actividad gracias a la infraestructura del agregador.

Acceso temprano a un modelo de vanguardia — Al ser un lanzamiento de nivel frontera (especialmente fuerte en programación/trabajo agéntico), le permite experimentar con capacidades de última generación sin configuración directa en Alibaba Cloud.

Preguntas frecuentes