
Qwen 3.8 Max cuesta $2/M de entrada y $6/M de salida. Compara las tarifas de caché, los costos de herramientas, ejemplos reales, límites y recomendaciones de migración desde Qwen 3.7.

En la víspera del Año Nuevo Lunar (16–17 de febrero de 2026), Alibaba Group lanzó su modelo de próxima generación, Qwen 3.5 — un modelo multimodal, con capacidad de agente, posicionado para lo que la compañía denomina una era de “agentic AI”. La cobertura del sector destacó afirmaciones de grandes mejoras en eficiencia y coste, y un soporte rápido por parte de proveedores de hardware y de la nube. CometAPI ofrece opciones para desarrolladores que quieren acceso a una API alojada o una integración compatible con OpenAI, mientras que AMD anunció compatibilidad de GPU desde el día 0 para el modelo en su línea Instinct. ByteDance es uno de los principales competidores nacionales que lanzó mejoras en el mismo periodo festivo. OpenAI sigue siendo un punto de referencia para la comparación en los benchmarks y en el estilo de integración.

El nuevo Qwen3.5 de Alibaba es un gran paso adelante — reduce la brecha con ciertos modelos de frontera de código cerrado y, en algunas cargas de trabajo agénticas / multimodales, afirma alcanzar la paridad o incluso ventaja frente a ellos en diversos benchmarks públicos y pruebas internas. Sin embargo, “superar” depende de la carga de trabajo: en el uso agéntico de herramientas, la comprensión multimodal de documentos/vídeos y el coste por inferencia, se informa de que Qwen3.5 es extremadamente competitivo (y en algunos gráficos de proveedores, por delante). La conclusión práctica: Qwen3.5 parece ser un auténtico contendiente de frontera a principios de 2026 — para muchos casos de uso empresariales agénticos y multimodales ahora es viable como opción principal.
Qwen3-Max-Thinking de Alibaba —la variante “thinking” de la enorme familia Qwen3— se ha convertido en uno de los grandes titulares de la IA este año: un buque insignia con más de un billón de parámetros, afinado para el razonamiento profundo, la comprensión de contextos largos y flujos de trabajo orientados a agentes. En resumen, es la iniciativa del proveedor para dotar a las aplicaciones de un modo de pensamiento “Sistema 2” más lento y más rastreable: el modelo no solo responde, también puede mostrar (y utilizar) pasos, herramientas y verificaciones intermedias de forma controlada.

El equipo Qwen de Alibaba ha lanzado Qwen3-Max-Preview (Instruct), el modelo más grande de la compañía hasta la fecha, con más de un billón de parámetros, y lo ha logrado.

Qwen3-Max-Preview es el último modelo insignia de vista previa de Alibaba en la familia Qwen3: un modelo de tipo Mixture-of-Experts (MoE) con más de un billón de parámetros y una ventana de contexto de tokens ultralarga de 262k, disponible en versión preliminar para uso empresarial y en la nube. Se centra en el razonamiento profundo, la comprensión de documentos extensos, la codificación y los flujos de trabajo de agencia.

El último avance de Alibaba en inteligencia artificial, Qwen3-Coder, marca un hito significativo en el panorama en rápida evolución del software impulsado por IA.

La API Qwen3-Coder es una API de generación y finalización de código basada en la familia de modelos de lenguaje Qwen3 de Alibaba, optimizada para tareas de desarrollo de software como escribir, comprender y depurar código en múltiples lenguajes de programación.