Gemini 3.6 Flash and 3.5 Flash Lite are now live on CometAPI →

Em breve

Q

Qwen3.8-Max

Entrada:$60/M
Saída:$240/M
Lançado:Jul 19, 2026

Qwen3.8-Max-Preview é uma versão prévia do modelo de linguagem carro-chefe da Alibaba, lançada em 19 de julho de 2026. Ele possui 2.4T de parâmetros, adota a arquitetura MoE, suporta a alternância entre os modos de raciocínio e de inferência rápida, pode lidar com diversos formatos de conteúdo e apresenta desempenho excelente em cenários como engenharia de código, tarefas profissionais de escritório e raciocínio lógico complexo, ficando atrás apenas do Fable 5 da Anthropic.

Novo
Uso comercial

O que é Qwen3.8 Max

Qwen3.8 Max é o mais novo modelo de linguagem grande (LLM) flagship da Alibaba. Ele foi projetado para competir com os modelos de ponta mais fortes em programação, raciocínio, fluxos de trabalho com agentes e tarefas multimodais (texto, imagens, documentos e vídeo).

Inovações em relação ao Qwen anterior:

  • Salto de parâmetros de centenas de bilhões para trilhões.
  • Ênfase mais forte em “cowork” profissional (programação + automação de escritório).
  • Compromisso de pesos abertos para o modelo completo (afastando-se de algum histórico de código fechado na linha Max).

Recursos e principais inovações do Qwen3.8-Max

  • 2,4 trilhões de parâmetros totais (reportado pelo fornecedor; parâmetros ativos/relação MoE ainda não totalmente divulgados).
  • Capacidades multimodais: Primeiro modelo Qwen >1T de parâmetros com suporte nativo a texto, imagens, vídeo e documentos.
  • Forças direcionadas: Desenvolvimento de software full-stack, programação agentiva, raciocínio em contexto longo, análise de dados e fluxos de trabalho de escritório. Baseia-se nos sucessos dos predecessores em benchmarks como SWE-Bench, GPQA e LiveCodeBench.
  • Raciocínio aprimorado e capacidades agentivas: Melhorias em compreensão de contexto longo, uso de ferramentas e fluxos de trabalho multietapa. Forte em tarefas profissionais, segundo a Alibaba.
  • Compatibilidade de API: Suporte aos protocolos OpenAI e Anthropic facilita a integração — troque endpoints com mudanças mínimas de código.
  • Otimizações de eficiência: Ativação esparsa + infraestrutura da Alibaba Cloud para menor latência/custo em escala.
AspectoQwen3.8-Max (Prévia)Qwen3.7-MaxKimi K3 (Moonshot)
Parâmetros2,4T~1T+ (anterior)2,8T
MultimodalSim (img/vídeo/docs)Limitado/Focado em textoSim (visão/3D nativas)
Janela de contextoGrande (multimodal)262K+1M tokens
Pontos fortesCom agentes, programação, produtividade, multimodalAgentes de longo horizonte, raciocínioPesos abertos, arenas de programação, raciocínio
Benchmarks (exemplos)Forte no KingBench (~2º), topo internoGPQA 92.4, SWE-Pro 60.6Lidera muitos (Frontend Arena), competitivo no geral
Preços (API aprox.)Prévia ~10% do padrãoCompetitivo (~$1-5/M combinado)$3 entrada / $15 saída por 1M
AcessoPrévia da Alibaba + CometAPIAlibaba + CometAPIAPI agora, pesos abertos em breve
Melhor paraFluxos de trabalho multimodais corporativosEstruturas de agentes, desenvolvimentoHospedagem própria, customização

Inovações do Qwen 3.8 Max que impulsionam impacto real e casos de uso

  • Programação e desenvolvimento: Superior em full-stack, correção de bugs, melhorias no Terminal-Bench.
  • Empresarial: Análise de dados, automação de escritório via Qoder.
  • Apps multimodais: Compreensão de imagem/vídeo para criação/ferramentas.
  • Agentes: O contexto longo permite agentes complexos e com estado.

Dica de integração do CometAPI: Use o endpoint unificado do CometAPI para rotear o tráfego dinamicamente — por exemplo, fallback de Qwen 3.8 para Qwen 3.7 ou Claude com base em custo/desempenho. Reduz o risco de fornecedor e otimiza os gastos.

Limitações e considerações potenciais do Qwen 3.8 Max

Fatores regulatórios/geopolíticos (controles dos EUA). 3.8 para Qwen 3.7 ou Claude com base em custo/desempenho. Reduz o risco de fornecedor e otimiza os gastos.

Estágio de prévia: Sem benchmarks independentes completos.

Parâmetros ativos não divulgados → incerteza de custo/latência.

Hospedagem própria desafiadora em escala total.

Por que usar Qwen3.8 Max no CometAPI?

CometAPI é uma plataforma/agregador unificado de API de IA que dá aos desenvolvedores acesso a 500+ modelos (de OpenAI, Anthropic, Google, Alibaba/Qwen, DeepSeek etc.) por meio de um único endpoint compatível com OpenAI. Isso evita gerenciar várias chaves de API, contas de faturamento e integrações.

Razões para escolher Qwen3.8 Max especificamente via CometAPI (ou agregadores similares):

Conveniência e acesso unificado — Alterne entre Qwen3.8 Max e outros modelos de ponta (por exemplo, Claude, GPT, Grok, Kimi) com uma única chave de API e interface consistente. Ideal para testes, comparações A/B ou apps de produção que precisam de modelos de fallback.

Preços competitivos/com descontos — O acesso em prévia na Alibaba já é com desconto (por exemplo, 90% off ou mais durante promoções). Agregadores como o CometAPI frequentemente oferecem tarifas atraentes, descontos por volume ou camadas gratuitas em comparação ao preço direto do fornecedor.

Amigável para desenvolvedores em produção:

  • Integração fácil em ferramentas como Cursor, Cline, Claude Code, agentes ou apps personalizados.
  • Bom para tarefas de alto desempenho em que sua escala (raciocínio, contexto longo, multimodalidade, programação) se destaca.
  • Confiabilidade e disponibilidade da infraestrutura do agregador.

Acesso antecipado a um modelo de ponta — Como um lançamento de nível de fronteira (especialmente forte em programação/trabalho agentivo), permite experimentar capacidades de última geração sem configuração direta no Alibaba Cloud.

FAQ