
Qwen 3.8 Max costa $2/M per l'input e $6/M per l'output. Confronta tariffe della cache, costi degli strumenti, esempi reali, limiti e consigli sulla migrazione di Qwen 3.7.

Alla vigilia del Capodanno lunare (16–17 febbraio 2026), Alibaba Group ha rilasciato il suo modello di nuova generazione, Qwen 3.5 — un modello multimodale, con capacità di agente, posizionato per quella che l’azienda definisce un’“agentic AI” era. La copertura del settore ha evidenziato affermazioni di grandi miglioramenti in efficienza e costi, e il rapido supporto da parte dei fornitori di hardware e cloud. CometAPI offre opzioni per gli sviluppatori che desiderano accesso a un’API ospitata o un’integrazione compatibile con OpenAI, mentre AMD ha annunciato il supporto GPU Day-0 per il modello sulla sua linea Instinct. ByteDance è uno dei principali concorrenti nazionali che hanno rilasciato aggiornamenti nello stesso periodo festivo. OpenAI resta un punto di riferimento per il confronto in termini di benchmark e stile di integrazione.

Il nuovo Qwen3.5 di Alibaba rappresenta un grande passo avanti — colma il divario con alcuni modelli di frontiera a codice chiuso su numerosi benchmark pubblici e test interni e, in alcuni carichi di lavoro basati su agenti/multimodali, rivendica la parità o addirittura un vantaggio rispetto ad essi. Tuttavia, cosa significhi "superare" dipende dal carico di lavoro: per l’uso di strumenti da parte di agenti, la comprensione multimodale di documenti/video e il costo per inferenza, Qwen3.5 risulta estremamente competitivo (e, in alcuni grafici dei fornitori, in vantaggio). La conclusione pratica: Qwen3.5 sembra essere un autentico contendente di frontiera all’inizio del 2026 — per molti casi d’uso aziendali basati su agenti e multimodali ora è una valida opzione primaria.
Qwen3-Max-Thinking di Alibaba — la variante "thinking" della vasta famiglia Qwen3 — è diventato uno dei temi di primo piano nell'IA quest'anno: un'ammiraglia da oltre mille miliardi di parametri, ottimizzata per il ragionamento profondo, la comprensione di contesti estesi e flussi di lavoro basati su agenti. In breve, è la mossa del fornitore per offrire alle applicazioni una modalità di pensiero "System-2" più lenta e più tracciabile: il modello non si limita a rispondere, può mostrare (e utilizzare) passaggi, strumenti e verifiche intermedie in modo controllato.

Il team Qwen di Alibaba ha rilasciato Qwen3-Max-Preview (Instruct), il modello più grande dell'azienda fino ad oggi, con oltre 1 trilione di parametri, e lo ha reso

Qwen3-Max-Preview è l'ultimo modello di anteprima di punta di Alibaba nella famiglia Qwen3: un modello in stile Mixture-of-Experts (MoE) da oltre un trilione di parametri con una finestra di contesto token ultra-lunga da 262 token, rilasciato in anteprima per uso aziendale/cloud. È rivolto a ragionamento approfondito, comprensione di documenti lunghi, codifica e flussi di lavoro agentici.

L'ultimo progresso di Alibaba nell'intelligenza artificiale, Qwen3-Coder, segna una pietra miliare significativa nel panorama in rapida evoluzione del software basato sull'intelligenza artificiale.

L'API Qwen3-Coder è un'API di generazione e completamento del codice basata sulla famiglia di modelli di linguaggio Qwen3 di Alibaba, ottimizzata per attività di sviluppo software quali scrittura, comprensione e debug del codice in più linguaggi di programmazione.