
AUTO
CometAPI Auto API is an intelligent model routing feature that allows developers to access the appropriate AI model without specifying a specific model ID for each request.
Scegli il tuo piano
Scegli il tuo piano
Cerca e confronta modelli di testo, immagini, video e audio dei principali fornitori. Controlla funzionalità e prezzi, poi integra con una sola chiave API.

CometAPI Auto API is an intelligent model routing feature that allows developers to access the appropriate AI model without specifying a specific model ID for each request.

MiMo-V2.6-Pro-UltraSpeed è la versione di serving a bassa latenza di MiMo-V2.6-Pro, progettata per applicazioni in cui la capacità di ragionamento del modello Pro deve essere abbinata a una generazione dell’output sostanzialmente più rapida.

GPT-6 Sol (gpt-6-sol) è un modello di ragionamento GPT-6 di OpenAI progettato per la programmazione complessa, flussi di lavoro basati su agenti e attività di lavoro della conoscenza particolarmente impegnative. OpenAI lo descrive come un modello per la programmazione complessa e i flussi di lavoro basati su agenti, con ragionamento adattivo, elaborazione di contesti lunghi, input di immagini e accesso a un’ampia gamma di strumenti tramite la Responses API.

GPT-6 Luna (gpt-6-luna) è il modello GPT-6 efficiente di OpenAI per carichi di lavoro mirati e ad alto volume. OpenAI colloca Luna al di sotto di GPT-6 Sol nella famiglia GPT-6, sottolineando efficienza, ripetibilità e un uso in produzione attento ai costi.

MiMo-V2.6-Flash è il modello di Xiaomi incentrato sull’efficienza nella famiglia MiMo-V2.6. È un modello nativo di ragionamento multimodale progettato per invocazioni ad alta frequenza, carichi di lavoro su larga scala, programmazione, automazione e attività degli agenti a lungo orizzonte.

MiMo-V2.6-Pro è il modello di ragionamento di punta di Xiaomi MiMo nella famiglia MiMo-V2.6. È un modello nativo a piena multimodalità, progettato per attività complesse e a lungo termine nell’ambito dell’ingegneria del software, della ricerca, della sicurezza informatica, dei flussi di lavoro agentici, dell’analisi multimodale e della creazione di contenuti.

Hy-Image 3.5 Preview (hy-image-v3.5-preview) è il modello professionale di generazione di immagini di Tencent Hunyuan, incentrato sulla generazione da testo a immagine, sulla generazione guidata da riferimenti e sulla modifica di immagini in più turni.

Grok Build 0.1 è il modello specializzato di xAI per la programmazione agentica e l'ingegneria del software.

Claude Opus 5.5 rilasciato il 22 settembre 2026, e progettato per la programmazione agentica e il lavoro cognitivo di lunga durata.

Intelligenza di nuova generazione per agenti a esecuzione prolungata

MiniMax H3 Max è una variante di fascia alta della famiglia H3 di MiniMax per la generazione di video. Le integrazioni documentate di H3 Max supportano la generazione da testo a video e da immagine a video. I materiali ufficiali di MiniMax relativi a H3 descrivono il sistema H3 più ampio come un modello video onnimodale con audio stereo nativo.

Prossimamente

Grok 4.7 è il modello di frontiera di SpaceXAI per la programmazione, i compiti agentici e il lavoro della conoscenza. È il successore di Grok 4.6 e utilizza un modello base più grande e un addestramento con apprendimento per rinforzo più lungo, incentrato su compiti difficili, della durata di più ore.

Claude Opus 5.2 potrebbe essere in fase di test limitati su Claude Code. Ecco cosa sostengono le indiscrezioni, cosa resta non verificato e come funzionerebbe l’accesso a CometAPI dopo il rilascio.

Esplora l'API di Gemini 4 Pro.

La versione 4.20 di Grok introduce un'architettura multi-agente (più agenti specializzati coordinati in tempo reale), modalità di contesto estese e miglioramenti mirati alla capacità di seguire le istruzioni, alla riduzione delle allucinazioni e agli output strutturati/strumentati.

GPT-6 Astra, il modello di punta per il ragionamento complesso e la programmazione. Scegli GPT-5.6 Terra per bilanciare intelligenza e costo,

Genera video da prompt testuali, anima immagini statiche o modifica video esistenti con il linguaggio naturale. L'API supporta la configurazione di durata, rapporto d'aspetto e risoluzione per i video generati — con l'SDK che gestisce automaticamente il polling asincrono.

Esplora l'API di Jev.

Dalla verifica rapida all'output cinematografico, la fatturazione si basa sulla durata del video generato, sulla selezione della risoluzione appropriata e sulla trasformazione di ogni generazione in una regola per un'attività di investimento creativo pianificata.

Grok Imagine Image 2.0, il suo modello di IA aggiornato per la generazione e la modifica di immagini

GLM-5.3-FlashX is Z.ai's high-speed API serving variant of GLM-5.3-Flash, designed for applications where model capability needs to be paired with lower response latency and high generation throughput.

GPT Image 2 è il modello di generazione di immagini all’avanguardia di OpenAI per generare e modificare immagini in modo rapido e di alta qualità. Supporta dimensioni di immagine flessibili e input di immagini ad alta fedeltà.

Qwen3.8-Omni-Flash (qwen3.8-omni-flash) è il modello nativo omnimodale di Alibaba Cloud per la comprensione di audio e video e l’analisi di contenuti multimodali.

GLM-5.3-Flash è il primo modello multimodale nativo della serie GLM-5, che offre un’intelligenza più avanzata rispetto a GLM-5.2, pur mantenendo un’architettura eccezionalmente efficiente in termini di costi.

minimax-h3 è un nuovo modello di generazione video progettato per una produzione creativa di alta qualità. Offre una migliore comprensione dei prompt, una maggiore coerenza visiva, movimenti più fluidi e un controllo più flessibile delle immagini di riferimento, per flussi di lavoro cinematografici di generazione video.

Genera immagini da prompt testuali con i modelli Grok Imagine. L'API supporta la generazione in batch di più immagini e il controllo del rapporto d'aspetto e della risoluzione.

Gemini 3.8 Flash è un modello Gemini leggero di nuova generazione, con l'obiettivo di raggiungere un migliore equilibrio tra velocità, costi e capacità di programmazione.

FLUX 3 - Modelli del mondo reale: verso modelli di flusso multimodali come spina dorsale dell'intelligenza visiva.

Minimax-m3 è un modello di IA multimodale progettato per un ragionamento solido, la conversazione naturale e la generazione creativa di contenuti. Fornisce prestazioni equilibrate nelle attività di comprensione testuale e visiva, rendendolo adatto ad applicazioni di IA di uso generale.

MiniMax-M2.7 offre la stessa intelligenza di altissimo livello della versione standard, inclusa l’autoevoluzione ricorsiva e una produttività d’ufficio di livello esperto, ma è progettato per applicazioni che richiedono una latenza inferiore al secondo e una generazione di token ad alta velocità. Sfruttando un’architettura backbone di inferenza migliorata, la sua velocità di output è del 66% più rapida rispetto al modello standard (raggiungendo 100 tps). È la scelta ideale per assistenti di programmazione interattivi, esecuzione in tempo reale di cicli di agenti e pipeline aziendali ad alto throughput con rigorosi requisiti sui tempi di completamento.

Esplora l'API di Gen4-image.