TL;DR: Il CometAPI Changelog registra 15 nuovi ID di modelli ad agosto 2026 per carichi di lavoro di testo, multimodale, immagine e video. Inizia con Seedance 2.5 o Wan3.0 per video, GLM 5.3 Flash per attività multimodali sensibili ai costi, e Gemini 3.7 Flash per coding e contesti lunghi; poi verifica la pagina del modello live, l’endpoint e il prezzo prima della messa in produzione.
Quali nuovi modelli AI ha aggiunto CometAPI ad agosto 2026?
Il riepilogo dei modelli di CometAPI per agosto 2026 è utile perché ogni modello è disponibile con una sola API key e un unico flusso di fatturazione, con ID di catalogo stabili, endpoint documentati e prezzi per modello. Gli sviluppatori possono sostituire un ID modello senza ricostruire l’intera integrazione, continuando a usare il formato di richiesta nativo o compatibile più adatto a ciascun provider.
Al 1 settembre 2026, l’official CometAPI Changelog è la fonte per le tempistiche di rilascio di agosto e registra 15 nuovi ID di modelli nei campi del ragionamento testuale, comprensione visiva, generazione di immagini e video. Il Models Catalog e le pagine dei singoli modelli restano la fonte per disponibilità e prezzi attuali. I modelli prioritari da testare per primi sono Seedance 2.5 per video multimodale, Wan3.0 per flussi video di produzione, GLM 5.3 Flash per ragionamento multimodale a costi contenuti e Gemini 3.7 Flash per coding e lavoro su contesti lunghi.
Riepilogo dei rilasci dei modelli CometAPI di agosto 2026
| Model / ID | Modality | Current CometAPI Price (as of Sep 3, 2026) | Recommended Endpoint |
|---|---|---|---|
| Gemini 3.7 Flash gemini-3.7-flash | Multimodale → testo | $0.60 input / $3.00 output per 1M di token | POST /v1beta/models/{model}:generateContent |
| Grok 4.6 grok-4.6 | Testo, immagine → testo | $1.60 input / $4.80 output per 1M di token | POST /v1/chat/completions POST /v1/responses |
| GLM 5.3 glm-5.3 | Testo → testo | $1.12 input / $3.528 output per 1M di token | POST /v1/chat/completions |
| DeepSeek V4 Flash Vision deepseek-v4-flash-vision | Testo, immagine → testo | $0.352 input / $1.056 output per 1M di token | POST /v1/chat/completions |
| Grok Imagine Image 2.0 grok-imagine-image-2.0 | Testo, immagine → immagine | $0.032 per richiesta | POST /v1/images/generations |
| GLM 5.3 Flash glm-5.3-flash | Testo, immagine, video → testo | $0.06 input / $0.20 output per 1M di token | POST /v1/chat/completions |
| Seedance 2.5 seedance-2-5 | Multimodale → video | Da $0.0824/s; fatturazione dettagliata: $0.103/s (480p), $0.231/s (720p) | POST /v1/videos |
| Qwen3.8 Max qwen3.8-max | Multimodale → testo | $1.60 input / $4.80 output per 1M di token | POST /v1/chat/completions POST /v1/responses |
| MiniMax H3 minimax-h3 | Testo, immagine, video, audio → video | Da $0.064/s; tariffe indicate: $0.08/s (768p), $0.13/s (2K) | POST /v1/videos GET /v1/videos/{task_id} |
| DeepSeek V4 Pro 0813 deepseek-v4-pro-0813 | Testo → testo | $0.528 input / $1.584 output / $0.0176 cache read per 1M di token; 2× in finestre UTC dichiarate | POST /v1/chat/completions |
| FLUX 3 flux-3 | Multimodale → video | $0.136/s (720p); $0.232/s (1080p) | POST /v1/videos GET /v1/videos/{task_id} |
| Qwen3.8 2.4T A95B qwen3.8-2.4t-a95b | Testo → testo | $1.60 input / $4.80 output per 1M di token | POST /v1/chat/completions |
| Grok Imagine Video 1.5 grok-imagine-video-1.5 | Testo, immagine → video | Input immagine $0.008; output $0.064/s (480p), $0.112/s (720p), $0.20/s (1080p) | POST /grok/v1/videos/generations GET /grok/v1/videos/{request_id} |
| Wan3.0 wan3.0 | Testo, immagine → video | Da $0.04/s; tariffe indicate: $0.05/s (480p), $0.10/s (720p), $0.20/s (1080p) | POST /v1/videos |
| Qwen3.8 Flash qwen3.8-flash | Multimodale → testo | $0.12 input / $0.376001 output per 1M di token | POST /v1/chat/completions |
Questa tabella evidenzia i modelli prioritari tra le 15 aggiunte registrate nel CometAPI August Changelog, inclusi prezzi scontati a tempo dove indicato da CometAPI. Poiché le affermazioni di benchmark provengono da fornitori e date diverse, usa il catalogo per discovery e pianificazione dell’integrazione, non come una classifica universale testa-a-testa.
Gli aggiornamenti solo di prezzo per gpt-5.6-sol e minimax-m3, oltre agli aggiustamenti di servizio per i modelli DeepSeek esistenti, non sono conteggiati come nuovi rilasci.
4 modelli di agosto che consiglio vivamente
Il catalogo di agosto è ampio, ma quattro modelli si distinguono per carichi di lavoro diversi. Le raccomandazioni seguenti privilegiano l’aderenza pratica invece di ripetere la tabella dei prezzi; conferma la tariffa live e il formato di richiesta sulla pagina del modello prima dell’uso in produzione.
Seedance 2.5: Video multimodale più lungo
Poiché la tariffazione video è fatturata al secondo e varia in base alla risoluzione, conserva la data dello snapshot e rimanda alla pagina del modello live. Per Seedance 2.5, un clip 480p costa $0.103 al secondo mentre un clip 720p costa $0.231 al secondo—più del doppio—quindi pianifica il budget in base alla risoluzione effettiva del tuo carico di lavoro.
Wan3.0: Video di produzione a prezzo di ingresso più basso
Wan3.0 è ora live per flussi text-to-video e image-to-video. È un’opzione pratica quando i team necessitano di un endpoint asincrono di produzione, fatturazione prevedibile al secondo e margine per confrontare velocità, qualità del movimento e risoluzione rispetto ad altri modelli video.
GLM 5.3 Flash: Ragionamento multimodale a basso costo
GLM 5.3 Flash è la scelta orientata ai costi per volumi elevati di comprensione di testo e immagini. Testalo per estrazione, visual question answering, assistenza al coding e passaggi di agenti in cui latenza e costo sono più importanti delle massime prestazioni di benchmark.
Kimi K3: Coding e lavoro su contesti lunghi
Kimi K3 è stato lanciato a luglio ma è rimasto uno dei modelli più rilevanti da adottare durante agosto. Il suo contesto da un milione di token e la rotta chat compatibile con OpenAI lo rendono utile per grandi repository, sintesi di ricerca e flussi di lavoro di coding di lunga durata.
Quale nuovo modello AI dovresti usare per caso d’uso?
Gemini 3.7 Flash: Coding e lavoro su contesti lunghi
I segnali pubblicati enfatizzano l’ingegneria del software e il lavoro di conoscenza, ma il test di produzione utile è il tuo repository o insieme di documenti. Esegui un pacchetto di prompt fisso, registra il tasso di attività accettate, la latenza e i token fatturati, quindi confronta il risultato con il modello che già usi.
Modelli video: movimento, fedeltà di riferimento e costo per clip accettata
Per Seedance 2.5, Wan3.0 e MiniMax H3, usa lo stesso prompt, durata, aspect ratio e immagine di riferimento. Valuta la coerenza del movimento, l’aderenza al prompt, gli artefatti visivi, i tempi di generazione e il costo per clip che supera la revisione.
Modelli multimodali: accuratezza prima del contesto massimo
Per GLM 5.3 Flash, DeepSeek V4 Flash Vision e Gemini 3.7 Flash, testa screenshot, grafici, PDF e input misti testo-immagine. Una finestra di contesto ampia conta solo quando il modello recupera la giusta evidenza e produce una risposta stabile.
DeepSeek V4 Flash Vision: Usalo per agenti di coding visivo, analisi di grafici, screenshot e input di automazione del browser. Valutalo sui tuoi compiti misti testo-immagine e confronta accuratezza, latenza e token fatturati prima dell’adozione in produzione.
Grok Imagine Image 2.0: Usalo per pipeline di generazione più editing, più formati di aspect ratio, creatività di prodotto e iterazione basata su riferimenti. Pianifica il budget partendo da qualità e risoluzione richieste dal tuo carico di lavoro, non solo dal prezzo iniziale più basso.
In arrivo su CometAPI: Watchlist
Al 3 settembre 2026, questa watchlist include solo modelli le cui pagine CometAPI sono contrassegnate Come Coming Soon. Considera i loro ID modello, rotte e prezzi come provvisori finché il catalogo non conferma l’accesso live in produzione.
| Model | Model ID | Status | Decision |
|---|---|---|---|
| Qwen-Image-3.0 | qwen-image-3.0 | Coming Soon | Watchlist; non pianificare ancora traffico di produzione. |
| Veo 4 | veo4 | Coming Soon | Attendi una rotta live confermata e fatturazione prima dell’uso in produzione. |
Come chiamare API compatibili con OpenAI e native con CometAPI?
CometAPI usa una sola API key e un flusso di fatturazione, ma non forza ogni provider in un unico formato di richiesta. Usa la pagina del modello per scegliere la rotta più adatta: generazione di contenuti nativa Gemini per Gemini, chat compatibile con OpenAI per molti LLM, endpoint immagine per modelli di immagine e l’API video asincrona per modelli video. I brevi esempi POST sotto mostrano solo la rotta e il campo model; consulta la API documentation per i parametri completi.
- Text and multimodal LLMs Example: POST https://api.cometapi.com/v1beta/models/gemini-3.7-flash:generateContent
- Image generation: POST
https://api.cometapi.com/v1/images/generations - Video generation: POST
https://api.cometapi.com/v1/videos
La rotta POST cambia in base alla modalità. Gemini supporta la rotta nativa /v1beta/models/{model}:generateContent oltre a pattern compatibili; Grok Imagine Image 2.0 usa /v1/images/generations; e Seedance 2.5 usa /v1/videos, seguito da polling dello stato del task. Usa la Text API, la Image API e la Video API come fonte ufficiale.
FAQ
Quali sono i migliori aggregatori di API AI per sviluppatori?
La scelta migliore dipende dal fatto che tu abbia bisogno solo di LLM testuali o di uno stack più ampio per testo, immagine, audio e video. Valuta ogni aggregatore su ID dei modelli live, compatibilità degli endpoint, visibilità d’uso, supporto al fallback, trasparenza di fatturazione e freschezza del catalogo. CometAPI merita di essere preso in considerazione quando una sola chiave e un unico flusso di fatturazione su più modalità sono prioritari.
Quali modelli di agosto 2026 sono effettivamente live su CometAPI?
Al 1 settembre, il Changelog di agosto registra 15 nuovi ID di modelli. L’elenco completo, i formati supportati e le note sui prezzi sono riassunti nella tabella sopra. Ricontrolla il Models Catalog prima della messa in produzione perché disponibilità, alias e prezzi possono cambiare.
Posso cambiare provider senza modificare l’intero SDK?
Spesso sì, ma non sempre. Molti modelli di testo supportano /v1/chat/completions, mentre Gemini può usare anche la sua rotta nativa di generazione di contenuti e i modelli multimediali usano endpoint immagine, realtime o video. CometAPI mantiene una sola chiave e un flusso di fatturazione su questi formati, quindi il cambio di provider è più semplice anche quando il body della richiesta non è identico.
Come funziona la generazione video?
La generazione video è asincrona. Crea il task, conserva l’ID del task restituito, quindi effettua il polling o ricevi un webhook finché il task non ha esito positivo o negativo. Solo dopo il completamento l’applicazione dovrebbe recuperare e archiviare il risultato.
Con quale frequenza devo ricontrollare ID dei modelli e prezzi?
Controlla prima dell’integrazione, prima di un rollout in produzione e prima di qualsiasi grande batch. I sistemi automatizzati dovrebbero anche registrare l’ID modello esatto e lo snapshot del prezzo usati per ogni stima dei costi in modo che i successivi cambi di catalogo non riscrivano la storia della decisione di distribuzione.
In sintesi
Le 15 aggiunte di agosto di CometAPI ampliano le scelte pratiche in coding, visione, immagini e video mantenendo una sola chiave e un flusso di fatturazione. Inizia con Seedance 2.5, Wan3.0, GLM 5.3 Flash o Gemini 3.7 Flash in base al carico di lavoro, poi promuovi un modello solo dopo che test con prompt fissi abbiano misurato qualità, latenza, affidabilità e costo fatturato.
