TL;DR : Le journal des modifications CometAPI enregistre 15 nouveaux IDs de modèles en août 2026 couvrant les charges de travail texte, multimodales, image et vidéo. Commencez par Seedance 2.5 ou Wan3.0 pour la vidéo, GLM 5.3 Flash pour les tâches multimodales sensibles au coût, et Gemini 3.7 Flash pour le codage et le long contexte ; puis vérifiez la page du modèle en ligne, l’endpoint et le prix avant le déploiement.
Quels nouveaux modèles d’IA CometAPI a-t-il ajoutés en août 2026 ?
La synthèse des modèles d’août 2026 de CometAPI est utile car chaque modèle est disponible avec une seule clé API et un seul flux de facturation, avec des IDs de catalogue stables, des endpoints documentés et une tarification par modèle. Les développeurs peuvent changer d’ID de modèle sans reconstruire toute l’intégration, tout en utilisant le format de requête natif ou compatible qui convient le mieux à chaque fournisseur.
Au 1er septembre 2026, le journal des modifications officiel de CometAPI est la source pour la chronologie des sorties d’août et enregistre 15 nouveaux IDs de modèles couvrant le raisonnement texte, la compréhension visuelle, la génération d’images et la vidéo. Le catalogue des modèles et les pages de modèles individuelles restent les sources pour la disponibilité et la tarification actuelles. Les modèles prioritaires à tester en premier sont Seedance 2.5 pour la vidéo multimodale, Wan3.0 pour des workflows vidéo en production, GLM 5.3 Flash pour le raisonnement multimodal à coût maîtrisé, et Gemini 3.7 Flash pour le codage et le travail à long contexte.
Synthèse des sorties de modèles CometAPI – août 2026
| Modèle / ID | Modalité | Prix CometAPI actuel (au 3 sept. 2026) | Route recommandée |
|---|---|---|---|
| Gemini 3.7 Flash gemini-3.7-flash | Multimodal → texte | $0.60 input / $3.00 output per 1M tokens | POST /v1beta/models/{model}:generateContent |
| Grok 4.6 grok-4.6 | Texte, image → texte | $1.60 input / $4.80 output per 1M tokens | POST /v1/chat/completions POST /v1/responses |
| GLM 5.3 glm-5.3 | Texte → texte | $1.12 input / $3.528 output per 1M tokens | POST /v1/chat/completions |
| DeepSeek V4 Flash Vision deepseek-v4-flash-vision | Texte, image → texte | $0.352 input / $1.056 output per 1M tokens | POST /v1/chat/completions |
| Grok Imagine Image 2.0 grok-imagine-image-2.0 | Texte, image → image | $0.032 per request | POST /v1/images/generations |
| GLM 5.3 Flash glm-5.3-flash | Texte, image, vidéo → texte | $0.06 input / $0.20 output per 1M tokens | POST /v1/chat/completions |
| Seedance 2.5 seedance-2-5 | Multimodal → vidéo | From $0.0824/s; detailed billing: $0.103/s (480p), $0.231/s (720p) | POST /v1/videos |
| Qwen3.8 Max qwen3.8-max | Multimodal → texte | $1.60 input / $4.80 output per 1M tokens | POST /v1/chat/completions POST /v1/responses |
| MiniMax H3 minimax-h3 | Texte, image, vidéo, audio → vidéo | From $0.064/s; listed rates: $0.08/s (768p), $0.13/s (2K) | POST /v1/videos GET /v1/videos/{task_id} |
| DeepSeek V4 Pro 0813 deepseek-v4-pro-0813 | Texte → texte | $0.528 input / $1.584 output / $0.0176 cache read per 1M tokens; 2× in stated UTC windows | POST /v1/chat/completions |
| FLUX 3 flux-3 | Multimodal → vidéo | $0.136/s (720p); $0.232/s (1080p) | POST /v1/videos GET /v1/videos/{task_id} |
| Qwen3.8 2.4T A95B qwen3.8-2.4t-a95b | Texte → texte | $1.60 input / $4.80 output per 1M tokens | POST /v1/chat/completions |
| Grok Imagine Video 1.5 grok-imagine-video-1.5 | Texte, image → vidéo | Image input $0.008; output $0.064/s (480p), $0.112/s (720p), $0.20/s (1080p) | POST /grok/v1/videos/generations GET /grok/v1/videos/{request_id} |
| Wan3.0 wan3.0 | Texte, image → vidéo | From $0.04/s; listed rates: $0.05/s (480p), $0.10/s (720p), $0.20/s (1080p) | POST /v1/videos |
| Qwen3.8 Flash qwen3.8-flash | Multimodal → texte | $0.12 input / $0.376001 output per 1M tokens | POST /v1/chat/completions |
Ce tableau met en évidence les modèles prioritaires parmi les 15 ajouts enregistrés dans le changelog d’août de CometAPI, y compris les tarifs promotionnels limités dans le temps lorsque CometAPI les indique. Étant donné que les affirmations de benchmark proviennent de différents fournisseurs et dates de sortie, utilisez le catalogue pour la découverte et la planification d’intégration plutôt que comme un comparatif universel.
Les mises à jour uniquement tarifaires pour gpt-5.6-sol et minimax-m3, ainsi que des ajustements de service pour les modèles DeepSeek existants, ne sont pas comptées comme de nouvelles sorties.
4 modèles d’août que je recommande vivement
Le catalogue d’août est large, mais quatre modèles se distinguent selon les charges de travail. Les recommandations ci-dessous se concentrent sur l’adéquation pratique plutôt que de répéter le tableau des prix ; confirmez le tarif en ligne et le format de requête sur chaque page de modèle avant l’usage en production.
Seedance 2.5 : vidéo multimodale plus longue
Comme la tarification vidéo est facturée à la seconde et varie selon la résolution, conservez la date du snapshot et renvoyez vers la page du modèle en ligne. Pour Seedance 2.5, un clip 480p coûte $0.103 par seconde tandis qu’un clip 720p coûte $0.231 par seconde—plus du double—donc budgétez en fonction de la résolution réellement utilisée par votre charge de travail.
Wan3.0 : vidéo de production à prix d’entrée plus bas
Wan3.0 est désormais live pour les workflows texte-vers-vidéo et image-vers-vidéo. C’est une option pratique lorsque les équipes ont besoin d’un endpoint de production asynchrone, d’une facturation prévisible à la seconde, et de marge pour comparer vitesse, qualité du mouvement et résolution avec d’autres modèles vidéo.
GLM 5.3 Flash : raisonnement multimodal à faible coût
GLM 5.3 Flash est le choix orienté coût pour du volume élevé de compréhension de texte et d’images. Testez-le pour l’extraction, le questionnement visuel, l’assistance au codage et les étapes d’agent où la latence et le coût priment sur la performance de benchmark maximale.
Kimi K3 : codage et travail de connaissance à long contexte
Kimi K3 a été lancé en juillet mais est resté l’un des modèles les plus pertinents à adopter en août. Son contexte d’un million de jetons et sa route de chat compatible OpenAI le rendent utile pour de grands dépôts, la synthèse de recherche et des workflows de codage de longue durée.
Quel nouveau modèle d’IA utiliser selon le cas d’usage ?
Gemini 3.7 Flash : codage et travail à long contexte
Les signaux publiés mettent l’accent sur l’ingénierie logicielle et le travail de connaissance, mais le test de production utile est votre propre dépôt ou ensemble de documents. Exécutez un pack de prompts fixe, enregistrez le taux de tâches acceptées, la latence et les jetons facturés, puis comparez le résultat avec le modèle que vous utilisez déjà.
Modèles vidéo : mouvement, fidélité à la référence et coût par clip accepté
Pour Seedance 2.5, Wan3.0 et MiniMax H3, utilisez le même prompt, la même durée, le même ratio d’aspect et la même image de référence. Notez la constance du mouvement, la conformité au prompt, les artefacts visuels, le temps de génération et le coût par clip qui passe la revue.
Modèles multimodaux : l’exactitude avant le contexte maximal
Pour GLM 5.3 Flash, DeepSeek V4 Flash Vision et Gemini 3.7 Flash, testez des captures d’écran, des graphiques, des PDFs et des entrées mixtes texte-image. Une grande fenêtre de contexte n’est utile que si le modèle récupère les bonnes preuves et produit une réponse stable.
DeepSeek V4 Flash Vision : Utilisez-le pour des agents de codage visuel, l’analyse de graphiques, des captures d’écran et des entrées d’automatisation de navigateur. Évaluez-le sur vos propres tâches mixtes texte-image et comparez l’exactitude, la latence et les jetons facturés avant une adoption en production.
Grok Imagine Image 2.0 : Utilisez-le pour des pipelines génération+édition, plusieurs ratios d’aspect, du créatif produit et des itérations basées sur référence. Budgétez selon la qualité et la résolution requises par votre charge de travail, et pas seulement selon le prix de départ le plus bas.
Bientôt sur CometAPI : liste de veille
Au 3 septembre 2026, cette liste de veille n’inclut que des modèles dont les pages CometAPI sont marquées Coming Soon. Considérez leurs IDs de modèle, routes et tarifs comme provisoires jusqu’à confirmation de l’accès live en production par le catalogue.
| Modèle | ID du modèle | Statut | Décision |
|---|---|---|---|
| Qwen-Image-3.0 | qwen-image-3.0 | Coming Soon | À surveiller ; ne pas planifier de trafic de production pour l’instant. |
| Veo 4 | veo4 | Coming Soon | Attendre une route live et une facturation confirmées avant l’usage en production. |
Comment appeler des API compatibles OpenAI et des API natives avec CometAPI ?
CometAPI utilise une seule clé API et un seul flux de facturation, mais ne force pas chaque fournisseur à un format de requête unique. Utilisez la page du modèle pour choisir la route la plus adaptée : génération de contenu native pour Gemini, chat compatible OpenAI pour de nombreux LLMs, endpoints d’image pour les modèles d’image, et API vidéo asynchrone pour les modèles vidéo. Les exemples POST abrégés ci-dessous montrent uniquement la route et le champ model ; consultez la documentation API pour les paramètres complets.
- Exemple LLM texte et multimodal : POST https://api.cometapi.com/v1beta/models/gemini-3.7-flash:generateContent
- Génération d’image : POST
https://api.cometapi.com/v1/images/generations - Génération vidéo : POST
https://api.cometapi.com/v1/videos
La route POST change selon la modalité. Gemini prend en charge la route native /v1beta/models/{model}:generateContent ainsi que des schémas compatibles ; Grok Imagine Image 2.0 utilise /v1/images/generations ; et Seedance 2.5 utilise /v1/videos, suivi d’un polling du statut de la tâche. Utilisez l’API Texte, l’API Image, et l’API Vidéo comme sources de référence.
FAQ
Quels sont les meilleurs agrégateurs d’API d’IA pour les développeurs ?
Le meilleur choix dépend de si vous avez uniquement besoin de LLMs texte ou d’une pile plus large texte, image, audio et vidéo. Évaluez chaque agrégateur sur les IDs de modèles live, la compatibilité des endpoints, la visibilité d’usage, le support de repli, la transparence de facturation et la fraîcheur du catalogue. CometAPI mérite d’être shortlisté si une clé unique et un flux de facturation unique sur plusieurs modalités sont prioritaires.
Quels modèles d’août 2026 sont effectivement live sur CometAPI ?
Au 1er septembre, le changelog d’août enregistre 15 nouveaux IDs de modèles. La liste complète, les formats supportés et les notes de tarification sont résumés dans le tableau ci-dessus. Revérifiez le catalogue des modèles avant le déploiement car la disponibilité, les alias et les prix peuvent changer.
Puis-je changer de fournisseur sans modifier tout mon SDK ?
Souvent, mais pas toujours. De nombreux modèles texte prennent en charge /v1/chat/completions, tandis que Gemini peut aussi utiliser sa route native de génération de contenu et les modèles média utilisent des endpoints image, realtime ou vidéo. CometAPI conserve une clé et un flux de facturation uniques sur ces formats, ce qui simplifie le changement de fournisseur même quand le corps de requête n’est pas identique.
Comment fonctionne la génération vidéo ?
La génération vidéo est asynchrone. Créez la tâche, conservez l’ID de tâche renvoyé, puis faites du polling ou recevez un webhook jusqu’à ce que la tâche réussisse ou échoue. Ce n’est qu’après la complétion que l’application doit récupérer et stocker le résultat.
À quelle fréquence devrais-je revérifier les IDs de modèles et les prix ?
Vérifiez avant l’intégration, avant une mise en production et avant tout lot important. Les systèmes automatisés devraient aussi journaliser l’ID de modèle exact et la capture de prix utilisée pour chaque estimation de coût afin que les changements ultérieurs du catalogue ne réécrivent pas l’historique d’une décision de déploiement.
L’essentiel
Les 15 ajouts d’août de CometAPI élargissent les choix pratiques en codage, vision, image et vidéo tout en conservant une seule clé et un seul flux de facturation. Commencez par Seedance 2.5, Wan3.0, GLM 5.3 Flash ou Gemini 3.7 Flash selon la charge de travail, puis promouvez un modèle uniquement après que des tests à prompts fixes aient mesuré la qualité, la latence, la fiabilité et le coût facturé.
