
AUTO
CometAPI Auto API is an intelligent model routing feature that allows developers to access the appropriate AI model without specifying a specific model ID for each request.
Choisissez votre plan
Choisissez votre plan
Recherchez et comparez des modèles de texte, image, vidéo et audio proposés par les principaux fournisseurs. Consultez les fonctionnalités et les tarifs, puis intégrez-les avec une seule clé API.

CometAPI Auto API is an intelligent model routing feature that allows developers to access the appropriate AI model without specifying a specific model ID for each request.

Découvrez l'API Claude Fable 5.5.

Découvrez l'API Claude Haiku 5.5.

Découvrez l'API GPT-6.1 Sol.

Découvrez l'API Claude Sonnet 5.5.

Découvrez l'API MiniMax-M3.1-Flash-Preview.

MiMo-V2.6-Pro-UltraSpeed est la version d’inférence à faible latence de MiMo-V2.6-Pro de Xiaomi, conçue pour des applications où la capacité de raisonnement du modèle Pro doit être associée à une génération de sorties considérablement plus rapide.

GPT-6 Sol (gpt-6-sol) est un modèle de raisonnement GPT-6 d'OpenAI conçu pour la programmation complexe, les workflows agentiques et le travail intellectuel exigeant. OpenAI le décrit comme un modèle pour la programmation complexe et les workflows agentiques, doté d'un raisonnement adaptatif, du traitement de contextes longs, de l'entrée d'images et d'un accès à un vaste ensemble d'outils via l'API Responses.

GPT-6 Luna (gpt-6-luna) est un modèle GPT-6 efficace d’OpenAI pour des charges de travail ciblées et à volume élevé. OpenAI positionne Luna en dessous de GPT-6 Sol au sein de la famille GPT-6, en mettant l’accent sur l’efficacité, la répétabilité et une utilisation en production sensible aux coûts.

MiMo-V2.6-Flash est le modèle de Xiaomi axé sur l’efficacité au sein de la famille MiMo-V2.6. Il s’agit d’un modèle natif de raisonnement multimodal conçu pour des requêtes à haute fréquence, des charges de travail à grande échelle, la programmation, l’automatisation et des tâches d’agents à long horizon.

MiMo-V2.6-Pro est le modèle de raisonnement phare de Xiaomi MiMo au sein de la famille MiMo-V2.6. Il s’agit d’un modèle natif pleinement multimodal conçu pour des travaux complexes et de longue durée couvrant l’ingénierie logicielle, la recherche, la cybersécurité, les flux de travail agentiques, l’analyse multimodale et la création de contenu.

Hy-Image 3.5 Preview (hy-image-v3.5-preview) est le modèle professionnel de génération d’images de Tencent Hunyuan, axé sur la génération texte‑vers‑image, la génération guidée par des références et l’édition d’images multi‑tours.

Grok Build 0.1 est le modèle spécialisé de xAI pour la programmation agentique et l’ingénierie logicielle.

Bientôt disponible

Grok 4.7 est le modèle de pointe de SpaceXAI pour la programmation, les tâches agentiques et le travail cognitif. Il succède à Grok 4.6 et utilise un modèle de base plus grand, ainsi qu'un entraînement par apprentissage par renforcement plus long, centré sur des tâches difficiles, de plusieurs heures.

Découvrez l'API Gemini 4 Pro.

La version 4.20 de Grok introduit une architecture multi‑agents (plusieurs agents spécialisés coordonnés en temps réel), des modes de contexte étendus, ainsi que des améliorations ciblées en matière de suivi des instructions, de réduction des hallucinations et de sorties structurées/outillées.

Claude Opus 5.5, publié le 22 septembre 2026, est conçu pour la programmation agentique et le travail intellectuel de longue durée.

GPT-6 Astra, le modèle phare pour le raisonnement complexe et la programmation. Choisissez GPT-5.6 Terra pour équilibrer l'intelligence et le coût,

Découvrez l'API Jev.

Une intelligence de nouvelle génération pour des agents à longue durée d'exécution

GLM-5.3-FlashX is Z.ai's high-speed API serving variant of GLM-5.3-Flash, designed for applications where model capability needs to be paired with lower response latency and high generation throughput.

Claude Opus 5.2 pourrait être en cours de tests limités dans Claude Code. Voici ce qu’affirment les fuites, ce qui reste non vérifié, et comment l’accès à CometAPI fonctionnerait après la sortie.

Qwen3.8-Omni-Flash (qwen3.8-omni-flash) est le modèle omnimodal natif d'Alibaba Cloud pour la compréhension audio/vidéo et l'analyse de contenus multimodaux.

GLM-5.3-Flash est le premier modèle multimodal natif de la série GLM-5, offrant une intelligence supérieure à GLM-5.2 tout en conservant une architecture au rapport coût-efficacité exceptionnel.

L’accès à Claude Fable 5 a été rétabli. Il apporte une intelligence de 5e génération à vos projets de programmation et à vos travaux professionnels les plus ambitieux.

Claude Opus 4.8 est un modèle d’IA haut de gamme conçu pour le raisonnement avancé, l’analyse approfondie et la génération de contenus de haute qualité. Il excelle dans le traitement d’instructions complexes, la compréhension de contextes étendus et la résolution de problèmes avancée dans les domaines professionnels et techniques.

Gemini 3.8 Flash est un modèle Gemini léger de nouvelle génération, ayant pour objectif d’atteindre un meilleur équilibre entre la vitesse, le coût et les capacités de codage.

Claude Sonnet 4.6 est notre modèle Sonnet le plus performant à ce jour. Il s’agit d’une mise à niveau complète des capacités du modèle dans la programmation, l’usage de l’ordinateur, le raisonnement sur des contextes étendus, la planification d’agents, le travail intellectuel et la conception. Sonnet 4.6 propose également une fenêtre de contexte de 1M de jetons en bêta.

Partage les capacités de Claude Fable 5 sans les classificateurs de sécurité. Disponible via Project Glasswing. Successeur de Claude Mythos Preview.

Minimax-m3 est un modèle d'IA multimodal conçu pour un raisonnement robuste, des conversations naturelles et la génération de contenu créatif. Il offre des performances équilibrées sur les tâches de compréhension textuelle et visuelle, ce qui le rend adapté aux applications d'IA à usage général.

MiniMax-M2.7 offre la même intelligence de premier ordre que la version standard — y compris l’auto-évolution récursive et une productivité bureautique de niveau expert — mais est conçu pour les applications nécessitant une latence inférieure à la seconde et une génération de jetons à grande vitesse. S’appuyant sur une architecture de backbone d’inférence améliorée, sa vitesse de sortie est 66 % plus rapide que celle du modèle standard (atteignant 100 tps). C’est le choix privilégié pour les assistants de programmation interactifs, l’exécution de boucles d’agents en temps réel et les pipelines d’entreprise à haut débit avec des exigences strictes en matière de temps de réponse.