GPT-6 Astra is now live on CometAPI →
ai-model/Recherche CometAPI

GPT-5.6 API: Tarifs, Sol vs Terra vs Luna, Tests de performance et Accès

Comparez les tarifs de l’API GPT-5.6, les capacités de Sol, Terra et Luna, la disponibilité, les benchmarks, la sélection des modèles et l’accès à CometAPI, avec des exemples de code actuels.

CometAPI
Bobby SpencerÉquipe de recherche sur les modèles IA et API
Mis à jour Sep 4, 2026 12 min de lecture
GPT-5.6 API: Tarifs, Sol vs Terra vs Luna, Tests de performance et Accès
Utiliser ce modèle

Passez le premier appel API.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

Que devez-vous savoir sur l'API GPT-5.6 ?

GPT-5.6 n’est plus seulement un élément à surveiller pour une prochaine version. OpenAI indique que les modèles Sol, Terra et Luna sont généralement disponibles, tandis que CometAPI documente un accès via une API compatible OpenAI. Au 2 septembre 2026, la page du modèle GPT-5.6 de CometAPI indique des prix des jetons en contexte court inférieurs de 20 % aux tarifs actuels de l’API Standard d’OpenAI pour les trois niveaux.

Le choix pragmatique n’est pas simplement « utiliser le modèle le plus récent ». Utilisez gpt-5.6-sol pour les travaux de codage et de raisonnement les plus difficiles, gpt-5.6-terra lorsque la capacité et le coût comptent tous deux, et gpt-5.6-luna pour les tâches à grand volume et bien délimitées. Les équipes utilisant déjà le SDK OpenAI peuvent tester la famille via CometAPI en définissant l’URL de base sur https://api.cometapi.com/v1, en fournissant une clé CometAPI et en choisissant un ID de modèle explicite.

Combien coûte l’API GPT-5.6 ?

Les prix ci-dessous ont été vérifiés le 2 septembre 2026. Il s’agit de dollars américains par 1 million de jetons pour des requêtes ne dépassant pas 272 000 jetons d’entrée. Les tarifs CometAPI proviennent de la page du modèle GPT-5.6 en direct ; les tarifs directs proviennent du catalogue officiel des modèles OpenAI.

ModèleEntrée CometAPISortie CometAPIEntrée OpenAISortie OpenAIDifférence indiquée
gpt-5.6-sol$3.20$16.00$4.00$20.00Inférieur de 20 %
gpt-5.6-terra$1.60$9.60$2.00$12.00Inférieur de 20 %
gpt-5.6-luna$0.16$0.96$0.20$1.20Inférieur de 20 %

Les tarifs pour l’entrée mise en cache et l’écriture dans le cache suivent la même différence publiée de 20 % sur la page CometAPI. Les requêtes dépassant 272 000 jetons d’entrée basculent vers le palier « contexte long » pour l’ensemble de la requête : les tarifs liés à l’entrée doublent et ceux liés à la sortie augmentent de 50 %. Étant donné que les prix et promotions peuvent évoluer, utilisez ce tableau comme instantané daté et revérifiez la page du modèle ou le tableau de bord du compte avant d’estimer un budget de production.

Une estimation simple du coût pour une requête est :

estimated_cost =
  (input_tokens / 1,000,000 × input_rate)
  + (output_tokens / 1,000,000 × output_rate)

Par exemple, un appel Terra en contexte court avec 100,000 jetons d’entrée non mis en cache et 10,000 jetons de sortie coûterait environ $0.256 aux tarifs CometAPI indiqués : $0.160 pour l’entrée plus $0.096 pour la sortie. Cette estimation exclut les frais d’outils, les réessais et le comportement du cache.

GPT-5.6 est-il moins cher via CometAPI ?

Oui — sur la page publique du modèle consultée le 2 septembre 2026, CometAPI indique chaque palier de GPT-5.6 à un niveau inférieur de 20 % par rapport au tarif actuel de l’API Standard d’OpenAI. Pour les appels en contexte court, Sol est à $3.20/$16, Terra à $1.60/$9.60 et Luna à $0.16/$0.96 par 1 million de jetons d’entrée/sortie. Il s’agit d’un paiement à l’usage plutôt que d’une remise d’abonnement : la page de tarification de CometAPI précise que le prix client des modèles officiels correspond au tarif officiel multiplié par 0,8, sans abonnement mensuel ni dépense minimale. Des paliers supplémentaires sont disponibles en fonction du volume mensuel, tandis que les tarifs entreprise sont négociés. Revérifiez la page du modèle en direct avant d’établir un budget, car les promotions et conditions au niveau du compte peuvent changer.

Que se passe-t-il lorsque les requêtes GPT-5.6 dépassent 272K jetons ?

Le palier supérieur s’applique à l’ensemble de la requête, pas seulement aux jetons au‑delà de 272K. Aux tarifs actuels CometAPI, Sol passe à $6.40 en entrée/$24 en sortie, Terra à $3.20/$14.40 et Luna à $0.32/$1.44 par 1 million de jetons ; les tarifs de lecture et d’écriture du cache doublent également. Proche du seuil, supprimez les passages récupérés en double, l’historique de chat obsolète, les journaux d’outils verbeux et les fichiers sources non nécessaires avant d’envoyer la requête.

Comment se comparent GPT-5.6 Sol, Terra et Luna ?

OpenAI a introduit GPT-5.6 comme une famille à trois niveaux plutôt qu’un seul modèle. Sol est la voie phare, Terra la voie équilibrée et Luna la voie à faible coût. Les modèles partagent une fenêtre de contexte de 1,050,000 jetons et une sortie maximale de 128,000 jetons. Ils acceptent des entrées texte et image et produisent des sorties texte ; l’audio et la vidéo ne sont pas pris en charge par ces voies de modèle.

ID du modèlePositionnementModalitésContexte / sortieRoutes prises en charge
gpt-5.6-solCapacités de pointeTexte et image en entrée ; texte en sortie1.05M / 128K jetonsChat Completions, Responses
gpt-5.6-terraÉquilibre capacité et coûtTexte et image en entrée ; texte en sortie1.05M / 128K jetonsChat Completions, Responses
gpt-5.6-lunaEfficience à grand volumeTexte et image en entrée ; texte en sortie1.05M / 128K jetonsChat Completions, Responses

L’alias gpt-5.6 sans suffixe oriente vers GPT-5.6 Sol selon la documentation officielle des modèles OpenAI. Utilisez un ID Terra ou Luna explicite lorsque la maîtrise des coûts fait partie de la décision d’acheminement.

GPT-5.6 est-il disponible via l’API ?

Oui. OpenAI indique que GPT-5.6 Sol, Terra et Luna sont généralement disponibles via son API, les routes Chat Completions et Responses étant documentées pour la famille. Disponibilité vérifiée au 2 septembre 2026. Utilisez l’ID de modèle exact requis par votre charge de travail et confirmez toute limite de débit au niveau du compte ou restriction régionale avant le déploiement en production.

Des passerelles tierces peuvent fournir une autre voie d’accès. CometAPI documente gpt-5.6-sol, gpt-5.6-terra et gpt-5.6-luna via des formats compatibles OpenAI pour Chat Completions et Responses. Considérez une liste publique comme une documentation de route plutôt qu’une garantie de quota : vérifiez l’ID exact dans votre compte avant le déploiement.

Que montrent les benchmarks publiés de GPT-5.6 ?

OpenAI publie des résultats de benchmark pour les trois niveaux de GPT-5.6. Le petit ensemble suivant est utile car il couvre des agents de codage, une navigation de type recherche et une récupération à long contexte plutôt que de répéter un large classement.

ÉvaluationSolTerraLuna
Artificial Analysis Coding Agent Index v1.180.077.474.6
BrowseComp90.4%87.5%83.3%
MRCR v2, 8-needle, 512K–1M73.8%72.5%41.3%

Source : rapport de lancement de GPT-5.6 d’OpenAI. Il s’agit de résultats publiés par l’éditeur, et non de tests indépendants exécutés via CometAPI. Les scores dépendent de l’outil d’évaluation, de l’effort de raisonnement, des outils et de la version du modèle, ils ne doivent donc pas être convertis directement en un argument prix‑performance pour votre application.

Comment devez-vous évaluer GPT-5.6 avant la mise en production ?

Exécutez le même ensemble d’invites sur Sol, Terra et Luna avec le même effort de raisonnement et la même limite de sortie. Enregistrez la réussite des tâches, la latence, les jetons d’entrée et de sortie, les réessais et le coût total. Un ensemble de quatre invites suffit généralement à mettre en évidence les principales différences :

  1. Repository : diagnostiquer un véritable bug multi‑fichiers et proposer un correctif avec des tests.
  2. Contexte long : extraire des exigences contradictoires d’une large spécification et citer leurs emplacements.
  3. Utilisation d’outils : planifier et exécuter un flux de travail borné avec des sorties structurées.
  4. Grand volume : classer ou résumer 100 entrées de production représentatives.

Évaluez la justesse avant le style. Calculez ensuite le coût par tâche réussie, et pas seulement le coût par jeton. Un modèle moins cher qui déclenche davantage de réessais, des sorties plus longues ou une revue humaine peut s’avérer plus coûteux en production. Inversement, Luna ou Terra peuvent surpasser une stratégie uniquement centrée sur le modèle phare lorsque la tâche est bien spécifiée et répétée à grande échelle.

Quel modèle GPT-5.6 devriez-vous choisir ?

Choisissez GPT-5.6 Sol pour le codage agentique difficile, la revue d’architecture, la synthèse de recherches, l’analyse de sécurité dans des environnements autorisés et les décisions pour lesquelles une mauvaise réponse coûte cher. C’est le palier au coût le plus élevé ; orientez donc uniquement le travail qui bénéficie de capacités de pointe.

Choisissez GPT-5.6 Terra pour les assistants de codage au quotidien, la rédaction technique, l’analyse de documents, l’automatisation métier et les charges mixtes de production. C’est le meilleur candidat par défaut lorsque vous souhaitez un seul modèle pour démarrer une évaluation contrôlée.

Choisissez GPT-5.6 Luna pour l’extraction, la classification, le triage du support, les étapes agent répétées, la surveillance et autres tâches à grand volume avec des critères d’acceptation clairs. Son prix catalogue bas est attractif, mais les résultats de benchmark en contexte long montrent pourquoi les équipes doivent le tester soigneusement avant de l’utiliser pour une récupération de un million de jetons ou un raisonnement multi‑étapes difficile.

GPT-5.6 n’est pas le meilleur choix lorsque l’application requiert une sortie audio ou vidéo native, un modèle affiné ou un coût fixe indépendant de l’usage des jetons. Dans ces cas, choisissez une route conçue pour la modalité ou le modèle de déploiement requis plutôt que de forcer la famille GPT-5.6 dans le flux de travail.

Comment accéder à l’API GPT-5.6 via CometAPI ?

CometAPI est particulièrement utile lorsque vous souhaitez une seule clé API et un seul compte de facturation pour GPT-5.6 Sol, Terra, Luna et des centaines d’autres modèles. Au 2 septembre 2026, GPT-5.6 affiche des tarifs inférieurs de 20 % aux prix de l’API Standard d’OpenAI, tandis que sa page de tarification documente une facturation à l’usage sans abonnement mensuel ni dépense minimale, avec des paliers supplémentaires en fonction du volume mensuel. Pour les équipes utilisant déjà le SDK OpenAI, tester GPT-5.6 nécessite de modifier l’URL de base, la clé API et l’ID de modèle plutôt que de construire une intégration spécifique à un fournisseur. Une facturation unifiée et un basculement peuvent encore réduire les opérations multi‑fournisseurs, bien que les équipes doivent toujours vérifier l’accès au compte, la latence, le quota et la disponibilité régionale. Pour l’API OpenAI, CometAPI accepte les formats chat et response. Les exemples ci‑dessous utilisent \\ API Chat Completions à https://api.cometapi.com/v1/chat/completions.

Comment appeler GPT-5.6 Sol avec Python ?

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["COMETAPI_KEY"],
    base_url="https://api.cometapi.com/v1",
)

completion = client.chat.completions.create(
    model="gpt-5.6-sol",
    messages=[
        {
            "role": "user",
            "content": "Passez en revue ce plan de migration et identifiez les trois hypothèses présentant le risque le plus élevé.",
        }
    ],
)

print(completion.choices[0].message.content)

Comment appeler GPT-5.6 Sol avec Node.js ?

import OpenAI from "openai";

const client = new OpenAI({
  apiKey: process.env.COMETAPI_KEY,
  baseURL: "https://api.cometapi.com/v1",
});

const completion = await client.chat.completions.create({
  model: "gpt-5.6-sol",
  messages: [
    {
      role: "user",
      content: "Passez en revue ce plan de migration et identifiez les trois hypothèses présentant le risque le plus élevé.",
    },
  ],
});

console.log(completion.choices[0].message.content);

Comment appeler GPT-5.6 Sol avec curl ?

curl https://api.cometapi.com/v1/chat/completions \
  -H "Authorization: Bearer $COMETAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-5.6-sol",
    "messages": [
      {
        "role": "user",
        "content": "Passez en revue ce plan de migration et identifiez les trois hypothèses présentant le risque le plus élevé."
      }
    ]
  }'

Consultez le Guide de démarrage rapide CometAPI, le guide de l’URL de base et la référence de l’API Chat Completions pour les détails d’authentification et de paramètres.

FAQ

Où puis-je accéder à l’API GPT-5.6 avec une remise ?

Au 2 septembre 2026, la page du modèle GPT-5.6 de CometAPI indique des tarifs de jetons pour Sol, Terra et Luna inférieurs de 20 % aux tarifs actuels de l’API Standard d’OpenAI pour les requêtes en contexte court et long. L’accès utilise l’URL de base compatible OpenAI https://api.cometapi.com/v1. Confirmez l’ID de modèle exact, le prix et la disponibilité du compte dans le catalogue ou le tableau de bord CometAPI en direct avant l’utilisation en production.

GPT-5.6 est-il encore seulement un modèle sur liste de surveillance ?

Non. OpenAI décrit la famille GPT-5.6 comme généralement disponible, et le journal des modifications de CometAPI indique que la famille est disponible via les formats Chat et Responses. La « liste de surveillance » utile concerne désormais l’évolution des prix, promotions, quotas, ID de routes et disponibilité au niveau du compte plutôt que la question du lancement de la famille.

Quel ID de modèle utilise gpt-5.6 ?

OpenAI précise que l’alias générique gpt-5.6 est routé vers GPT-5.6 Sol. Utilisez explicitement gpt-5.6-terra ou gpt-5.6-luna lorsque vous avez besoin de ces paliers de coût.

Quel modèle GPT-5.6 est le moins cher ?

GPT-5.6 Luna est le palier le plus économique. Sur la page du modèle CometAPI consultée le 2 septembre 2026, son tarif en contexte court est de $0.16 par million de jetons d’entrée et $0.96 par million de jetons de sortie.

La différence de 20 % s’applique-t-elle aux requêtes en contexte long ?

La page du modèle CometAPI indique la même différence de 20 % pour les paliers en contexte court et long. Une fois que l’entrée dépasse 272,000 jetons, les tarifs supérieurs s’appliquent à l’ensemble de la requête ; les tests en contexte long doivent donc être budgétés séparément.

Puis-je passer entre Sol, Terra et Luna sans changer le SDK ?

Oui. Avec une intégration CometAPI compatible OpenAI, l’URL de base et l’authentification restent identiques. Modifiez l’ID de modèle, puis validez tout comportement spécifique au modèle, les paramètres de raisonnement, les objectifs de qualité et les limites de débit avant d’acheminer du trafic de production.

Continuer à apprendre

Reliez cet article à la décision suivante.

Voir tous les sujets
Publié le Sep 3, 2026
Dernière mise à jour Sep 4, 2026
13 vues
Revu pour la clarté, l'attribution des sources et la terminologie API actuelle.

Prêt à réduire vos coûts de développement IA de 20 % ?

Démarrez gratuitement en quelques minutes. Crédits d'essai offerts. Aucune carte bancaire requise.

En savoir plus