Kimi K3 is now live on CometAPI →

API Qwen3.8 Max en préversion : accès, disponibilité et guide de migration

CometAPI
Mia MarenJul 20, 2026
API Qwen3.8 Max en préversion : accès, disponibilité et guide de migration

TL;DR Qwen3.8 Max Preview est disponible pour des tests précoces via l’écosystème Token Plan d’Alibaba et les produits Qoder pris en charge, mais la tarification API à l’usage de Model Studio n’a pas encore été publiée. Pour les charges de production, Qwen3.7 Max reste la base la plus sûre, tandis que Qwen3.8 convient mieux à une évaluation contrôlée.

Qwen3.8 Max Preview est le dernier fleuron en préversion associé à la génération Qwen3.8 d’Alibaba. Les développeurs peuvent déjà le tester via des produits pris en charge tels que Qwen Code et Qoder, tandis que des détails clés pour la production — notamment la tarification API standard, les limites de débit, la disponibilité régionale et le versionnage stable — restent incomplets.

Pour les équipes utilisant déjà Qwen3.7 Max, les questions clés sont simples : L’API Qwen3.8 Max est-elle prête pour la production, combien coûte-t-elle et cela vaut-il la peine de migrer ?

Ce guide se concentre sur ces décisions, notamment les méthodes d’accès actuelles, la tarification en Crédits Qoder, les spécifications confirmées et la façon d’évaluer Qwen3.8 Max Preview par rapport à Qwen3.7 Max.

Image

Le teaser officiel de Qwen pour Qwen3.8 met en avant un nombre de paramètres de 2,4 billions et une publication en poids ouverts prévue. Le modèle hébergé qwen3.8-max-preview est déjà disponible via certains produits, tandis que la publication plus large des poids ouverts est encore à venir.

Source*:* Qwen sur X

Tarification de l’API Qwen3.8 Max

Au 20 juillet 2026, Alibaba n’a pas publié de prix standard par million de jetons en entrée ou en sortie pour Qwen3.8 Max.

Les développeurs doivent donc éviter de supposer que Qwen3.8 réutilisera la tarification de Qwen3.7 Max, que les Crédits Qoder équivalent aux coûts directs des jetons API, ou que l’ID de modèle qwen3.8-max-preview restera inchangé après la disponibilité générale.

Aperçu rapide de Qwen3.8 Max Preview

ÉlémentStatut au 20 juillet 2026
ID du modèleqwen3.8-max-preview
Phase de diffusionPreview
Nombre total de paramètres annoncé2,4 billions
Accès actuelÉcosystème Token Plan d’Alibaba et produits Qoder pris en charge
Tarification standard Model StudioPas encore publiée
Taux de Crédit Qoder standard0.5x
Taux promotionnel Qoder0.05x heures normales ; 0.01x heures creuses
Fenêtre de contexte1,000,000 jetons via les métadonnées d’intégration de Qwen Code
Mode de réflexionActivé dans les métadonnées d’intégration de Qwen Code
Entrée image et vidéoActivée dans les métadonnées d’intégration de Qwen Code
Poids ouvertsAnnoncé comme à venir bientôt
Meilleur usage aujourd’huiÉvaluation contrôlée

La distinction clé est entre Qwen3.8, la nouvelle génération de modèles annoncée, et qwen3.8-max-preview, la voie de préversion actuellement visible dans les produits pris en charge.

L’annonce officielle de Qwen décrit Qwen3.8 comme un modèle de 2,4 billions de paramètres et indique qu’une publication en poids ouverts est prévue. Qwen Code a séparément ajouté qwen3.8-max-preview à son intégration Token Plan.

Ce qui est confirmé à propos de Qwen3.8 Max Preview

Parce que Qwen3.8 est encore en préversion, il est utile de distinguer les annonces officielles des métadonnées d’intégration.

AssertionNiveau de preuveStatut actuel
2,4T de paramètres au totalAnnonce officielleRapporté par l’équipe Qwen
ID de modèle qwen3.8-max-previewIntégration officielleAjouté à Qwen Code Token Plan
Contexte de 1,000,000 jetonsMétadonnées d’intégrationConfiguré dans Qwen Code
Mode de réflexionMétadonnées d’intégrationActivé dans Qwen Code
Entrée image et vidéoMétadonnées d’intégrationActivée dans Qwen Code
Publication en poids ouvertsIntention officielleAnnoncée comme à venir
Tarification des jetons de l’API standardInconnuePas encore listée publiquement
Architecture et paramètres actifsInconnusPas encore documentés publiquement
Consensus de benchmarks indépendantsLimitéTrop tôt pour une conclusion stable

La configuration de Qwen Code fournit des indications utiles pour la fenêtre de contexte 1M, le mode de réflexion et la prise en charge de l’entrée multimodale. Toutefois, cela reste des spécifications au niveau de l’intégration tant qu’Alibaba n’a pas publié une fiche modèle complète pour Model Studio.

Que signifie « Thinking mode » ici ? Qwen Code active le comportement de réflexion pour qwen3.8-max-preview. Dans l’écosystème API plus large, les modèles dotés de cette capacité sont souvent décrits comme des modèles de raisonnement, où un calcul supplémentaire peut être utilisé avant de générer une réponse finale. La comptabilisation et la tarification finales des jetons de raisonnement ou de réflexion n’ont pas encore été documentées pour une API Qwen3.8 Max standard.

Comment accéder à Qwen3.8 Max Preview

Les voies d’accès confirmées à ce jour incluent :

  • L’écosystème Token Plan d’Alibaba
  • Qwen Code
  • Qoder Desktop
  • Qoder JetBrains Plugin
  • Qoder CLI
  • Qoder Cloud Agents
  • Produits Web et Mobile Qoder

Le dépôt officiel de Qwen Code inclut qwen3.8-max-preview dans son intégration Token Plan, tandis que la documentation de lancement de Qoder liste le modèle dans les produits Qoder pris en charge.

Les développeurs créant des intégrations API directes doivent confirmer l’ID exact du modèle, la compatibilité des points de terminaison, la disponibilité régionale, les limites de débit, les limites de contexte et le comportement de facturation avant d’utiliser la préversion dans des systèmes de production.

Tarification Qoder pour Qwen3.8 : que signifient 0.05x et 0.01x ?

Qoder propose actuellement une remise promotionnelle pour Qwen3.8 Max Preview.

PériodeTaux en Crédits pour Qwen3.8 Max PreviewRemise vs taux standard 0.5x
Heures normales0.05x-90 %
Heures creuses0.01x-98 %

La promotion a débuté le 19 juillet 2026, avec une date de fin actuellement indiquée comme TBD.

Qoder définit sa période creuse comme 22:00–08:00 heure de Singapour (UTC+8). Pendant l’heure d’été aux États‑Unis en juillet 2026, cela correspond approximativement à :

  • 10:00–20:00 EDT
  • 7:00–17:00 PDT

Les Crédits Qoder ne sont pas des prix par jeton d’API

Qoder Credits est une unité de ressource au niveau produit. La consommation peut varier selon le modèle, l’usage de jetons et le nombre d’appels déclenchés par des workflows d’agent ou de sous‑agent.

Ce calcul est valide :

discounted workflow credits =
base workflow credits × applicable Qoder multiplier

Mais celui‑ci ne l’est pas :

Qwen3.8 API token price =
0.05 × an assumed price per million tokens

Pour les équipes évaluant le modèle via Qoder, une métrique plus utile est :

credits per successful task =
total Credits consumed / successful tasks

Cela reflète le coût réel pour mener à bien un workflow sans convertir à tort les Crédits en prix par jeton API.

Qwen3.8 Max Preview vs Qwen3.7 Max

Pour les développeurs utilisant déjà Qwen3.7 Max, la question pratique est de savoir si la préversion est prête à le remplacer.

DimensionQwen3.7 MaxQwen3.8 Max Preview
Statut de diffusionModèle de production établiPreview
Tarification standard à l’usagePubliéePas encore publiée
Déploiement régionalDocumentéPas encore entièrement documenté
IDs de modèle versionnésDisponiblesPas encore documentés pour la GA
Mise en cache du contexteDocumentéeRègles de production en attente
Prise en charge du traitement par lotsDisponible sur les routes prises en chargePas encore documentée
Modélisation des coûtsPrévisibleLimitée
Meilleur usage aujourd’huiProductionÉvaluation

Alibaba Cloud documente la tarification de Qwen3.7 Max selon différents périmètres de déploiement. Les prix et promotions peuvent varier selon la région ; les développeurs doivent donc consulter la page de tarification de Model Studio.

Pour les équipes utilisant CometAPI, l’API Qwen3.7 Max fournit une base de production pratique pour évaluer les futures charges Qwen3.8.

Pour des cas d’usage plus légers ou plus sensibles aux coûts, Qwen3.7 Plus constitue un autre point de comparaison.

Les utilisateurs de Qwen3.7 Max doivent-ils migrer vers Qwen3.8 maintenant ?

L’approche pragmatique est la suivante :

Testez Qwen3.8 Max Preview dès maintenant, mais ne migrez que si ses gains de qualité justifient les compromis opérationnels et de coût.

Testez Qwen3.8 Max Preview si :

  • Votre charge inclut des tâches de codage ou d’agents difficiles.
  • Vous évaluez des workflows fortement axés sur le raisonnement.
  • Vous avez besoin de long contexte ou de capacités multimodales.
  • Vous pouvez tolérer des changements de comportement propres à la préversion.
  • Vous disposez de tests automatisés ou de grilles de relecture humaine.

Conservez Qwen3.7 Max en production si :

  • Vous avez besoin de coûts par jeton prévisibles.
  • Le déploiement régional est important.
  • Des IDs de modèle stables et du versionnage sont requis.
  • Votre architecture dépend d’un comportement documenté de cache ou de traitement par lots.
  • Les performances actuelles de Qwen3.7 Max satisfont déjà les exigences.

Le nombre de paramètres annoncé de 2,4 billions ne doit pas, à lui seul, dicter la migration.

Pour les systèmes d’IA en production, le plus utile est généralement le taux de résolution, la latence, les relances, le temps de correction humaine et le coût par tâche réussie plutôt que le nombre total de paramètres.

Comment évaluer Qwen3.8 Max Preview

Plutôt que de s’appuyer sur des annonces de lancement ou un seul benchmark, construisez un petit ensemble d’évaluation basé sur vos charges réelles.

Un point de départ pratique est de 20–30 tâches représentatives.

Charge de travailExemples de tâchesCe qu’il faut mesurer
Codage de référentielCorrectifs multi‑fichiers, refactoring, testsTaux de réussite, relances, appels d’outils
Développement full‑stackMise en œuvre de fonctionnalitésQualité d’exécution, temps de correction
Analyse de donnéesCSV, tableaux, scriptsPrécision, raisonnement, qualité des artefacts
BureautiqueDocuments et feuilles de calculExhaustivité, modifications humaines
Tâches long contexteGrands dépôts ou documentsRappel, cohérence
Tâches de raisonnementProblèmes techniques multi‑étapesPrécision, latence
Codage de routineCorrectifs simplesSi le modèle plus grand apporte de la valeur

Pour chaque tâche, consignez :

  • Réussite ou échec
  • Appels au modèle et aux outils
  • Relances
  • Latence de bout en bout
  • Jetons d’entrée et de sortie
  • Jetons de raisonnement lorsqu’ils sont exposés
  • Crédits Qoder consommés
  • Temps de correction humaine

Pour Qwen3.7 Max :

cost per successful task =
total API cost / successful tasks

Pour Qwen3.8 Max Preview via Qoder :

credits per successful task =
total Credits consumed / successful tasks

Une fois la tarification API standard de Qwen3.8 disponible, relancez la même évaluation et comparez :

qualité × latence × fiabilité × coût

Cela fournit un signal de migration plus utile que les seuls scores de benchmark.

Ce que les développeurs doivent surveiller ensuite

  1. Fiche modèle officielle dans Model Studio.
  2. Tarification des jetons d’entrée, de sortie, d’entrée mise en cache et de raisonnement.
  3. Disponibilité régionale de l’API et limites de débit.
  4. IDs de modèle stables et versionnage.
  5. Prise en charge de Context Cache et Batch.
  6. Dépôt des poids ouverts et licence.
  7. Détails d’architecture et de paramètres actifs.
  8. Benchmarks indépendants de codage, d’agents, multimodaux, de latence et d’efficacité.

FAQ

L’API Qwen3.8 Max est-elle disponible ?

Qwen3.8 Max Preview est accessible via l’écosystème Token Plan d’Alibaba et les produits Qoder pris en charge. Une offre API Model Studio de disponibilité générale complète n’a pas encore été documentée publiquement.

Combien coûte l’API Qwen3.8 Max ?

La tarification standard par million de jetons n’a pas encore été publiée. Qoder propose actuellement des taux promotionnels en Crédits de 0.05x et 0.01x, mais il s’agit de Crédits Qoder et non de prix généraux par jeton d’API.

Qwen3.8 Max Preview dispose‑t‑il d’une fenêtre de contexte de 1M ?

Les métadonnées d’intégration Token Plan de Qwen Code configurent une fenêtre de contexte de 1,000,000 jetons pour qwen3.8-max-preview. Les limites de production spécifiques aux endpoints doivent encore être confirmées lorsque Alibaba publiera la documentation finale.

Puis‑je utiliser Qwen3.8 Max via une API compatible OpenAI ?

Un endpoint de production largement documenté pour Qwen3.8 Max avec un contrat API compatible OpenAI final n’a pas encore été publié. Les développeurs doivent vérifier l’endpoint de préversion exact et les paramètres pris en charge avant l’intégration.

Dois‑je remplacer Qwen3.7 Max par Qwen3.8 Max Preview ?

Pour la plupart des systèmes en production, pas encore. Utilisez Qwen3.7 Max comme base stable et évaluez Qwen3.8 Max Preview jusqu’à ce que sa tarification et son comportement en production soient mieux documentés.

Préparez‑vous à Qwen3.8 sur CometAPI

La compatibilité Qwen3.8 Max arrive bientôt sur CometAPI. Une fois disponible, les équipes pourront tester le modèle via le workflow API unifié de CometAPI et le comparer directement aux modèles de production existants.

En attendant, Kimi K3 peut servir d’alternative pratique pour le codage avancé, le raisonnement et les workflows d’agent. Les équipes peuvent commencer à construire leur base d’évaluation avec Kimi K3 aujourd’hui, puis relancer les mêmes tâches sur Qwen3.8 Max lorsqu’il sera disponible.

Pour les équipes utilisant déjà la famille Qwen, l’API Qwen3.7 Max reste un point de référence utile pour mesurer les améliorations de qualité, de latence et de coût entre générations de modèles.

Vous pouvez également parcourir le Catalogue des modèles CometAPI pour connaître les modèles les plus récents disponibles.

Prêt à réduire vos coûts de développement IA de 20 % ?

Démarrez gratuitement en quelques minutes. Crédits d'essai offerts. Aucune carte bancaire requise.

En savoir plus