TL;DR Qwen3.8 Max Preview est disponible pour des tests précoces via l’écosystème Token Plan d’Alibaba et les produits Qoder pris en charge, mais la tarification API à l’usage de Model Studio n’a pas encore été publiée. Pour les charges de production, Qwen3.7 Max reste la base la plus sûre, tandis que Qwen3.8 convient mieux à une évaluation contrôlée.
Qwen3.8 Max Preview est le dernier fleuron en préversion associé à la génération Qwen3.8 d’Alibaba. Les développeurs peuvent déjà le tester via des produits pris en charge tels que Qwen Code et Qoder, tandis que des détails clés pour la production — notamment la tarification API standard, les limites de débit, la disponibilité régionale et le versionnage stable — restent incomplets.
Pour les équipes utilisant déjà Qwen3.7 Max, les questions clés sont simples : L’API Qwen3.8 Max est-elle prête pour la production, combien coûte-t-elle et cela vaut-il la peine de migrer ?
Ce guide se concentre sur ces décisions, notamment les méthodes d’accès actuelles, la tarification en Crédits Qoder, les spécifications confirmées et la façon d’évaluer Qwen3.8 Max Preview par rapport à Qwen3.7 Max.
Le teaser officiel de Qwen pour Qwen3.8 met en avant un nombre de paramètres de 2,4 billions et une publication en poids ouverts prévue. Le modèle hébergé qwen3.8-max-preview est déjà disponible via certains produits, tandis que la publication plus large des poids ouverts est encore à venir.
Source*:* Qwen sur X
Tarification de l’API Qwen3.8 Max
Au 20 juillet 2026, Alibaba n’a pas publié de prix standard par million de jetons en entrée ou en sortie pour Qwen3.8 Max.
Les développeurs doivent donc éviter de supposer que Qwen3.8 réutilisera la tarification de Qwen3.7 Max, que les Crédits Qoder équivalent aux coûts directs des jetons API, ou que l’ID de modèle qwen3.8-max-preview restera inchangé après la disponibilité générale.
Aperçu rapide de Qwen3.8 Max Preview
| Élément | Statut au 20 juillet 2026 |
|---|---|
| ID du modèle | qwen3.8-max-preview |
| Phase de diffusion | Preview |
| Nombre total de paramètres annoncé | 2,4 billions |
| Accès actuel | Écosystème Token Plan d’Alibaba et produits Qoder pris en charge |
| Tarification standard Model Studio | Pas encore publiée |
| Taux de Crédit Qoder standard | 0.5x |
| Taux promotionnel Qoder | 0.05x heures normales ; 0.01x heures creuses |
| Fenêtre de contexte | 1,000,000 jetons via les métadonnées d’intégration de Qwen Code |
| Mode de réflexion | Activé dans les métadonnées d’intégration de Qwen Code |
| Entrée image et vidéo | Activée dans les métadonnées d’intégration de Qwen Code |
| Poids ouverts | Annoncé comme à venir bientôt |
| Meilleur usage aujourd’hui | Évaluation contrôlée |
La distinction clé est entre Qwen3.8, la nouvelle génération de modèles annoncée, et qwen3.8-max-preview, la voie de préversion actuellement visible dans les produits pris en charge.
L’annonce officielle de Qwen décrit Qwen3.8 comme un modèle de 2,4 billions de paramètres et indique qu’une publication en poids ouverts est prévue. Qwen Code a séparément ajouté qwen3.8-max-preview à son intégration Token Plan.
Ce qui est confirmé à propos de Qwen3.8 Max Preview
Parce que Qwen3.8 est encore en préversion, il est utile de distinguer les annonces officielles des métadonnées d’intégration.
| Assertion | Niveau de preuve | Statut actuel |
|---|---|---|
| 2,4T de paramètres au total | Annonce officielle | Rapporté par l’équipe Qwen |
| ID de modèle qwen3.8-max-preview | Intégration officielle | Ajouté à Qwen Code Token Plan |
| Contexte de 1,000,000 jetons | Métadonnées d’intégration | Configuré dans Qwen Code |
| Mode de réflexion | Métadonnées d’intégration | Activé dans Qwen Code |
| Entrée image et vidéo | Métadonnées d’intégration | Activée dans Qwen Code |
| Publication en poids ouverts | Intention officielle | Annoncée comme à venir |
| Tarification des jetons de l’API standard | Inconnue | Pas encore listée publiquement |
| Architecture et paramètres actifs | Inconnus | Pas encore documentés publiquement |
| Consensus de benchmarks indépendants | Limité | Trop tôt pour une conclusion stable |
La configuration de Qwen Code fournit des indications utiles pour la fenêtre de contexte 1M, le mode de réflexion et la prise en charge de l’entrée multimodale. Toutefois, cela reste des spécifications au niveau de l’intégration tant qu’Alibaba n’a pas publié une fiche modèle complète pour Model Studio.
Que signifie « Thinking mode » ici ? Qwen Code active le comportement de réflexion pour
qwen3.8-max-preview. Dans l’écosystème API plus large, les modèles dotés de cette capacité sont souvent décrits comme des modèles de raisonnement, où un calcul supplémentaire peut être utilisé avant de générer une réponse finale. La comptabilisation et la tarification finales des jetons de raisonnement ou de réflexion n’ont pas encore été documentées pour une API Qwen3.8 Max standard.
Comment accéder à Qwen3.8 Max Preview
Les voies d’accès confirmées à ce jour incluent :
- L’écosystème Token Plan d’Alibaba
- Qwen Code
- Qoder Desktop
- Qoder JetBrains Plugin
- Qoder CLI
- Qoder Cloud Agents
- Produits Web et Mobile Qoder
Le dépôt officiel de Qwen Code inclut qwen3.8-max-preview dans son intégration Token Plan, tandis que la documentation de lancement de Qoder liste le modèle dans les produits Qoder pris en charge.
Les développeurs créant des intégrations API directes doivent confirmer l’ID exact du modèle, la compatibilité des points de terminaison, la disponibilité régionale, les limites de débit, les limites de contexte et le comportement de facturation avant d’utiliser la préversion dans des systèmes de production.
Tarification Qoder pour Qwen3.8 : que signifient 0.05x et 0.01x ?
Qoder propose actuellement une remise promotionnelle pour Qwen3.8 Max Preview.
| Période | Taux en Crédits pour Qwen3.8 Max Preview | Remise vs taux standard 0.5x |
|---|---|---|
| Heures normales | 0.05x | -90 % |
| Heures creuses | 0.01x | -98 % |
La promotion a débuté le 19 juillet 2026, avec une date de fin actuellement indiquée comme TBD.
Qoder définit sa période creuse comme 22:00–08:00 heure de Singapour (UTC+8). Pendant l’heure d’été aux États‑Unis en juillet 2026, cela correspond approximativement à :
- 10:00–20:00 EDT
- 7:00–17:00 PDT
Les Crédits Qoder ne sont pas des prix par jeton d’API
Qoder Credits est une unité de ressource au niveau produit. La consommation peut varier selon le modèle, l’usage de jetons et le nombre d’appels déclenchés par des workflows d’agent ou de sous‑agent.
Ce calcul est valide :
discounted workflow credits =
base workflow credits × applicable Qoder multiplier
Mais celui‑ci ne l’est pas :
Qwen3.8 API token price =
0.05 × an assumed price per million tokens
Pour les équipes évaluant le modèle via Qoder, une métrique plus utile est :
credits per successful task =
total Credits consumed / successful tasks
Cela reflète le coût réel pour mener à bien un workflow sans convertir à tort les Crédits en prix par jeton API.
Qwen3.8 Max Preview vs Qwen3.7 Max
Pour les développeurs utilisant déjà Qwen3.7 Max, la question pratique est de savoir si la préversion est prête à le remplacer.
| Dimension | Qwen3.7 Max | Qwen3.8 Max Preview |
|---|---|---|
| Statut de diffusion | Modèle de production établi | Preview |
| Tarification standard à l’usage | Publiée | Pas encore publiée |
| Déploiement régional | Documenté | Pas encore entièrement documenté |
| IDs de modèle versionnés | Disponibles | Pas encore documentés pour la GA |
| Mise en cache du contexte | Documentée | Règles de production en attente |
| Prise en charge du traitement par lots | Disponible sur les routes prises en charge | Pas encore documentée |
| Modélisation des coûts | Prévisible | Limitée |
| Meilleur usage aujourd’hui | Production | Évaluation |
Alibaba Cloud documente la tarification de Qwen3.7 Max selon différents périmètres de déploiement. Les prix et promotions peuvent varier selon la région ; les développeurs doivent donc consulter la page de tarification de Model Studio.
Pour les équipes utilisant CometAPI, l’API Qwen3.7 Max fournit une base de production pratique pour évaluer les futures charges Qwen3.8.
Pour des cas d’usage plus légers ou plus sensibles aux coûts, Qwen3.7 Plus constitue un autre point de comparaison.
Les utilisateurs de Qwen3.7 Max doivent-ils migrer vers Qwen3.8 maintenant ?
L’approche pragmatique est la suivante :
Testez Qwen3.8 Max Preview dès maintenant, mais ne migrez que si ses gains de qualité justifient les compromis opérationnels et de coût.
Testez Qwen3.8 Max Preview si :
- Votre charge inclut des tâches de codage ou d’agents difficiles.
- Vous évaluez des workflows fortement axés sur le raisonnement.
- Vous avez besoin de long contexte ou de capacités multimodales.
- Vous pouvez tolérer des changements de comportement propres à la préversion.
- Vous disposez de tests automatisés ou de grilles de relecture humaine.
Conservez Qwen3.7 Max en production si :
- Vous avez besoin de coûts par jeton prévisibles.
- Le déploiement régional est important.
- Des IDs de modèle stables et du versionnage sont requis.
- Votre architecture dépend d’un comportement documenté de cache ou de traitement par lots.
- Les performances actuelles de Qwen3.7 Max satisfont déjà les exigences.
Le nombre de paramètres annoncé de 2,4 billions ne doit pas, à lui seul, dicter la migration.
Pour les systèmes d’IA en production, le plus utile est généralement le taux de résolution, la latence, les relances, le temps de correction humaine et le coût par tâche réussie plutôt que le nombre total de paramètres.
Comment évaluer Qwen3.8 Max Preview
Plutôt que de s’appuyer sur des annonces de lancement ou un seul benchmark, construisez un petit ensemble d’évaluation basé sur vos charges réelles.
Un point de départ pratique est de 20–30 tâches représentatives.
| Charge de travail | Exemples de tâches | Ce qu’il faut mesurer |
|---|---|---|
| Codage de référentiel | Correctifs multi‑fichiers, refactoring, tests | Taux de réussite, relances, appels d’outils |
| Développement full‑stack | Mise en œuvre de fonctionnalités | Qualité d’exécution, temps de correction |
| Analyse de données | CSV, tableaux, scripts | Précision, raisonnement, qualité des artefacts |
| Bureautique | Documents et feuilles de calcul | Exhaustivité, modifications humaines |
| Tâches long contexte | Grands dépôts ou documents | Rappel, cohérence |
| Tâches de raisonnement | Problèmes techniques multi‑étapes | Précision, latence |
| Codage de routine | Correctifs simples | Si le modèle plus grand apporte de la valeur |
Pour chaque tâche, consignez :
- Réussite ou échec
- Appels au modèle et aux outils
- Relances
- Latence de bout en bout
- Jetons d’entrée et de sortie
- Jetons de raisonnement lorsqu’ils sont exposés
- Crédits Qoder consommés
- Temps de correction humaine
Pour Qwen3.7 Max :
cost per successful task =
total API cost / successful tasks
Pour Qwen3.8 Max Preview via Qoder :
credits per successful task =
total Credits consumed / successful tasks
Une fois la tarification API standard de Qwen3.8 disponible, relancez la même évaluation et comparez :
qualité × latence × fiabilité × coût
Cela fournit un signal de migration plus utile que les seuls scores de benchmark.
Ce que les développeurs doivent surveiller ensuite
- Fiche modèle officielle dans Model Studio.
- Tarification des jetons d’entrée, de sortie, d’entrée mise en cache et de raisonnement.
- Disponibilité régionale de l’API et limites de débit.
- IDs de modèle stables et versionnage.
- Prise en charge de Context Cache et Batch.
- Dépôt des poids ouverts et licence.
- Détails d’architecture et de paramètres actifs.
- Benchmarks indépendants de codage, d’agents, multimodaux, de latence et d’efficacité.
FAQ
L’API Qwen3.8 Max est-elle disponible ?
Qwen3.8 Max Preview est accessible via l’écosystème Token Plan d’Alibaba et les produits Qoder pris en charge. Une offre API Model Studio de disponibilité générale complète n’a pas encore été documentée publiquement.
Combien coûte l’API Qwen3.8 Max ?
La tarification standard par million de jetons n’a pas encore été publiée. Qoder propose actuellement des taux promotionnels en Crédits de 0.05x et 0.01x, mais il s’agit de Crédits Qoder et non de prix généraux par jeton d’API.
Qwen3.8 Max Preview dispose‑t‑il d’une fenêtre de contexte de 1M ?
Les métadonnées d’intégration Token Plan de Qwen Code configurent une fenêtre de contexte de 1,000,000 jetons pour qwen3.8-max-preview. Les limites de production spécifiques aux endpoints doivent encore être confirmées lorsque Alibaba publiera la documentation finale.
Puis‑je utiliser Qwen3.8 Max via une API compatible OpenAI ?
Un endpoint de production largement documenté pour Qwen3.8 Max avec un contrat API compatible OpenAI final n’a pas encore été publié. Les développeurs doivent vérifier l’endpoint de préversion exact et les paramètres pris en charge avant l’intégration.
Dois‑je remplacer Qwen3.7 Max par Qwen3.8 Max Preview ?
Pour la plupart des systèmes en production, pas encore. Utilisez Qwen3.7 Max comme base stable et évaluez Qwen3.8 Max Preview jusqu’à ce que sa tarification et son comportement en production soient mieux documentés.
Préparez‑vous à Qwen3.8 sur CometAPI
La compatibilité Qwen3.8 Max arrive bientôt sur CometAPI. Une fois disponible, les équipes pourront tester le modèle via le workflow API unifié de CometAPI et le comparer directement aux modèles de production existants.
En attendant, Kimi K3 peut servir d’alternative pratique pour le codage avancé, le raisonnement et les workflows d’agent. Les équipes peuvent commencer à construire leur base d’évaluation avec Kimi K3 aujourd’hui, puis relancer les mêmes tâches sur Qwen3.8 Max lorsqu’il sera disponible.
Pour les équipes utilisant déjà la famille Qwen, l’API Qwen3.7 Max reste un point de référence utile pour mesurer les améliorations de qualité, de latence et de coût entre générations de modèles.
Vous pouvez également parcourir le Catalogue des modèles CometAPI pour connaître les modèles les plus récents disponibles.
