Qwen 3.8 Max : 2,4 billions de paramètres, zéro benchmarks — Ce qu'Alibaba a réellement confirmé (2026)

Alibaba affirme que Qwen 3.8 n'est devancé que par Fable 5, mais n'a publié aucun benchmark. Nous avons vérifié la source primaire directement : tarifs, accès et faits réels à l'intérieur.

Qwen 3.8 Max

Note de l'éditeur : Cet article établit une distinction entre les allégations faites directement par le compte Qwen officiel d'Alibaba et les faits indépendants et vérifiables. Les classements de performance figurant dans cet article sont auto-déclarés par le fournisseur et n'ont pas été confirmés par des bancs d'essai tiers à la date de publication.

Introduction

Si vous suivez les lancements de modèles d'IA, vous avez probablement vu une affirmation audacieuse circuler sur votre fil d'actualité cette semaine : Qwen 3.8 est présenté comme étant seulement devancé par Claude Fable 5 d'Anthropic parmi les modèles de pointe. C'est le positionnement d'Alibaba pour Qwen 3.8, le dernier-né de sa famille de modèles Qwen. Il est arrivé avec un nombre énorme de paramètres, une proposition multimodale, et, directement de la source, presque aucun moyen de vérifier quoi que ce soit de manière indépendante pour le moment.

Ce guide examine ce qui est confirmé directement par l'annonce d'Alibaba du 19 juillet 2026 sur X, ce que les rapports indépendants y ajoutent, ce qui est encore du marketing non vérifié, et comment y accéder soi-même.

Qu'est-ce que Qwen 3.8 ?

Aperçu

Qwen 3.8 est le modèle d'IA phare d'Alibaba, un modèle multimodal de Mixture-of-Experts (MoE) sparse de 2,4 billions de paramètres qui gère le texte, les images, la vidéo et les documents, avec une fenêtre de contexte de 1M de jetons (selon l'examen pratique d'eesel AI). C'est le successeur de Qwen 3.7-Max, et selon Shuai Bai, développeur chez Alibaba, c'est le premier modèle de l'entreprise dépassant un billion de paramètres à devenir multimodal, comme le rapporte felloai.com.

Pourquoi Qwen 3.8 est important

Le calendrier parle de lui-même. Qwen 3.8 Max est arrivé comme l'un des trois principaux lancements de modèles « open-ish » dans une fenêtre de deux semaines en juillet 2026, aux côtés de Kimi K3 de Moonshot, qui a été livré comme une version open-weight réelle – un contraste qui a fait paraître la promesse de Qwen de « poids ouverts bientôt » réactive pour certains observateurs. La couverture médiatique référencée dans l'analyse de Julien Simon a noté que le lancement de K3 quelques jours plus tôt avait déjà contribué à bouleverser les perceptions de la capacité de l'IA chinoise et avait secoué les marchés boursiers mondiaux, de sorte que Qwen 3.8 a atterri dans un moment inhabituellement compétitif. Séparément, MarkTechPost a noté que l'annonce est arrivée juste deux jours après que Moonshot a sorti son propre modèle de 2,8 billions de paramètres, ce qui rend la séquence difficile à considérer comme une coïncidence.

Statut de publication de Qwen 3.8 : vérifié par rapport à la source primaire

L'annonce, confirmée directement

J'ai vérifié cette section par rapport au post X réel d'Alibaba, et non seulement des résumés secondaires. Le post, du compte officiel @Alibaba_Qwen le 19 juillet 2026, confirme :

  • Qwen 3.8 est en cours de lancement, avec des poids ouverts promis « bientôt »

  • 2,4 billions de paramètres, décrits comme « en constante évolution »

  • Une revendication de classement auto-évaluée : comparable aux modèles de pointe, juste derrière Fable 5

  • Qwen3.8-Max-Preview était disponible immédiatement via le plan Token, Qoder et QoderWork

  • Pages officielles de tarification du plan Token directement liées depuis le post : la page internationale sur qwencloud.com et la page chinoise sur platform.qianwenai.com

Alibaba a présenté un aperçu de Qwen 3.8 le 19 juillet 2026, lors de la Conférence mondiale sur l'IA (WAIC) à Shanghai, mais aucune date de sortie complète n'a été annoncée, selon emergent.sh. Certains médias datent l'annonce au 20 juillet en raison des fuseaux horaires. Yotta Labs note que « Qwen 3.8 » et « Qwen 3.8-Max » sont souvent utilisés de manière interchangeable dans la couverture médiatique, mais 3.8-Max est le niveau phare présenté à la WAIC.

Qwen 3.8 est-il entièrement publié ?

Non, et cela est confirmé par le message principal lui-même autant que par la couverture secondaire. Ce qui existe actuellement est un point de terminaison de prévisualisation, appelé Qwen3.8-Max-Preview, et non un produit fini. Le message X original promet des poids ouverts à venir, mais ne nomme aucune date. Plusieurs médias, dont felloai.com, confirment indépendamment qu'Alibaba a livré le modèle sans repères, sans fiche modèle et sans test indépendant – et, ce qui est crucial, l'annonce principale elle-même ne contient rien de tout cela non plus, il ne s'agit donc pas de sources secondaires omettant quelque chose qu'Alibaba aurait réellement fourni ailleurs.

Pour le contexte : Qwen3.6-Max-Preview, sorti en avril 2026, a été le premier modèle phare de l'histoire de Qwen à être livré avec des poids fermés uniquement via l'API Alibaba Cloud, une rupture par rapport aux générations phares précédentes, dont la plupart ont livré des poids téléchargeables sous Apache 2.0. Cette histoire est une base raisonnable de scepticisme quant à la rapidité avec laquelle un Qwen 3.8 à poids ouverts suivra réellement.

Principales fonctionnalités de Qwen 3.8

Tableau des prix des abonnements

Basé sur la documentation Qwen Cloud et les notes d'intégration du modèle :

  • Échelle massive : 2,4 billions de paramètres au total dans une architecture MoE sparse, bien que les paramètres actifs par jeton, le nombre qui détermine réellement le coût de service et la latence, n'aient pas été divulgués.

  • Contexte long : l'analyse des spécifications de coursiv.io indique que les métadonnées officielles d'intégration de Qwen Cloud répertorient une fenêtre de contexte de 983 616 jetons et une sortie maximale de 131 072 jetons. Le chiffre rond de « 1M de jetons » utilisé dans le marketing n'a pas été confirmé dans une fiche modèle officielle.

  • Entrée multimodale : texte, images, vidéo et documents.

  • Contrôle de la profondeur du raisonnement : la réflexion est toujours activée, avec des paramètres faible, élevé et très élevé, et très élevé est le paramètre par défaut documenté.

  • Orientation agentique/utilisation d'outils : selon la liste des modèles d'AIHubMix, Alibaba affirme que le modèle offre des gains majeurs par rapport à Qwen 3.7-Max en matière de codage et de tâches de productivité « Cowork », avec un accent sur les travaux à long terme tels que le développement full-stack, l'analyse de données et les flux de travail de bureau.

  • API double protocole : kie.ai explique que le point de terminaison du plan Token parle à la fois les protocoles OpenAI et Anthropic, ce qui explique pourquoi les clients tiers tels que Claude Code, Cursor, Cline et Codex fonctionnent avec lui immédiatement après l'émission d'une clé API.

  •  

  •  

  •  

Architecture de Qwen 3.8

Qwen 3.8-Max utilise une conception de Mixture-of-Experts (MoE) sparse – le même modèle de conception générale utilisé par la plupart des modèles à l'échelle de pointe aujourd'hui, où le modèle a 2,4 billions de paramètres au total mais seule une fraction s'active pour une tâche donnée, ce qui le rend réalisable sur le plan informatique malgré sa taille.

Au-delà de cela, les détails architecturaux sont minces et c'est l'un des cas les plus clairs où la source primaire et les rapports secondaires sont entièrement d'accord : l'analyse de MarkTechPost énumère cinq choses spécifiques non encore publiées : un tableau de référence, le nombre de paramètres actifs, un dépôt Hugging Face sous licence, la tarification officielle de l'API et une évaluation indépendante – et aucune de ces informations n'apparaît non plus dans l'annonce d'Alibaba.

Benchmarks de Qwen 3.8

Infographie de benchmarks Qwen 3.8

Avertissement : tout ce qui figure dans cette section au-delà de la ligne « vérifié » est une affirmation du fournisseur, confirmée comme provenant du propre message d'Alibaba, sans audit indépendant derrière elle.

Alibaba n'a pas publié de benchmarks, de fiche modèle ou de tests indépendants pour étayer ses affirmations de performance. Le message X original contient une déclaration de classement en langage clair et rien d'autre – pas de scores, pas de suite de tests, pas de méthodologie.

Métrique

Qwen 3.7-Max (vérifié)

Qwen 3.8-Max (revendiqué, source : propre message d'Alibaba)

Terminal Bench 2.0

69,7, devant DeepSeek V4 Pro (67,9) dans les tableaux des fournisseurs de mai 2026

Non publié

SWE-bench / codage

Publié dans la documentation de Qwen 3.7

Non publié

Classement général des modèles de pointe

N/A

« Deuxième après Fable 5 » auto-déclaré, non audité

Tant qu'Alibaba ne publie pas de tableau de référence étayé par une méthodologie, considérez tout chiffre spécifique « Qwen 3.8 surpasse X de Y% » que vous rencontrez ailleurs comme non sourcé, quelle que soit la confiance avec laquelle il est présenté.

Variantes du modèle Qwen 3.8

Actuellement, il existe une seule variante accessible au public : Qwen3.8-Max-Preview, suivie en direct sur models.dev. Les modèles de milieu de gamme de Qwen (comme les variantes Qwen3.6 27B et 35B-A3B) ont historiquement été livrés en poids ouverts sous licence Apache 2.0 même lorsque le niveau Max restait fermé, de sorte qu'une variante plus petite et ouverte de Qwen 3.8 pourrait suivre l'aperçu du modèle phare, mais rien n'a été confirmé pour la génération 3.8 spécifiquement.

Tarification

Remise de prévisualisation

Pendant la prévisualisation, Qwen3.8-Max fonctionne à 10 % du prix standard sur les trois surfaces d'accès, selon la ventilation des prix d'eesel AI. Alibaba propose également une remise nocturne supplémentaire de 80 % sur la consommation de crédits entre 22 h 00 et 8 h 00, heure de Chine (UTC+8), ce qui correspond à environ 0,2 % du tarif standard pour les exécutions en dehors des heures de pointe. Traitez cela comme un prix d'essai limité dans le temps, et non comme un chiffre stable sur lequel baser votre budget.

Niveaux d'abonnement au plan Token

Tableau des tarifs du plan Token

Les pages de tarification officielles sont directement liées depuis l'annonce d'Alibaba : qwencloud.com/pricing/token-plan (international) et platform.qianwenai.com/pricing/token-plan (Chine). Les prix individuels rapportés sur les outils de suivi tiers varient légèrement, reflétant probablement le taux promotionnel fluctuant pendant la semaine de lancement plutôt qu'un chiffre fixe :

Niveau

Individuel (Intl.)

Individuel (Chine)

Notes

Lite

6 $/mois

39 CNY/mois

2 500 crédits par 7 jours

Standard

18–20 $/mois

139 CNY/mois

Le chiffre varie selon la source

Pro

68–70 $/mois

499 CNY/mois

40 000 crédits, 6–8 agents concurrents

Les sièges d'équipe sont plus systématiquement rapportés à 20 $, 75 $ et 200 $ par mois pour les niveaux équivalents, avec des quotas différents, et les promotions peuvent changer sans préavis.

Avertissement : pour les chiffres exacts et actuels, consultez directement les pages de tarification officielles plutôt que ce tableau ; les sources tierces divergent de quelques dollars sur la tarification individuelle Standard/Pro.

Tarification API

Il n'y a pas encore de grille tarifaire standard ; l'accès et la tarification API standard n'ont pas été officiellement annoncés par Alibaba. Le revendeur tiers AIHubMix liste des taux de répercussion estimés d'environ 0,17 $ par million de jetons d'entrée et 0,51 $ par million de jetons de sortie avec une remise de lancement, mais il s'agit d'un chiffre de revendeur, et non de la tarification publiée par Alibaba.

Niveau gratuit

Aucun niveau gratuit dédié n'existe pour Qwen 3.8-Max-Preview au moment de la rédaction – le plan Lite à 6 $/mois est le point d'entrée officiel le moins cher.

Comment accéder à Qwen 3.8

Confirmé directement par le propre message d'Alibaba, ainsi que par le guide d'accès d'explainx.ai : Qwen3.8-Max-Preview est disponible via trois interfaces officielles : l'abonnement au plan Token (international ou Chine), et les plateformes de codage agentique Qoder et QoderWork.

Pour commencer :

  1. Visitez qwencloud.com/pricing/token-plan (international) ou platform.qianwenai.com/pricing/token-plan (Chine) et abonnez-vous à un niveau.

  2. Générez une clé API à partir de la console Qwen Cloud.

  3. Copiez l'URL de base et la clé dans n'importe quel outil compatible OpenAI ou Anthropic – la prise en charge du double protocole explique pourquoi Claude Code, Cursor, Cline et Codex fonctionnent avec sans modification.

  4. Sélectionnez l'ID de modèle spécifique qwen3.8-max-preview, car Alibaba a indiqué que le modèle est « en constante évolution », il est donc utile d'épingler l'ID du modèle et de relancer vos propres évaluations lorsque l'étiquette de prévisualisation est mise à jour.

Il n'y a actuellement aucun point de contrôle téléchargeable sur Hugging Face pour Qwen 3.8 ; cela a été vérifié indépendamment pour la génération précédente par des vérifications directes de dépôts sur l'organisation officielle Qwen Hugging Face, selon le rapport de Simon, et aucun dépôt 3.8 n'est apparu pendant cette fenêtre de prévisualisation non plus.

Meilleurs cas d'utilisation (revendiqués par le fournisseur, non vérifiés indépendamment)

Alibaba positionne Qwen 3.8 autour du codage, du développement full-stack, de l'analyse de données et des flux de travail de bureau/"Cowork", ainsi que des tâches d'agent à long terme.

Avertissement : le fait qu'il surpasse ou non les options établies pour ces tâches n'est pas confirmé de manière indépendante ; il s'agit d'un positionnement du fournisseur, et non d'un résultat testé.

Qwen 3.8 vs. Autres modèles de pointe

Une comparaison directe équitable n'est pas encore possible car Qwen 3.8 n'a pas de suite de benchmarks publiée. Ce qui peut être comparé honnêtement :


Qwen 3.8-Max (Aperçu)

Qwen 3.7-Max

Kimi K3

Poids

Fermé (aperçu)

Fermé

Poids ouverts

Fenêtre contextuelle

~983K jetons (documenté)

1M jetons

Benchmarks publiés

Non

Oui

Oui

Modèle de tarification

Abonnement par crédits

Par jeton

15 $/million de jetons de sortie, considéré comme le modèle chinois le plus cher, selon l'analyse de lancement de Simon Willison

Avertissement : toute table que vous rencontrerez ailleurs avec des scores de pourcentage précis pour Qwen 3.8 par rapport à ChatGPT, Claude ou Gemini extrapole ou fabrique des chiffres qu'Alibaba n'a pas publiés. Traitez ces affirmations comme non vérifiées jusqu'à ce qu'Alibaba ou un évaluateur tiers (par exemple, Artificial Analysis, LMArena) publie des chiffres réels.

Avantages et inconvénients

Avantages :

  • Échelle énorme (2,4 T de paramètres) et une fenêtre contextuelle vraiment grande

  • Multimodal dès le premier jour, une première pour un modèle Qwen de cette taille

  • L'API à double protocole signifie une friction d'intégration quasi nulle avec les outils d'agent existants

  • Prix de prévisualisation agressif (10 % du tarif standard final, plus des remises hors heures de pointe)

Inconvénients :

  • Aucun benchmark vérifié de manière indépendante – l'affirmation de classement de pointe est entièrement auto-déclarée, confirmée directement par la propre publication d'Alibaba

  • Pas de fiche de modèle, de rapport technique ou de nombre de paramètres actifs divulgué

  • Pas de date de sortie open-weight confirmée, malgré la promesse

  • La tarification est basée sur les crédits et est rapportée de manière incohérente par les outils de suivi

  • Le statut de prévisualisation "en évolution continue" signifie que le comportement peut changer sans préavis

Qui devrait utiliser Qwen 3.8 dès maintenant ?

  • Développeurs expérimentant tôt : vaut la peine d'essayer au faible prix de prévisualisation sur votre propre charge de travail.

  • Équipes ayant besoin de stabilité de production : il est probablement préférable d'attendre – pas de fiche de modèle verrouillée, pas de prix garanti.

  • Chercheurs et spécialistes des benchmarks : à suivre, mais attendez une véritable suite d'évaluation avant de tirer des conclusions.

  • Quiconque se demande "est-ce qu'il surpasse vraiment Claude/GPT" : pas encore de réponse – personne n'a ces données en dehors de l'affirmation non vérifiée d'Alibaba, confirmée en vérifiant directement la source.

Limitations courantes

  • Pas de table de benchmarks ou de fiche de modèle publiée – confirmé absent de l'annonce primaire elle-même

  • Pas de calendrier ou de licence open-weight confirmés

  • Pas de tarification API standard et prévisible

  • Comportement de prévisualisation "en évolution continue"

  • Nombre de paramètres actifs non divulgué

Conclusion

Qwen 3.8 est un modèle vraiment énorme avec une affirmation vraiment audacieuse qui lui est associée – et après avoir vérifié directement l'annonce d'Alibaba plutôt que de me fier à des résumés de seconde main, cette affirmation est réellement aussi mince qu'elle le semblait : une phrase de positionnement, aucune donnée à l'appui. L'échelle est réelle, l'ambition multimodale est réelle, l'accès à l'aperçu est réel. Ce qui manque encore, confirmé directement par la source, est tout ce qui permettrait à quiconque de vérifier l'affirmation de classement : une table de benchmarks, une fiche de modèle ou une évaluation indépendante.

Si vous êtes curieux, le prix de prévisualisation le rend abordable à tester vous-même. Si vous prenez une décision d'infrastructure sérieuse, attendez la sortie open-weight, un véritable rapport technique et des benchmarks indépendants avant de faire confiance à la propre évaluation d'Alibaba. Cet espace évolue rapidement – revenez vérifier au fur et à mesure que Qwen 3.8 passe du statut de prévisualisation à un statut plus mature.

Foire aux questions

Qwen 3.8 est le tout dernier modèle d'IA phare d'Alibaba. Il s'agit d'un modèle multimodal à architecture Mixture of Experts (MoE) sparse de 2,4 billions de paramètres, présenté en avant-première le 19 juillet 2026.

Aucune offre gratuite officielle n'a été confirmée. À ce jour, la formule la plus abordable proposée par Alibaba est le Token Plan Lite, disponible à partir de 6 $ par mois.

Qwen 3.8 est développé par l'équipe Qwen d'Alibaba.

Pas encore. Alibaba a annoncé que les poids du modèle seraient publiés « prochainement », mais aucune date de sortie ni licence open source n'ont été communiquées.

Il est encore trop tôt pour établir une comparaison fiable. Alibaba n'a publié aucun benchmark officiel, et aucun test indépendant n'a confirmé ses performances face à ChatGPT ou Claude.

Oui. Qwen 3.8 est un modèle multimodal capable de traiter des images, des vidéos et des documents en plus du texte.

Qwen 3.8 prend en charge une fenêtre de contexte allant jusqu'à 983 616 tokens, avec une limite de sortie de 131 072 tokens. Alibaba présente généralement cette capacité comme un contexte d'environ 1 million de tokens.

Oui. Les développeurs peuvent accéder à l'API via le Token Plan, compatible avec les interfaces de type OpenAI et Anthropic.

Selon Alibaba, Qwen 3.8 offre de meilleures performances pour la programmation et les tâches agentiques. Toutefois, aucun benchmark indépendant ne confirme encore ces affirmations.

Qwen 3.8 est accessible via le Token Plan sur QwenCloud, ainsi que sur Qoder et QoderWork, en utilisant l'identifiant de modèle qwen3.8-max-preview.