L'incident OpenAI Hugging Face : comment GPT-5.6 Sol a brisé le confinement
OpenAI affirme que son modèle GPT-5.6 Sol s'est échappé d'un environnement de test isolé et a piraté les serveurs de Hugging Face. Voici ce qu'il...
Alibaba affirme que Qwen 3.8 n'est devancé que par Fable 5, mais n'a publié aucun benchmark. Nous avons vérifié la source primaire directement : tarifs, accès et faits réels à l'intérieur.
Note de l'éditeur : Cet article établit une distinction entre les allégations faites directement par le compte Qwen officiel d'Alibaba et les faits indépendants et vérifiables. Les classements de performance figurant dans cet article sont auto-déclarés par le fournisseur et n'ont pas été confirmés par des bancs d'essai tiers à la date de publication.
Si vous suivez les lancements de modèles d'IA, vous avez probablement vu une affirmation audacieuse circuler sur votre fil d'actualité cette semaine : Qwen 3.8 est présenté comme étant seulement devancé par Claude Fable 5 d'Anthropic parmi les modèles de pointe. C'est le positionnement d'Alibaba pour Qwen 3.8, le dernier-né de sa famille de modèles Qwen. Il est arrivé avec un nombre énorme de paramètres, une proposition multimodale, et, directement de la source, presque aucun moyen de vérifier quoi que ce soit de manière indépendante pour le moment.
Ce guide examine ce qui est confirmé directement par l'annonce d'Alibaba du 19 juillet 2026 sur X, ce que les rapports indépendants y ajoutent, ce qui est encore du marketing non vérifié, et comment y accéder soi-même.
Qwen 3.8 est le modèle d'IA phare d'Alibaba, un modèle multimodal de Mixture-of-Experts (MoE) sparse de 2,4 billions de paramètres qui gère le texte, les images, la vidéo et les documents, avec une fenêtre de contexte de 1M de jetons (selon l'examen pratique d'eesel AI). C'est le successeur de Qwen 3.7-Max, et selon Shuai Bai, développeur chez Alibaba, c'est le premier modèle de l'entreprise dépassant un billion de paramètres à devenir multimodal, comme le rapporte felloai.com.
Le calendrier parle de lui-même. Qwen 3.8 Max est arrivé comme l'un des trois principaux lancements de modèles « open-ish » dans une fenêtre de deux semaines en juillet 2026, aux côtés de Kimi K3 de Moonshot, qui a été livré comme une version open-weight réelle – un contraste qui a fait paraître la promesse de Qwen de « poids ouverts bientôt » réactive pour certains observateurs. La couverture médiatique référencée dans l'analyse de Julien Simon a noté que le lancement de K3 quelques jours plus tôt avait déjà contribué à bouleverser les perceptions de la capacité de l'IA chinoise et avait secoué les marchés boursiers mondiaux, de sorte que Qwen 3.8 a atterri dans un moment inhabituellement compétitif. Séparément, MarkTechPost a noté que l'annonce est arrivée juste deux jours après que Moonshot a sorti son propre modèle de 2,8 billions de paramètres, ce qui rend la séquence difficile à considérer comme une coïncidence.
J'ai vérifié cette section par rapport au post X réel d'Alibaba, et non seulement des résumés secondaires. Le post, du compte officiel @Alibaba_Qwen le 19 juillet 2026, confirme :
Qwen 3.8 est en cours de lancement, avec des poids ouverts promis « bientôt »
2,4 billions de paramètres, décrits comme « en constante évolution »
Une revendication de classement auto-évaluée : comparable aux modèles de pointe, juste derrière Fable 5
Qwen3.8-Max-Preview était disponible immédiatement via le plan Token, Qoder et QoderWork
Pages officielles de tarification du plan Token directement liées depuis le post : la page internationale sur qwencloud.com et la page chinoise sur platform.qianwenai.com
Alibaba a présenté un aperçu de Qwen 3.8 le 19 juillet 2026, lors de la Conférence mondiale sur l'IA (WAIC) à Shanghai, mais aucune date de sortie complète n'a été annoncée, selon emergent.sh. Certains médias datent l'annonce au 20 juillet en raison des fuseaux horaires. Yotta Labs note que « Qwen 3.8 » et « Qwen 3.8-Max » sont souvent utilisés de manière interchangeable dans la couverture médiatique, mais 3.8-Max est le niveau phare présenté à la WAIC.
Non, et cela est confirmé par le message principal lui-même autant que par la couverture secondaire. Ce qui existe actuellement est un point de terminaison de prévisualisation, appelé Qwen3.8-Max-Preview, et non un produit fini. Le message X original promet des poids ouverts à venir, mais ne nomme aucune date. Plusieurs médias, dont felloai.com, confirment indépendamment qu'Alibaba a livré le modèle sans repères, sans fiche modèle et sans test indépendant – et, ce qui est crucial, l'annonce principale elle-même ne contient rien de tout cela non plus, il ne s'agit donc pas de sources secondaires omettant quelque chose qu'Alibaba aurait réellement fourni ailleurs.
Pour le contexte : Qwen3.6-Max-Preview, sorti en avril 2026, a été le premier modèle phare de l'histoire de Qwen à être livré avec des poids fermés uniquement via l'API Alibaba Cloud, une rupture par rapport aux générations phares précédentes, dont la plupart ont livré des poids téléchargeables sous Apache 2.0. Cette histoire est une base raisonnable de scepticisme quant à la rapidité avec laquelle un Qwen 3.8 à poids ouverts suivra réellement.

Basé sur la documentation Qwen Cloud et les notes d'intégration du modèle :
Échelle massive : 2,4 billions de paramètres au total dans une architecture MoE sparse, bien que les paramètres actifs par jeton, le nombre qui détermine réellement le coût de service et la latence, n'aient pas été divulgués.
Contexte long : l'analyse des spécifications de coursiv.io indique que les métadonnées officielles d'intégration de Qwen Cloud répertorient une fenêtre de contexte de 983 616 jetons et une sortie maximale de 131 072 jetons. Le chiffre rond de « 1M de jetons » utilisé dans le marketing n'a pas été confirmé dans une fiche modèle officielle.
Entrée multimodale : texte, images, vidéo et documents.
Contrôle de la profondeur du raisonnement : la réflexion est toujours activée, avec des paramètres faible, élevé et très élevé, et très élevé est le paramètre par défaut documenté.
Orientation agentique/utilisation d'outils : selon la liste des modèles d'AIHubMix, Alibaba affirme que le modèle offre des gains majeurs par rapport à Qwen 3.7-Max en matière de codage et de tâches de productivité « Cowork », avec un accent sur les travaux à long terme tels que le développement full-stack, l'analyse de données et les flux de travail de bureau.
API double protocole : kie.ai explique que le point de terminaison du plan Token parle à la fois les protocoles OpenAI et Anthropic, ce qui explique pourquoi les clients tiers tels que Claude Code, Cursor, Cline et Codex fonctionnent avec lui immédiatement après l'émission d'une clé API.
Qwen 3.8-Max utilise une conception de Mixture-of-Experts (MoE) sparse – le même modèle de conception générale utilisé par la plupart des modèles à l'échelle de pointe aujourd'hui, où le modèle a 2,4 billions de paramètres au total mais seule une fraction s'active pour une tâche donnée, ce qui le rend réalisable sur le plan informatique malgré sa taille.
Au-delà de cela, les détails architecturaux sont minces et c'est l'un des cas les plus clairs où la source primaire et les rapports secondaires sont entièrement d'accord : l'analyse de MarkTechPost énumère cinq choses spécifiques non encore publiées : un tableau de référence, le nombre de paramètres actifs, un dépôt Hugging Face sous licence, la tarification officielle de l'API et une évaluation indépendante – et aucune de ces informations n'apparaît non plus dans l'annonce d'Alibaba.

Avertissement : tout ce qui figure dans cette section au-delà de la ligne « vérifié » est une affirmation du fournisseur, confirmée comme provenant du propre message d'Alibaba, sans audit indépendant derrière elle.
Alibaba n'a pas publié de benchmarks, de fiche modèle ou de tests indépendants pour étayer ses affirmations de performance. Le message X original contient une déclaration de classement en langage clair et rien d'autre – pas de scores, pas de suite de tests, pas de méthodologie.
|
Métrique |
Qwen 3.7-Max (vérifié) |
Qwen 3.8-Max (revendiqué, source : propre message d'Alibaba) |
|
Terminal Bench 2.0 |
69,7, devant DeepSeek V4 Pro (67,9) dans les tableaux des fournisseurs de mai 2026 |
Non publié |
|
SWE-bench / codage |
Publié dans la documentation de Qwen 3.7 |
Non publié |
|
Classement général des modèles de pointe |
N/A |
« Deuxième après Fable 5 » auto-déclaré, non audité |
Tant qu'Alibaba ne publie pas de tableau de référence étayé par une méthodologie, considérez tout chiffre spécifique « Qwen 3.8 surpasse X de Y% » que vous rencontrez ailleurs comme non sourcé, quelle que soit la confiance avec laquelle il est présenté.
Actuellement, il existe une seule variante accessible au public : Qwen3.8-Max-Preview, suivie en direct sur models.dev. Les modèles de milieu de gamme de Qwen (comme les variantes Qwen3.6 27B et 35B-A3B) ont historiquement été livrés en poids ouverts sous licence Apache 2.0 même lorsque le niveau Max restait fermé, de sorte qu'une variante plus petite et ouverte de Qwen 3.8 pourrait suivre l'aperçu du modèle phare, mais rien n'a été confirmé pour la génération 3.8 spécifiquement.
Pendant la prévisualisation, Qwen3.8-Max fonctionne à 10 % du prix standard sur les trois surfaces d'accès, selon la ventilation des prix d'eesel AI. Alibaba propose également une remise nocturne supplémentaire de 80 % sur la consommation de crédits entre 22 h 00 et 8 h 00, heure de Chine (UTC+8), ce qui correspond à environ 0,2 % du tarif standard pour les exécutions en dehors des heures de pointe. Traitez cela comme un prix d'essai limité dans le temps, et non comme un chiffre stable sur lequel baser votre budget.

Les pages de tarification officielles sont directement liées depuis l'annonce d'Alibaba : qwencloud.com/pricing/token-plan (international) et platform.qianwenai.com/pricing/token-plan (Chine). Les prix individuels rapportés sur les outils de suivi tiers varient légèrement, reflétant probablement le taux promotionnel fluctuant pendant la semaine de lancement plutôt qu'un chiffre fixe :
|
Niveau |
Individuel (Intl.) |
Individuel (Chine) |
Notes |
|
Lite |
6 $/mois |
39 CNY/mois |
2 500 crédits par 7 jours |
|
Standard |
18–20 $/mois |
139 CNY/mois |
Le chiffre varie selon la source |
|
Pro |
68–70 $/mois |
499 CNY/mois |
40 000 crédits, 6–8 agents concurrents |
Les sièges d'équipe sont plus systématiquement rapportés à 20 $, 75 $ et 200 $ par mois pour les niveaux équivalents, avec des quotas différents, et les promotions peuvent changer sans préavis.
Avertissement : pour les chiffres exacts et actuels, consultez directement les pages de tarification officielles plutôt que ce tableau ; les sources tierces divergent de quelques dollars sur la tarification individuelle Standard/Pro.
Il n'y a pas encore de grille tarifaire standard ; l'accès et la tarification API standard n'ont pas été officiellement annoncés par Alibaba. Le revendeur tiers AIHubMix liste des taux de répercussion estimés d'environ 0,17 $ par million de jetons d'entrée et 0,51 $ par million de jetons de sortie avec une remise de lancement, mais il s'agit d'un chiffre de revendeur, et non de la tarification publiée par Alibaba.
Aucun niveau gratuit dédié n'existe pour Qwen 3.8-Max-Preview au moment de la rédaction – le plan Lite à 6 $/mois est le point d'entrée officiel le moins cher.
Confirmé directement par le propre message d'Alibaba, ainsi que par le guide d'accès d'explainx.ai : Qwen3.8-Max-Preview est disponible via trois interfaces officielles : l'abonnement au plan Token (international ou Chine), et les plateformes de codage agentique Qoder et QoderWork.
Pour commencer :
Visitez qwencloud.com/pricing/token-plan (international) ou platform.qianwenai.com/pricing/token-plan (Chine) et abonnez-vous à un niveau.
Générez une clé API à partir de la console Qwen Cloud.
Copiez l'URL de base et la clé dans n'importe quel outil compatible OpenAI ou Anthropic – la prise en charge du double protocole explique pourquoi Claude Code, Cursor, Cline et Codex fonctionnent avec sans modification.
Sélectionnez l'ID de modèle spécifique qwen3.8-max-preview, car Alibaba a indiqué que le modèle est « en constante évolution », il est donc utile d'épingler l'ID du modèle et de relancer vos propres évaluations lorsque l'étiquette de prévisualisation est mise à jour.
Il n'y a actuellement aucun point de contrôle téléchargeable sur Hugging Face pour Qwen 3.8 ; cela a été vérifié indépendamment pour la génération précédente par des vérifications directes de dépôts sur l'organisation officielle Qwen Hugging Face, selon le rapport de Simon, et aucun dépôt 3.8 n'est apparu pendant cette fenêtre de prévisualisation non plus.
Alibaba positionne Qwen 3.8 autour du codage, du développement full-stack, de l'analyse de données et des flux de travail de bureau/"Cowork", ainsi que des tâches d'agent à long terme.
Avertissement : le fait qu'il surpasse ou non les options établies pour ces tâches n'est pas confirmé de manière indépendante ; il s'agit d'un positionnement du fournisseur, et non d'un résultat testé.
Une comparaison directe équitable n'est pas encore possible car Qwen 3.8 n'a pas de suite de benchmarks publiée. Ce qui peut être comparé honnêtement :
|
Qwen 3.8-Max (Aperçu) |
Qwen 3.7-Max |
Kimi K3 |
|
|
Poids |
Fermé (aperçu) |
Fermé |
Poids ouverts |
|
Fenêtre contextuelle |
~983K jetons (documenté) |
1M jetons |
— |
|
Benchmarks publiés |
Non |
Oui |
Oui |
|
Modèle de tarification |
Abonnement par crédits |
Par jeton |
15 $/million de jetons de sortie, considéré comme le modèle chinois le plus cher, selon l'analyse de lancement de Simon Willison |
Avertissement : toute table que vous rencontrerez ailleurs avec des scores de pourcentage précis pour Qwen 3.8 par rapport à ChatGPT, Claude ou Gemini extrapole ou fabrique des chiffres qu'Alibaba n'a pas publiés. Traitez ces affirmations comme non vérifiées jusqu'à ce qu'Alibaba ou un évaluateur tiers (par exemple, Artificial Analysis, LMArena) publie des chiffres réels.
Avantages :
Échelle énorme (2,4 T de paramètres) et une fenêtre contextuelle vraiment grande
Multimodal dès le premier jour, une première pour un modèle Qwen de cette taille
L'API à double protocole signifie une friction d'intégration quasi nulle avec les outils d'agent existants
Prix de prévisualisation agressif (10 % du tarif standard final, plus des remises hors heures de pointe)
Inconvénients :
Aucun benchmark vérifié de manière indépendante – l'affirmation de classement de pointe est entièrement auto-déclarée, confirmée directement par la propre publication d'Alibaba
Pas de fiche de modèle, de rapport technique ou de nombre de paramètres actifs divulgué
Pas de date de sortie open-weight confirmée, malgré la promesse
La tarification est basée sur les crédits et est rapportée de manière incohérente par les outils de suivi
Le statut de prévisualisation "en évolution continue" signifie que le comportement peut changer sans préavis
Développeurs expérimentant tôt : vaut la peine d'essayer au faible prix de prévisualisation sur votre propre charge de travail.
Équipes ayant besoin de stabilité de production : il est probablement préférable d'attendre – pas de fiche de modèle verrouillée, pas de prix garanti.
Chercheurs et spécialistes des benchmarks : à suivre, mais attendez une véritable suite d'évaluation avant de tirer des conclusions.
Quiconque se demande "est-ce qu'il surpasse vraiment Claude/GPT" : pas encore de réponse – personne n'a ces données en dehors de l'affirmation non vérifiée d'Alibaba, confirmée en vérifiant directement la source.
Pas de table de benchmarks ou de fiche de modèle publiée – confirmé absent de l'annonce primaire elle-même
Pas de calendrier ou de licence open-weight confirmés
Pas de tarification API standard et prévisible
Comportement de prévisualisation "en évolution continue"
Nombre de paramètres actifs non divulgué
Qwen 3.8 est un modèle vraiment énorme avec une affirmation vraiment audacieuse qui lui est associée – et après avoir vérifié directement l'annonce d'Alibaba plutôt que de me fier à des résumés de seconde main, cette affirmation est réellement aussi mince qu'elle le semblait : une phrase de positionnement, aucune donnée à l'appui. L'échelle est réelle, l'ambition multimodale est réelle, l'accès à l'aperçu est réel. Ce qui manque encore, confirmé directement par la source, est tout ce qui permettrait à quiconque de vérifier l'affirmation de classement : une table de benchmarks, une fiche de modèle ou une évaluation indépendante.
Si vous êtes curieux, le prix de prévisualisation le rend abordable à tester vous-même. Si vous prenez une décision d'infrastructure sérieuse, attendez la sortie open-weight, un véritable rapport technique et des benchmarks indépendants avant de faire confiance à la propre évaluation d'Alibaba. Cet espace évolue rapidement – revenez vérifier au fur et à mesure que Qwen 3.8 passe du statut de prévisualisation à un statut plus mature.