Le Qwen3.8-Max d'Alibaba est là avec 2,4 billions de paramètres. Mais pouvez-vous réellement l’utiliser ?
19 juillet 2026 — WAIC Shanghai. Deux jours après que Moonshot AI ait abandonné Kimi K3 (2 800 milliards de paramètres, poids ouverts promis pour le 27 juillet), Alibaba a riposté. L'équipe Qwen a présenté en avant-première Qwen3.8-Max-Preview, un modèle multimodal de 2 400 milliards de paramètres qui, selon la société, est « juste derrière Claude Fable 5 » parmi les systèmes qu'elle a comparés.
La course aux armements en matière d’IA est devenue beaucoup plus bruyante.
Mais voici le problème – et il est important – le modèle que vous pouvez réellement utiliser aujourd'hui n'est pas celui dont vous avez entendu parler. Séparons ce qui a été expédié de ce qui a été réclamé.
Ce qui est actuellement disponible
Le produit en direct est Qwen3.8-Max-Preview, accessible via l'abonnement Token Plan d'Alibaba, Qoder et QoderWork. Shuai Bai, un développeur de Qwen, a confirmé qu'il s'agit du premier modèle multimodal de l'équipe dépassant 1 000 milliards de paramètres, gérant du texte, des images, des vidéos et des documents dans une architecture de mélange d'experts clairsemée.
Faits clés sur ce qui est en direct :
- 2,4 billions de paramètres (affirmation d'Alibaba — aucune carte modèle ou spécification n'a été publiée pour le confirmer)
- Architecture MoE clairsemée : le nombre de paramètres actifs par jeton n'est pas divulgué, c'est-à-dire le nombre qui détermine réellement le coût de service.
- Multimodal : traite le texte, les images, les vidéos et les documents
- Compatible OpenAI et Anthropic API — les agents de codage existants peuvent pointer vers Qwen3.8 sans reconstruire leurs harnais
- Tarif d'avant-première — offert à 10 % du prix standard via Token Plan
Le problème du poids ouvert
Qwen3.8 est commercialisé en tant que modèle ouvert. Mais aujourd’hui, il n’existe pas de poids ouverts. Pas sur Hugging Face, ni nulle part.
Le compte officiel @Alibaba_Qwen indique que les poids ouverts arriveront "bientôt" - mais sans date, sans licence, sans référentiel Hugging Face et, surtout, aucune petite variante annoncée. Un modèle de 2 400 milliards de paramètres est un objet de centre de données, quelle que soit la difficulté avec laquelle vous le quantifiez. Même avec une quantification de 1 bit, vous envisagez environ 270 Go+. Pour le contexte, cela représente environ 35 GPU NVIDIA H200 rien que pour les poids.
La propre histoire d’Alibaba raconte ici une histoire mitigée :
Le modèle a changé avec Qwen 3.7, livré en tant que modèle propriétaire uniquement API, sans poids ouverts – ni un 27B, ni un 9B, rien. Si Qwen 3.8 suit la cadence 3,5/3,6, attendez-vous à une variante exécutable 27B ou 35B-A3B d'ici une à deux semaines. S'il suit le précédent 3.7, vous obtenez une suppression du centre de données étiquetée « ouvert » et rien pour votre GPU.
"Deuxième après Fable 5" — Parlons-en
L'affirmation d'Alibaba « juste derrière Fable 5 » est un classement autodéclaré. Aucun tableau de référence n’a été publié. Aucune invite, harnais ou méthodologie. Le classement d'Analyse Artificielle – l'indice indépendant le plus cité – ne répertorie pas du tout Qwen 3.8. Son sommet actuel ressemble à ceci :
- Claude Fable 5 — 60
- GPT-5.6 — 59
- Kimi K3 — 57
- Claude Opus 4.8 — 56
- Qwen 3.7 Max — 46
Il existe un précédent historique ici : Qwen 3.7 Max a été présenté comme "le numéro un de la Chine" et, lorsqu'il a été noté de manière indépendante, il a atterri à 46 - toujours fort, mais ce n'est pas ce que l'annonce impliquait.
Comment ça se compare : le test TrilogyAI
Une référence indépendante a émergé. TrilogyAI a exécuté Qwen3.8-Max-Preview et Kimi K3 via un test StackPerf correspondant : 269 fichiers répartis sur deux projets inconnus nécessitant des recommandations de planification, de storyboard et d'architecture système.
Résultats après examen aveugle :
Kimi a devancé Qwen de 3 points, mais Qwen a produit des métadonnées de relecture plus solides et des définitions de limites du système plus claires. Les chercheurs ont noté que « leur recommandation commune était plus forte que l’un ou l’autre contrat proposé seul ».
Le contexte géopolitique
Cette version n’existe pas en vase clos. Le 7 juillet, Reuters a rapporté que le ministère chinois du Commerce avait eu des discussions avec Alibaba, ByteDance et Z.ai sur une éventuelle restriction de l'accès à l'étranger aux modèles d'IA les plus avancés de Chine – des discussions qui couvraient explicitement les versions ouvertes et même les futurs modèles inédits.
Alibaba était un participant désigné.
La société n'a pas encore lié ces discussions aux plans de sortie de Qwen, et aucune règle n'existe pour l'instant. Mais le calendrier de l'ouverture prochaine des pondérations, parallèlement aux consultations gouvernementales sur leur restriction, mérite d'être surveillé de près.
Le résultat
Qwen3.8-Max-Preview est un modèle réel et performant. Si l'affirmation d'Alibaba concernant le 2,4T résiste à des tests indépendants, elle est véritablement compétitive par rapport aux systèmes frontières. Les capacités multimodales, la compatibilité API et les tarifs d’aperçu sont tous positifs.
Mais jusqu'à ce que les poids ouverts soient livrés – avec une licence qui signifie quelque chose, dans une taille qui correspond au matériel réel – appeler Qwen 3.8 « ouvert » est prématuré. Regardez l'organisation Qwen Hugging Face, pas les tweets. Les poids ou une petite variante nommée sont le seul signal qui compte.
Pour l’instant, la course aux armements en matière d’IA est réelle. La révolution du modèle ouvert ? J'attends toujours.
Cet article a été recherché et publié le 20 juillet 2026. Qwen3.8-Max-Preview a été annoncé le 19 juillet 2026 au WAIC Shanghai. Les références et la disponibilité changent rapidement : consultez les dernières mises à jour de @Alibaba_Qwen.