Alibaba dévoile Qwen3.8-Max, son plus grand modèle d'IA

iEXExchanger
Alibaba dévoile Qwen3.8-Max, son plus grand modèle d'IA

Alibaba a dévoilé Qwen3.8-Max, un modèle de 2 400 milliards de paramètres avec une fenêtre de contexte d'un million de tokens. L'entreprise affirme être juste derrière Claude Fable 5, l'action a bondi de 7 %.

Alibaba a dévoilé Qwen3.8-Max, le plus grand modèle qu'elle ait jamais construit : 2 400 milliards de paramètres au total, dont seulement 95 milliards s'activent à chaque requête. C'est l'architecture "mélange d'experts" : plutôt que de mobiliser tout le système à chaque question, elle ne réveille que les blocs spécialisés nécessaires, ce qui limite le coût de calcul malgré l'ampleur du modèle.

Le modèle traite le texte, l'image et la vidéo, et conserve jusqu'à un million de tokens de contexte, soit environ 750 000 mots — de quoi charger un livre entier et lui demander de retrouver un paragraphe précis. Alibaba l'a conçu pour le codage autonome et les tâches de recherche longues, où le modèle doit avancer seul pendant des dizaines d'étapes.

Sur le classement Arena.AI, il s'est immédiatement imposé comme le meilleur modèle chinois sur les tâches de texte et s'est classé deuxième mondial en vision, derrière une seule variante de Claude Fable 5 d'Anthropic. Alibaba l'affirme sans détour : le modèle est "juste derrière Fable 5". C'est une déclaration de l'entreprise, pas une vérification indépendante, et sur d'autres benchmarks, Qwen3.8-Max ressemble davantage à un concurrent à égalité avec Kimi K3 de Moonshot AI qu'à un modèle nettement supérieur.

Alibaba promet une version à poids ouverts la semaine prochaine, un retour à l'open source après plusieurs modèles phares gardés fermés. Le modèle est pour l'instant accessible via l'API de Model Studio et la nouvelle plateforme QwenWork, passée en bêta publique le même jour. L'action Alibaba a bondi de 7 % à Hong Kong, clôturant à 125,20 HK$.

Derrière tout cela, une course des laboratoires chinois pour rattraper les leaders américains en offrant des poids ouverts gratuits aux développeurs, pendant qu'Anthropic, OpenAI et Google gardent leurs meilleurs modèles fermés.

Questions et réponses

Questions fréquemment posées sur le sujet de l'article

Qu'est-ce que Qwen3.8-Max ?

C'est le nouveau modèle phare d'Alibaba, avec 2 400 milliards de paramètres au total mais seulement 95 milliards actifs par requête. Il traite texte, image et vidéo avec jusqu'à un million de tokens de contexte.

Qu'est-ce que l'architecture « mélange d'experts » ?

C'est une conception où seuls les blocs spécialisés nécessaires à une requête s'activent, plutôt que tout le réseau. Cela permet d'augmenter la taille du modèle sans faire grimper le coût de calcul dans les mêmes proportions.

Qwen3.8-Max dépasse-t-il vraiment Claude ?

Alibaba affirme n'être devancé que par Claude Fable 5 d'Anthropic, mais c'est une évaluation de l'entreprise elle-même, pas une vérification indépendante. Sur d'autres benchmarks, il semble plutôt à égalité avec son rival chinois Kimi K3.

Quand les poids ouverts seront-ils publiés ?

Alibaba annonce une version à poids ouverts une semaine après l'annonce. Pour l'instant, le modèle n'est accessible que via l'API de Model Studio et la plateforme QwenWork, passée en bêta publique le même jour.