Lorsque les États-Unis ont restreint la vente de puces d’IA à la Chine, ils savaient qu’il s’agissait d’une mesure désespérée. Alibaba vient de le confirmer
Le géant chinois Alibaba a dévoilé Qwen3.8-Max, son modèle d’IA le plus ambitieux à ce jour. Il est multimodal, dispose d’une fenêtre contextuelle d’un million de jetons et se distingue également par deux autres choses : la première, étant à nouveau un modèle ouvert, ce que l’entreprise avait exclu dans les versions précédentes. La seconde, absolument gigantesque, avec 2,4 milliards de paramètres.
Ce qui se passe. Nous sommes confrontés à un modèle qui se targue de rivaliser avec le meilleur d’OpenAI et d’Anthropic, et qui menace une fois de plus de démontrer que les modèles chinois ne sont plus en retard sur les modèles frontières américains. C’est une période absolument folle pour l’IA.

Les tests internes d’Alibaba doivent encore être confirmés par des tests indépendants, mais Qwen3-8-Max promet beaucoup.
Je fais référence aux preuves. Les benchmarks internes montrent comment Qwen3.8-Max rivalise face à face avec Fable 5 et GPT-5.6 Sol dans divers benchmarks, prenant un peu de retard dans certains mais dépassant également les deux modèles dans d’autres. Kimi K3 était déjà « impressionnant », mais ce modèle Alibaba va encore plus loin. Bien entendu, ces résultats devront être validés par des tests indépendants.
Un modèle qui, plus que parler, fonctionne. Qwen3.8-Max fonctionne particulièrement bien dans l’ingénierie logicielle, le fonctionnement des terminaux, la perception visuelle et le contrôle des ordinateurs et des téléphones mobiles. Ce sont des critères conçus pour mesurer quelque chose de plus ambitieux que la simple « réponse à une question ». Le modèle peut utiliser des outils et effectuer de longues tâches, et dans la vidéo promotionnelle présentée ici, ils se vantent de pouvoir concevoir des puces ou remplir des contrats pendant que vous vous détendez un moment. Le message est clair : l’IA travaille pour vous.
La taille est impressionnante. Qwen3.8-Max possède 2,4 milliards de paramètres (il y a 10 mois ils atteignaient à peine un milliard), un chiffre proche des 2,8 milliards de Kimi K3. Son architecture MoE (Mixture of Experts) répartit les connaissances entre différents « experts » et n’active qu’environ 95 milliards de paramètres par requête. C’est déjà une technique bien connue pour pouvoir augmenter les performances du modèle, le rendant également très efficace.
Les restrictions ne servent à rien. En 2022, les États-Unis ont commencé à restreindre l’accès de la Chine aux équipements avancés de fabrication de puces et de semi-conducteurs. Ensuite, il a restreint l’accès à d’autres types de composants technologiques avancés sous prétexte de sécurité nationale. Cela aurait théoriquement dû rendre très difficile pour la Chine de faire progresser le développement de ses propres modèles d’IA. Ces mesures n’ont pratiquement servi à rien et ont en fait fait disparaître presque complètement l’ancienne dépendance à l’égard des États-Unis. La Chine est montée en puissance et a réussi à réduire son avance dans la course de manière surprenante. Aujourd’hui, il n’est pas du tout clair que les modèles frontières américains soient bien plus puissants que le Kimi K3 ou ce nouveau Qwen3.8-Max.
Et le modèle local promet encore plus. Dans le cadre de cette annonce, Alibaba a déclaré qu’il proposerait la semaine prochaine le Qwen3.8-27B et publierait les poids des deux modèles. L’entreprise certifie ainsi revenir à la philosophie ouverte qu’elle avait momentanément abandonnée, mais ce modèle aux 27 milliards de paramètres est surtout prometteur pour ceux qui souhaitent disposer d’un modèle d’IA local et privé qu’ils pourront exécuter sur leurs PC et ordinateurs portables.
La Chine ne veut plus être « l’alternative bon marché ». Pendant des années, l’industrie de l’IA a semblé clairement et confortablement divisée en deux camps. Les laboratoires américains étaient en tête en termes de performances et les Chinois rivalisaient grâce à des modèles ouverts avec des prix bien inférieurs. Qwen3.8-Max, comme Kimi K3, provoque la rupture de cet équilibre, et s’il répond aux attentes, nous envisageons un modèle dont les performances sont égales à celles du Fable 5 ou du GPT-5.6 Sol à une fraction de son prix. A défaut de confirmation, ce modèle est bon, joli et pas cher.

OpenAI et Anthropic ont un autre problème, et ce ne sont pas des benchmarks. Lorsque plusieurs modèles américains et chinois atteignent des niveaux similaires, l’IA commence à devenir un modèle dans lequel il n’y a pas de gagnant clair entre un modèle et un autre, car ils sont tous vraiment bons. Cette tendance touche les startups d’IA qui gagnent leur vie en faisant payer un accès exclusif à leurs modèles, comme c’est le cas d’OpenAI et d’Anthropic. Mais Alibaba ne dispose pas seulement d’une API qui rivalise avec celles de ces entreprises : elle a Alibaba Cloud comme infrastructure cloud. Qwen3.8-Max n’est peut-être qu’un cheval de Troie, si bien que de plus en plus de clients finissent par utiliser les services cloud de l’entreprise plutôt que d’autres alternatives.
La Chine accélère. Au cours des deux derniers mois, nous avons pu constater à quel point les laboratoires chinois d’IA ont progressé de façon spectaculaire. C’est d’abord Z.ai avec le surprenant GLM-5.2 qui commençait déjà à envoyer le message, puis Moonshot AI avec son Kimi K3, et maintenant Alibaba avec Qwen3.8-Max. DeepSeek V4 vient également d’être mis à jour avec une version bêta Flash axée sur le rapport prix/performance. C’est non-stop.
Images | Marc
À Simseo | « Nous avons un mythe chez nous » : les experts affirment déjà que le modèle chinois GLM-5.2 est aussi « dangereux » que celui d’Anthropic
