Ce qu'Alibaba a annoncé à Shanghai
Le 19 juillet, à la Conférence mondiale sur l'IA de Shanghai, l'équipe Qwen d'Alibaba a présenté Qwen3.8-Max, le prochain modèle phare de la famille Qwen. La spécification mise en avant est de 2 400 milliards de paramètres, et c'est le premier modèle multimodal de l'équipe au-dessus du millier de milliards, capable de traiter texte, images, vidéo et documents dans un seul système.
Alibaba le place juste derrière Claude Fable 5 et affirme qu'il améliore Qwen3.7-Max sur le codage, le développement complet, l'analyse de données et les flux de travail bureautiques. Une préversion est accessible via Token Plan, Qoder et QoderWork d'Alibaba à 10 pour cent du prix standard, et l'entreprise a promis une publication des poids ouverts bientôt, sans annoncer de date.
Le chiffre manquant est celui qui tarife votre charge
Pourquoi c'est important : 2 400 milliards est le nombre qui circule et celui qui vous apprend le moins. Les grands modèles de frontière de cette forme sont des systèmes creux à mélange d'experts, ce qui signifie que seule une partie des paramètres est mobilisée pour une requête donnée. Le total décrit la taille du modèle. Le nombre actif décrit la part qui s'exécute, et donc la puissance de calcul consommée par chaque requête.
Alibaba n'a pas divulgué le nombre actif. Cette seule omission rend la taille annoncée inutilisable pour planifier : un modèle de 2 400 milliards de paramètres avec une petite fraction active peut coûter moins cher à servir qu'un modèle dense bien plus petit, et un modèle à grande fraction active peut coûter bien davantage. Qui dimensionne un budget à partir du chiffre du titre travaille sur un nombre choisi pour impressionner et non pour informer.
Une revendication de classement encore sans rien derrière
La revendication de deuxième place mérite le même examen. Alibaba a nommé un concurrent précis, Claude Fable 5, et s'est placé juste en dessous, sans publier de résultats de tests à l'appui de ce positionnement.
C'est l'inverse du schéma auquel se fier. Quand Moonshot a publié Kimi K3, sa propre annonce plaçait le modèle deuxième au général, et les tests indépendants sur Arena.ai l'ont ensuite classé premier pour le code d'interface. Un fournisseur dont la revendication est plus modeste que le résultat indépendant vous a donné un signal exploitable. Un fournisseur dont la revendication arrive sans le moindre résultat indépendant vous a donné une ligne de communiqué. Tant que les classements publics n'auront pas noté Qwen3.8-Max, ce positionnement reste l'opinion d'Alibaba sur Alibaba.
Lisez la remise pour ce qu'elle est
L'essentiel : une préversion à 10 pour cent du tarif public est une invitation à tester, pas une offre sur laquelle bâtir. Le prix remplit une fonction, celle d'amener de vraies charges sur un modèle non éprouvé assez vite pour produire les preuves d'évaluation que le lancement n'a pas fournies.
Rien d'incorrect à cela, et pour une équipe européenne disposant de capacité d'évaluation, ce peut être un moyen peu coûteux d'apprendre quelque chose. L'erreur serait de prendre le tarif remisé pour l'économie du modèle. Les prix de préversion s'arrêtent, le tarif standard est dix fois plus élevé, et tout dossier économique bâti sur le chiffre promotionnel s'inverse dès la fermeture de la préversion. Si vous testez, testez sur votre propre charge et relevez le coût au tarif public complet, pas au tarif de lancement.
Bientôt n'est pas une date, et la comparaison en a une
La promesse de poids ouverts est la partie aux conséquences les plus nettes pour qui pèse son indépendance vis-à-vis d'une interface hébergée. Alibaba dit que les poids arriveront bientôt et ne s'est pas engagé sur le moment. Moonshot a annoncé que les poids complets de Kimi K3 arrivent le 27 juillet.
Pour un opérateur qui tient à pouvoir exécuter un modèle sur une infrastructure qu'il maîtrise, ces deux déclarations ne sont pas comparables. L'une est un plan avec une date que l'on inscrit dans un calendrier et sur laquelle on tient un fournisseur. L'autre est une intention. Si votre raison de suivre les modèles de frontière chinois est que les poids ouverts permettent d'héberger soi-même, d'inspecter et de partir, alors une publication sans date ne fait pas encore avancer cet objectif, quelle que soit la taille du nombre de paramètres qui l'accompagne.
À lire ensuite: Des tests indépendants classent Kimi K3 devant Fable 5 | Le plus gros modèle de Moonshot n'a pas de molette de réflexion



