IA

Le modèle IA d’Alibaba coûte 2 $ par million de tokens — les poids ouverts arrivent le 10 août

Adrian Kessler

Un modèle d’IA de 2,4 billions de paramètres vient d’arriver sur le marché à 2 dollars le million de tokens en entrée et 6 dollars en sortie. Il repose sur une architecture de mélange d’experts éparse qui réduit les coûts par token en n’activant que 95 milliards de paramètres à la fois, le reste restant inactif. Ce modèle, c’est le Qwen 3.8 Max, et il est signé Alibaba.

L’écart de prix avec les meilleurs modèles américains est saisissant. Le Qwen 3.8 Max affiche des résultats compétitifs sur plusieurs benchmarks standards : 93,0 sur PaperBench et 86,1 sur OSWorld-Verified, ce qui le place au-dessus de Fable 5 et GPT-5.6 Sol sur ces mesures spécifiques. Sa fenêtre de contexte s’étend à un million de tokens — soit environ un million de mots en une seule requête — ce qui couvre l’analyse de documents longs, les grandes bases de code et les chaînes de raisonnement étendues. Le modèle est également multimodal, acceptant images et vidéos en plus du texte, à un niveau de prix qui n’était réservé qu’aux modèles propriétaires il y a un an.

Le développement le plus conséquent pourrait être ce qu’Alibaba a promis pour la semaine prochaine. L’entreprise affirme qu’elle rendra publics les poids du modèle, ce qui signifie que toute équipe disposant d’une infrastructure de calcul suffisante pourra exécuter Qwen 3.8 Max localement, sans frais d’API, sans envoyer de données vers un serveur Alibaba et sans accord d’utilisation. Cet engagement, s’il est tenu dans les délais, mettrait pour la première fois un modèle de 2,4 billions de paramètres entre les mains des auto-hébergeurs. Alibaba publie également un checkpoint plus petit de 27 milliards de paramètres pour les organisations disposant de capacités de calcul plus limitées.

Les réserves sont réelles. Sur le leaderboard Chatbot Arena, axé sur le texte, Qwen 3.8 Max se classe cinquième — derrière quatre modèles de la gamme actuelle d’Anthropic. Sur SWE-bench Pro, l’évaluation des agents de codage la plus importante pour les équipes d’IA en entreprise, il obtient 67,7 contre 80,0 pour Fable 5. La sortie des poids ouverts est promise pour la semaine du 10 août, mais à la date de publication, aucun poids n’est apparu sur Hugging Face ou ModelScope. Pour les organisations soumises aux exigences de résidence des données de l’UE ou aux règles de contrôle des exportations américaines, Qwen 3.8 Max soulève les mêmes questions de juridiction que les autres modèles des laboratoires chinois.

La fenêtre du 10 août pour la sortie des poids publics est le premier point de contrôle crucial. Si Alibaba tient parole, la structure de coûts de l’inférence d’IA de pointe chute considérablement pour toute équipe prête à gérer sa propre infrastructure. Si la sortie est retardée ou assortie de restrictions, le prix de 2 dollars via l’API en fait toujours l’un des modèles de pointe les plus agressivement tarifés actuellement disponibles.

Étiquettes: , , , ,

Discussion

Il y a 0 commentaire.