IA

Claude Opus 5.5 : 40 % moins cher, alors qu’Anthropic appelle à la prudence

Susan Hill
Ajoutez-nous sur Google

Claude Opus 5.5 fait ce que les modèles précédents d’Anthropic n’avaient pas fait : il coûte moins cher et fonctionne plus vite tout en égalant ou surpassant un système plus gros et plus onéreux. Le modèle gère le codage agentique, l’utilisation d’ordinateur, la lecture de graphiques et le raisonnement multidisciplinaire à des niveaux qui, selon les données d’Anthropic, dépassent sur plusieurs mesures ceux de Claude Fable 5.1, le modèle le plus performant de la société jusqu’alors. Pour les particuliers et les développeurs qui trouvaient Opus 5 utile mais cher, l’écart entre ce que le modèle peut faire et ce qu’il coûte s’est nettement réduit.

La différence de prix est précise. Opus 5.5 facture 4 $ par million de tokens en entrée et 20 $ par million de tokens en sortie ; Opus 5 coûtait respectivement 5 $ et 25 $. Les lectures en cache passent de 0,50 $ à 0,20 $ par million de tokens. Anthropic indique que les charges de travail typiques sont environ 40 % moins chères dans l’ensemble. La vitesse suit la même tendance : le modèle standard génère du texte plus de 30 % plus vite qu’Opus 5. Une option séparée en mode rapide, facturée 8 $ en entrée et 40 $ en sortie par million de tokens, atteint jusqu’à 2,5 fois la vitesse d’Opus 5 standard – un réglage utile pour les applications sensibles à la latence.

Les performances publiées par Anthropic placent Opus 5.5 devant Fable 5.1, Opus 5 et GPT-6 Astra sur quatre des six benchmarks. Sur Terminal-Bench 4.0, qui teste l’exécution de code dans un environnement terminal en direct, Opus 5.5 obtient 66,4 % contre 55,8 % pour Fable 5.1. Sur Humanity’s Last Exam, un test couvrant les connaissances académiques et professionnelles dans plusieurs disciplines, le résultat est de 67,7 % contre 65,6 %. OSWorld 2.0, qui mesure la manipulation d’interfaces informatiques, affiche 81,8 % contre 80,7 %. Un test Deloitte a montré qu’Opus 5.5, à son réglage d’effort le plus bas, détectait 72 % des erreurs de codage connues lors d’une révision, contre 56 % pour Opus 5 à effort élevé. Ces chiffres proviennent d’Anthropic et de ses partenaires sélectionnés ; les marges d’erreur annoncées vont de ±1,6 à ±5 points de pourcentage, et aucune vérification indépendante par un tiers n’a été publiée au lancement.

Deux domaines rompent la tendance. Sur AutomationBench, GPT-6 Astra score 41,4 % contre 40,0 % pour Opus 5.5. Sur Terminal-Bench-Science, l’écart est plus large : Astra atteint 64,6 % tandis qu’Opus 5.5 se situe à 58,7 %. Les deux différences se situent dans les marges d’erreur annoncées – il peut s’agir de bruit – mais ce n’est pas forcément le cas. Anthropic inclut ces lignes dans son propre tableau publié, ce qui est plus que ce que la plupart des entreprises d’IA font au lancement. Les chiffres ont encore besoin d’un examen indépendant avant de pouvoir être considérés comme définitifs.

Sur la sécurité, Anthropic affirme qu’Opus 5.5 a été évalué avant sa sortie par des équipes externes, dont METR. Dans son propre audit comportemental interne, près de 2 000 scénarios conçus pour tester si le modèle tente de contourner les contraintes qui lui sont imposées, Opus 5.5 est décrit comme 85 % moins susceptible qu’Opus 5 de tenter un tel contournement. Les modèles plus forts ont tendance à être plus capables de trouver des solutions de contournement, ce qui rend l’amélioration significative si elle se confirme. L’expérience de déploiement sera le véritable test.

Ce qui rend ce lancement inhabituel, c’est son timing. Plus tôt ce mois-ci, le PDG d’Anthropic, Dario Amodei, a publié un essai dans lequel il écrivait qu’il était devenu convaincu que répondre pleinement aux risques de l’IA exigeait « d’ajuster le rythme de l’avancement des capacités pour que la prévention des risques ait le temps de suivre ». Sam Altman d’OpenAI et Elon Musk ont exprimé leur accord avec cette préoccupation générale. Jensen Huang de Nvidia a déclaré que la science sous-jacente ne la soutenait pas. Et puis Anthropic a livré un modèle plus rapide, moins cher et plus performant que son prédécesseur. Une lecture : un modèle avec de meilleures évaluations de sécurité et un accès plus large est précisément ce qu’Amodei avait en tête. Une autre : l’essai désignait l’avancement des capacités comme la préoccupation, et les capacités ont avancé. Les deux lectures reposent sur le même ensemble de faits, et les benchmarks d’Anthropic seuls ne peuvent pas trancher.

Claude Opus 5.5 est disponible depuis le 22 septembre 2026 sous l’ID de modèle API claude-opus-5-5. Il fonctionne dans Claude sur les formules Pro, Max, Team et Enterprise, et est accessible via AWS, Google Cloud et Microsoft Azure. Anthropic augmente les limites d’utilisation sur les abonnements de cinq heures. Sonnet 5.5 et Haiku 5.5, les autres membres de la famille 5.5, doivent suivre dans les semaines à venir, sans prix ni date de sortie spécifique annoncés pour l’un ou l’autre.

Étiquettes: , , , , ,

Ajoutez-nous sur Google

Discussion

Il y a 0 commentaire.