IA

Claude Opus 5 coûte moitié moins que Fable 5 et atteint 99,5% en code

Adrian Kessler

Claude Opus 5 repère ses propres erreurs, réécrit ses réponses quand elles sont insuffisantes et exécute des tâches scientifiques et de codage en plusieurs étapes du début à la fin — pour moitié prix par rapport à Fable 5, le modèle le plus puissant d’Anthropic. Sur les benchmarks de codage, Opus 5 performe à moins de 0,5% près de Fable 5 ; sur les tests d’utilisation informatique OSWorld 2.0, il surpasse même le modèle phare pour un tiers du coût.

Ce qui rend Opus 5 structurellement différent de ses prédécesseurs, c’est un réglage d’effort : un niveau faible, moyen ou élevé attaché à chaque requête API. Une équipe juridique effectuant une revue documentaire de routine peut fonctionner en mode faible ; un workflow d’ingénierie logicielle déboguant un système distribué complexe peut passer en mode élevé. Le modèle ajuste la puissance de calcul qu’il consacre à la tâche, et donc ce que l’utilisateur paie, sans changer le modèle lui-même.

Le tarif est de 5 dollars par million de tokens d’entrée et 25 dollars par million de tokens de sortie, soit le même prix qu’Opus 4.8, le prédécesseur direct d’Opus 5. Fable 5, le modèle phare d’Anthropic, coûte environ deux fois plus cher. Opus 5 est désormais le modèle par défaut des abonnements Claude Max et disponible via le point d’accès API claude-opus-5. Un mode rapide offre une vitesse d’inférence 2,5 fois supérieure pour un prix de token de base deux fois plus élevé, destiné aux pipelines en temps réel où la latence prime sur le coût.

Les limites sont réelles et Anthropic les expose clairement. Opus 5 reste derrière Mythos 5, le modèle de sécurité spécialisé de l’entreprise, sur les tâches de cybersécurité, et n’affiche aucun progrès en biologie à double usage, qu’Anthropic a défini comme un plafond strict pour des raisons de sécurité. Pour les projets de recherche biologique autonomes s’étalant sur plusieurs mois, Fable 5 reste la recommandation. L’écart de 0,5% en codage pourrait se creuser en pratique pour des problèmes complexes et ouverts qui sortent des benchmarks.

Cette sortie intervient dans un contexte de lancements en rafale dans toute l’industrie. OpenAI a lancé GPT-5.6 en trois niveaux le 9 juillet ; Google a publié Gemini 3.6 Flash le 21 juillet, réduisant de 17% le coût des tokens de sortie. Chaque vague relève le niveau de référence tout en comprimant le temps dont disposent les entreprises pour évaluer et déployer ce qui a précédé.

Opus 5 est disponible dès aujourd’hui via l’API Claude, Claude.ai, Claude Code et Claude Cowork, au tarif de 5 dollars par million de tokens d’entrée et 25 dollars par million de tokens de sortie. Anthropic indique que le réglage d’effort est disponible immédiatement pour tous les utilisateurs de l’API et les abonnés Claude Max.

Opus 5 est le quatrième modèle lancé par Anthropic en soixante jours. La vitesse à laquelle la frontière coût-performance évolue crée désormais un problème différent pour les acheteurs en entreprise : savoir quand arrêter d’évaluer et enfin déployer quelque chose.

Étiquettes: , , , , ,

Discussion

Il y a 0 commentaire.