Claude Opus 5 dépasse Fable 5 en termes de performances sur les benchmarks, pour un prix moitié moindre

BABA-1,64%
Key Takeaways
  • Anthropic a publié Claude Opus 5 le 24 juillet, au prix de 5 dollars par million de jetons d’entrée, soit la moitié du coût de Fable 5.
  • Opus 5 a obtenu 43,3 % sur Frontier-Bench v0.1, contre 33,7 % pour Fable 5 et 34,4 % pour GPT-5.6 Sol.
  • Opus 5 est devenu le mode par défaut sur Claude Max, remplaçant Fable 5 après ses perturbations opérationnelles.

Anthropic a libéré Claude Opus 5 le 24 juillet, au prix de 5 dollars pour un million de jetons d’entrée—soit la moitié du coût du modèle précédent Claude Fable 5—tout en surpassant Fable 5 sur la plupart des principaux benchmarks. Opus 5 a obtenu 43,3 % sur Frontier-Bench v0.1, une évaluation de codage agentique, contre 33,7 % pour Fable 5 et 34,4 % pour GPT-5.6 Sol d’OpenAI ; sur ARC-AGI-3, un benchmark inédit de résolution de problèmes, il a atteint 30,2 % contre 7,8 % pour GPT-5.6 Sol. Le nouveau modèle est devenu la configuration par défaut sur Claude Max et l’option la plus solide sur Claude Pro, remplaçant efficacement Fable 5 comme modèle de prédilection pour la plupart des abonnés à la suite des perturbations opérationnelles de Fable 5 plus tôt cet été.

La gamme d’Anthropic comprend quatre paliers : Haiku est rapide et économique, Sonnet se situe dans la moyenne, Opus est le gros moteur de travail, et la classe Mythos—introduite ce printemps—inclut Claude Fable 5 pour le grand public et Claude Mythos 5 pour des chercheurs en cybersécurité et des opérateurs d’infrastructures critiques pré-validés via Project Glasswing.

Claude Opus 5 surpasse Fable 5 sur les principaux benchmarks

Sur Frontier-Bench v0.1, qui teste si des agents de codage IA peuvent accomplir des tâches réelles d’ingénierie logicielle de bout en bout, Opus 5 a atteint 43,3 %. Fable 5 est arrivé à 33,7 % et GPT-5.6 Sol d’OpenAI a obtenu 34,4 %.

L’écart le plus large est apparu sur ARC-AGI-3, un test de résolution de problèmes fondé sur des énigmes inédites qu’un modèle ne pouvait pas avoir mémorisées à partir des données d’entraînement. Opus 5 a atteint 30,2 % ; GPT-5.6 Sol a obtenu 7,8 % ; Fable 5 n’a pas été testé du tout.

Sur GDPval-AA v2, un benchmark de travail de connaissance évalué via des cotes Elo utilisées pour mesurer les performances relatives sur des tâches professionnelles réelles, Opus 5 a atteint 1 861 contre 1 747 pour Fable 5 et 1 736 pour GPT-5.6 Sol.

Fable 5 a surpassé Opus 5 avec une petite marge uniquement dans des évaluations liées au droit et à la santé, d’après les benchmarks publiés par Anthropic.

Anthropic fixe le prix d’Opus 5 à 5 dollars par million de jetons d’entrée

Opus 5 est disponible via API à 5 dollars par million de jetons d’entrée et 25 dollars par million de jetons de sortie. Un mode Fast, qui tourne à environ 2,5 fois la vitesse par défaut, est proposé à deux fois le prix de base—10 dollars par million de jetons d’entrée et 50 dollars par million de jetons de sortie.

La tarification correspond à Opus 4,8 et est exactement la moitié du coût de Fable 5, qu’Anthropic avait positionné comme produit frontier du quotidien pour les utilisateurs payants.

Fable 5 retiré à l’échelle mondiale après une ordonnance de contrôle des exportations

Fable 5 a été lancé le 9 juin, retiré à l’échelle mondiale trois jours plus tard après que le gouvernement américain a publié une ordonnance d’exportation de contrôle d’urgence évoquant une vulnérabilité de jailbreak, puis a été remis en service le 30 juin. À son retour, il est passé immédiatement à un modèle ne proposant que des crédits, et n’était plus inclus dans les formules standard.

Opus 5 occupe désormais la place que Fable 5 n’a pas pu conserver en tant que modèle phare pour les abonnés.

Des plateformes tierces valident les gains de performance d’Opus 5

Lovable, une plateforme de développeurs comptant des millions d’utilisateurs, a fait tourner Opus 5 sur ses évaluations internes. « Ce n’est pas seulement mieux sur nos tâches de codage agentique les plus difficiles, avec 22 % de mieux que Opus 4.7, c’est aussi plus stable, avec beaucoup moins de variance d’une exécution à l’autre », a déclaré Fabian Hedin dans un communiqué partagé par Anthropic.

Zapier a testé Opus 5 sur AutomationBench, une évaluation qui mesure si un modèle peut gérer un flux de travail complet pour une entreprise, du début à la fin, sans aide humaine. Le modèle « a pris un classeur brut de santé de compte et a exécuté une séquence complète de prévention du churn de bout en bout : en identifiant les comptes à risque, en alertant le bon propriétaire et en résumant pour les opérations de rétention. Les modèles précédents n’ont pas réussi ; Opus 5 a atteint 100 %. »

Ultima Genomics, une société de séquençage ADN, a déclaré que le modèle « se comporte davantage comme un scientifique attentif que tout autre modèle que nous avons exécuté. Il va chercher les bons tests statistiques pour écarter les facteurs confondants, recoupe ses propres résultats par des méthodes indépendantes et reste sur la bonne trajectoire tout au long de longues analyses multi-étapes. »

Le lancement a eu lieu une semaine après Moonshot AI, une startup basée à Pékin soutenue par Alibaba, qui a dévoilé Kimi K3—un modèle open-weight à 2,8 billions de paramètres que Moonshot a décrit comme le plus grand système d’IA open au monde. Des benchmarks indépendants placent systématiquement Kimi K3 troisième au total, derrière à la fois Fable 5 et GPT-5.6 Sol, en les surpassant sur des domaines spécifiques.

FAQ

Quels benchmarks Claude Opus 5 a-t-il surpassé par rapport à Fable 5 ?

Claude Opus 5 a obtenu 43,3 % sur Frontier-Bench v0.1 contre 33,7 % pour Fable 5, 30,2 % sur ARC-AGI-3 (Fable 5 n’a pas été testé) et 1 861 sur GDPval-AA v2 contre 1 747 pour Fable 5. Fable 5 a surpassé Opus 5 avec une petite marge uniquement dans des évaluations liées au droit et à la santé.

Combien coûte Claude Opus 5 par rapport à Fable 5 ?

Claude Opus 5 coûte 5 dollars par million de jetons d’entrée et 25 dollars par million de jetons de sortie via API—exactement la moitié du coût implicite de Fable 5. Un mode Fast est disponible à 10 dollars par million de jetons d’entrée et 50 dollars par million de jetons de sortie.

Pourquoi Claude Fable 5 a-t-il été retiré de la disponibilité mondiale ?

Fable 5 a été lancé le 9 juin et a été retiré à l’échelle mondiale trois jours plus tard après que le gouvernement américain a publié une ordonnance d’exportation de contrôle d’urgence évoquant une vulnérabilité de jailbreak. Il est revenu le 30 juin sous forme d’un modèle ne proposant que des crédits et n’est plus inclus dans les formules standard.

Avertissement : Les informations figurant sur cette page peuvent provenir de sources tierces et sont fournies à titre indicatif uniquement. Elles ne reflètent pas les points de vue ou opinions de Gate et ne constituent pas un conseil financier, d’investissement ou juridique. Le trading des actifs virtuels comporte des risques élevés. Veuillez ne pas vous fonder uniquement sur les informations de cette page pour prendre vos décisions. Pour en savoir plus, consultez l’avertissement.
Commentaire
0/400
Aucun commentaire