Aller au contenu
WorkBench.ai

Modèle

Claude Opus 5.5 évalué sur le seul benchmark du hub

Sorti le 22 septembre 2026, Claude Opus 5.5 (Anthropic) entre dans les classements du hub : son rang à l'indice métier, ses métiers forts et faibles, son coût et son taux d'hallucinations.

Compte rendu rédigé par le hub à partir des classements publiés : chaque phrase est calculée, aucune n'est une opinion.

  • 17e sur 27 à l'indice métier, avec 99,3 % (marge d'erreur à 95 % : ± 1,2 point).
  • 0,8 point d'indice de plus que Claude Fable 5.1, son prédécesseur chez Anthropic, sorti le 1er septembre 2026. L'écart est inférieur à la marge d'erreur : les deux modèles ne sont pas départagés.
  • Coût moyen par test : 0,030 $, le 24e moins cher des 27 modèles dont le tarif est connu.
  • Taux d'hallucinations moyen : 0,0 %, la part des éléments absents de la source pour lesquels il a inventé une valeur.
  • Il a passé le seul benchmark publié du hub.

Scores par métier

Exactitude moyenne du modèle sur les benchmarks de chaque métier qu'il a passés.

MétierScore
FinanceNon testé
Comptabilité99,3 %
Ressources humainesNon testé
JuridiqueNon testé
CommercialNon testé
MarketingNon testé
Service clientNon testé
Achats & logistiqueNon testé
InformatiqueNon testé
DirectionNon testé
Indice métier99,3 %