Aller au contenu
WorkBench.ai

Modèle

GPT-6 Sol évalué sur le seul benchmark du hub

Sorti le 22 septembre 2026, GPT-6 Sol (OpenAI) entre dans les classements du hub : son rang à l'indice métier, ses métiers forts et faibles, son coût et son taux d'hallucinations.

Compte rendu rédigé par le hub à partir des classements publiés : chaque phrase est calculée, aucune n'est une opinion.

  • 20e sur 27 à l'indice métier, avec 98,5 % (marge d'erreur à 95 % : ± 1,7 point).
  • 0,8 point d'indice de moins que GPT-6 Astra, son prédécesseur chez OpenAI, sorti le 4 septembre 2026. L'écart est inférieur à la marge d'erreur : les deux modèles ne sont pas départagés.
  • Coût moyen par test : 0,018 $, le 20e moins cher des 27 modèles dont le tarif est connu.
  • Taux d'hallucinations moyen : 0,0 %, la part des éléments absents de la source pour lesquels il a inventé une valeur.
  • Il a passé le seul benchmark publié du hub.

Scores par métier

Exactitude moyenne du modèle sur les benchmarks de chaque métier qu'il a passés.

MétierScore
FinanceNon testé
Comptabilité98,5 %
Ressources humainesNon testé
JuridiqueNon testé
CommercialNon testé
MarketingNon testé
Service clientNon testé
Achats & logistiqueNon testé
InformatiqueNon testé
DirectionNon testé
Indice métier98,5 %