Modèle
GPT-6 Sol évalué sur le seul benchmark du hub
Sorti le 22 septembre 2026, GPT-6 Sol (OpenAI) entre dans les classements du hub : son rang à l'indice métier, ses métiers forts et faibles, son coût et son taux d'hallucinations.
Compte rendu rédigé par le hub à partir des classements publiés : chaque phrase est calculée, aucune n'est une opinion.
- 20e sur 27 à l'indice métier, avec 98,5 % (marge d'erreur à 95 % : ± 1,7 point).
- 0,8 point d'indice de moins que GPT-6 Astra, son prédécesseur chez OpenAI, sorti le 4 septembre 2026. L'écart est inférieur à la marge d'erreur : les deux modèles ne sont pas départagés.
- Coût moyen par test : 0,018 $, le 20e moins cher des 27 modèles dont le tarif est connu.
- Taux d'hallucinations moyen : 0,0 %, la part des éléments absents de la source pour lesquels il a inventé une valeur.
- Il a passé le seul benchmark publié du hub.
Scores par métier
| Métier | Score |
|---|---|
| Finance | Non testé |
| Comptabilité | 98,5 % |
| Ressources humaines | Non testé |
| Juridique | Non testé |
| Commercial | Non testé |
| Marketing | Non testé |
| Service client | Non testé |
| Achats & logistique | Non testé |
| Informatique | Non testé |
| Direction | Non testé |
| Indice métier | 98,5 % |