The Latent Score classe GPT-6 Sol 7e sur 25 modèles
The Latent Score lui attribue 117,5 points, contre 111,9 à GPT-5.6 Sol
The Latent Score indique que trois domaines n'ont pas encore de score pour Sol
The Latent Score classe GPT-6 Luna 18e, soit 13 places de mieux que GPT-5.6 Luna
The Latent Score classe GPT-6 Astra 2e, derrière Opus 5.5 avec cinq points d'écart
GPT-6 Sol, le nouveau modèle de milieu de gamme d'OpenAI, s'est classé septième sur 25 modèles dans The Latent Score, soit trois places de mieux que son prédécesseur.
Mardi, OpenAI a lancé GPT-6 Sol et Luna comme déclinaisons moins chères de la génération qui a suivi le lancement d'Astra au début du mois. L'entreprise a déclaré que les deux nouveaux modèles avaient été entraînés selon des méthodes similaires à celles d'Astra et qu'ils héritaient de ses avancées en matière de travail professionnel, de factualité, de programmation, d'utilisation d'ordinateurs et d'alignement.
OpenAI a déclaré que GPT-6 Sol pouvait « s'attaquer à des tâches professionnelles difficiles » tout en offrant des limites d'utilisation plus élevées et un coût inférieur, tandis que Luna est le modèle le plus « efficace » pour les tâches à gros volume. OpenAI a fixé le prix de Sol à $2 par million de tokens d'entrée et $10 par million de tokens de sortie, et celui de Luna à $0.10 pour les entrées et $0.50 pour les sorties. Cela représente une réduction de 50 % par rapport aux tarifs promotionnels de GPT-5.6.
À sa sortie, GPT-6 Sol s'est classé septième sur 25 modèles dans The Latent Score, le classement des modèles d'IA de The Latent, qui synthétise les capacités démontrées dans des contextes de raisonnement publiés et sept domaines pondérés de manière égale. Au total, GPT-6 Sol obtient un score de 117.5, soit une hausse de 5.6 points par rapport à GPT-5.6 Sol, qui occupe la 10e place avec 111.9.
Les points forts de GPT-6 Sol résident dans les domaines des « connaissances et du raisonnement », ainsi que des « outils agentiques et de l'utilisation d'ordinateurs », où le modèle s'est classé sixième parmi tous les modèles. Il s'est classé septième en « multimodalité et vision », une place derrière son modèle 5.6, et huitième en « programmation et ingénierie logicielle ».
Les scores ne sont pas encore disponibles pour trois autres domaines : le travail professionnel et réel, la cybersécurité, ainsi que les préférences et la communication. Les scores préliminaires peuvent évoluer à mesure que davantage d'éléments évalués sont disponibles.
Pendant ce temps, GPT-6 Luna s'est classé 18e, soit une progression de 13 points par rapport à son précédent modèle 5.6.
GPT-6 Astra, le modèle phare de la génération d'OpenAI, est actuellement le deuxième meilleur modèle d'IA selon The Latent Score, seulement devancé par Opus 5.5 d'Anthropic, avec cinq points d'écart. Astra ne dépasse Opus 5.5 que dans un seul domaine : les connaissances et le raisonnement.
The Latent est un média d'information qui ambitionne d'être la première et la dernière référence en matière d'actualités, de recherche et de données sur l'IA.