GPT-6 Sol, le nouveau modèle de milieu de gamme d'OpenAI, s'est classé septième sur 25 modèles dans The Latent Score, soit trois places de mieux que son prédécesseur.

Mardi, OpenAI a lancé GPT-6 Sol et Luna comme déclinaisons moins chères de la génération qui a suivi le lancement d'Astra au début du mois. L'entreprise a déclaré que les deux nouveaux modèles avaient été entraînés selon des méthodes similaires à celles d'Astra et qu'ils héritaient de ses avancées en matière de travail professionnel, de factualité, de programmation, d'utilisation d'ordinateurs et d'alignement.

OpenAI a déclaré que GPT-6 Sol pouvait « s'attaquer à des tâches professionnelles difficiles » tout en offrant des limites d'utilisation plus élevées et un coût inférieur, tandis que Luna est le modèle le plus « efficace » pour les tâches à gros volume. OpenAI a fixé le prix de Sol à $2 par million de tokens d'entrée et $10 par million de tokens de sortie, et celui de Luna à $0.10 pour les entrées et $0.50 pour les sorties. Cela représente une réduction de 50 % par rapport aux tarifs promotionnels de GPT-5.6.

Frontier Model Releases per Month by Lab

Frontier Model Releases per Month by Lab

  • OpenAI
  • Google
  • Anthropic
  • xAI
  • Meta AI
  • NVIDIA
  • Z.ai
  • Other
SOURCE: Epoch AI — Frontier AI Models

The Latent Score

À sa sortie, GPT-6 Sol s'est classé septième sur 25 modèles dans The Latent Score, le classement des modèles d'IA de The Latent, qui synthétise les capacités démontrées dans des contextes de raisonnement publiés et sept domaines pondérés de manière égale. Au total, GPT-6 Sol obtient un score de 117.5, soit une hausse de 5.6 points par rapport à GPT-5.6 Sol, qui occupe la 10e place avec 111.9.

Les points forts de GPT-6 Sol résident dans les domaines des « connaissances et du raisonnement », ainsi que des « outils agentiques et de l'utilisation d'ordinateurs », où le modèle s'est classé sixième parmi tous les modèles. Il s'est classé septième en « multimodalité et vision », une place derrière son modèle 5.6, et huitième en « programmation et ingénierie logicielle ».

Les scores ne sont pas encore disponibles pour trois autres domaines : le travail professionnel et réel, la cybersécurité, ainsi que les préférences et la communication. Les scores préliminaires peuvent évoluer à mesure que davantage d'éléments évalués sont disponibles.

Pendant ce temps, GPT-6 Luna s'est classé 18e, soit une progression de 13 points par rapport à son précédent modèle 5.6.

GPT-6 Astra, le modèle phare de la génération d'OpenAI, est actuellement le deuxième meilleur modèle d'IA selon The Latent Score, seulement devancé par Opus 5.5 d'Anthropic, avec cinq points d'écart. Astra ne dépasse Opus 5.5 que dans un seul domaine : les connaissances et le raisonnement.