OpenAIの新たな中価格モデルGPT-6 Solは、The Latent Scoreで25モデル中7位となり、前モデルから3つ順位を上げた。

火曜日、OpenAIはGPT-6 SolとLunaを発表した。今月初めにAstraを発表したのに続く世代の、より安価なモデルとして提供するものだ。同社によると、2つの新モデルはAstraと同様の手法で訓練され、専門業務、正確性、コーディング、コンピューター操作、アライメントにおける同モデルの進歩を受け継いでいる。

OpenAIによると、GPT-6 Solは「難しい業務に取り組む」ことができ、利用上限を引き上げながらコストを抑えている。一方、Lunaは大量処理向けに最も「効率的」なモデルだという。OpenAIはSolの価格を入力トークン100万個あたり$2、出力トークン100万個あたり$10とし、Lunaについては入力が$0.10、出力が$0.50。GPT-5.6のプロモーション価格から50%引き下げられた。

Frontier Model Releases per Month by Lab

Frontier Model Releases per Month by Lab

  • OpenAI
  • Google
  • Anthropic
  • xAI
  • Meta AI
  • NVIDIA
  • Z.ai
  • Other
SOURCE: Epoch AI — Frontier AI Models

The Latent Score

リリース時点で、GPT-6 SolはThe Latent Scoreで25モデル中7位となった。The Latent Scoreは、公開された推論設定と、同じ重み付けの7つの分野で実証された能力を集約する、The LatentのAIモデル評価ランキングだ。GPT-6 Solの総合スコアは117.5で、10位のGPT-5.6 Sol(111.9)から5.6ポイント上昇した。

GPT-6 Solの最大の強みは「知識と推論」、そして「エージェント型ツールとコンピューター操作」にあり、これらの分野では全モデル中6位となった。「マルチモーダルとビジョン」では7位で、5.6モデルの1つ後ろにつけた。また、「コーディングとソフトウェアエンジニアリング」では8位だった。

残る3分野――専門業務と現実世界の仕事、サイバーセキュリティ、選好とコミュニケーション――のスコアはまだ発表されていない。レビュー済みの証拠が増えるにつれて、初期スコアは変動する可能性がある。

一方、GPT-6 Lunaは18位となり、従来の5.6モデルから13ポイント上昇した。

OpenAIの同世代におけるフラッグシップモデルGPT-6 Astraは現在、The Latent Scoreに基づくAIモデルランキングで2位につけており、1位のAnthropicのOpus 5.5とは5ポイント差だ。AstraがOpus 5.5を上回るのは、「知識と推論」の1分野だけである。