OpenAI의 새로운 중간 가격대 모델 GPT-6 Sol은 The Latent Score에서 25개 모델 중 7위를 기록하며 전작보다 3계단 높은 순위에 올랐다.

화요일, OpenAI는 출시했다 이달 초 Astra를 출시한 데 이어 차세대 모델의 저가형 라인업으로 GPT-6 Sol과 Luna를 선보였다. 회사는 두 신형 모델이 Astra와 유사한 방식으로 학습됐으며, 전문 업무, 사실성, 코딩, 컴퓨터 사용 및 정렬 분야에서 Astra의 발전된 기능을 이어받았다고 밝혔다.

OpenAI는 GPT-6 Sol이 더 높은 사용 한도와 낮은 비용을 제공하면서 "어려운 업무를 맡을 수 있다"고 밝혔다. Luna는 대량 작업에 가장 "효율적인" 모델이라고 설명했다. OpenAI는 Sol의 가격을 입력 토큰 100만 개당 2달러, 출력 토큰 100만 개당 10달러로 책정했으며, Luna에는 입력 토큰 100만 개당 0.10달러, 출력 토큰 100만 개당 0.50달러를 부과한다. 이는 GPT-5.6 프로모션 요금보다 50% 인하된 가격이다.

Frontier Model Releases per Month by Lab

Frontier Model Releases per Month by Lab

  • OpenAI
  • Google
  • Anthropic
  • xAI
  • Meta AI
  • NVIDIA
  • Z.ai
  • Other
SOURCE: Epoch AI — Frontier AI Models

The Latent Score

출시 직후 GPT-6 Sol은 25개 모델 중 The Latent Score에서 7위를 기록했다. The Latent의 AI 모델 평가 순위표인 The Latent Score는 공개된 추론 평가 환경과 동일한 가중치가 적용된 7개 영역에서 입증된 성능을 종합한다. GPT-6 Sol의 종합 점수는 117.5점으로, 10위인 GPT-5.6 Sol의 111.9점보다 5.6점 높다.

GPT-6 Sol은 "지식 및 추론"과 "에이전트형 도구 및 컴퓨터 사용"에서 가장 강점을 보였으며, 후자에서는 전체 모델 중 6위를 기록했다. "멀티모달 및 비전"에서는 7위로 5.6 모델보다 한 계단 낮았고, "코딩 및 소프트웨어 엔지니어링"에서는 8위에 올랐다.

전문 및 실제 업무, 사이버보안, 선호도 및 커뮤니케이션 등 나머지 3개 영역의 점수는 아직 공개되지 않았다. 추가 검토 결과가 나오면 초기 점수는 변동될 수 있다.

한편 GPT-6 Luna는 18위를 기록해 이전 5.6 모델보다 13계단 상승했다.

OpenAI의 해당 세대 플래그십 모델인 GPT-6 Astra는 현재 The Latent Score를 기준으로 두 번째로 우수한 AI 모델이다. 5점 앞선 Anthropic의 Opus 5.5에 이어 2위다. Astra가 Opus 5.5를 앞서는 분야는 지식 및 추론 한 곳뿐이다.