오픈AI는 토요일 수학과 이론 컴퓨터과학의 10개 문제에 대한 해법을 제시한 논문을 발표했으며, 그 공로를 어떤 사람에게도 아닌 내부 버전 Astra에 돌렸다. 이 모델은 아직 공개되지 않았다. 그보다 몇 시간 앞서 10개 중 하나인 군론 구성물이 X에 유출됐다.

반복해서 언급될 숫자는 2,000달러다. OpenAI는 10개 해법을 모두 찾는 데 사용된 토큰 비용이 자사 현재 플래그십인 GPT-5.6 Sol의 API 요율 기준으로 이 정도일 것이라고 추산한다. 목록에 오른 모든 문제는 핵심 결과에서 최소 10년간 진전이 없었고, 대부분은 그보다 훨씬 더 오래됐다.

유출이 먼저였다. 군론 장의 스크린샷이 밤사이 "Nonsofic Groups Exist"라는 제목으로 퍼졌고, Epoch AI의 수석 수학자인 Elliot Glazer는 그 페이지들이 진짜라고 답했다 그리고 이 작업을 지금까지 나온 수학 AI 결과 중 가장 중요한 것이라고 평가했다. 전체 출판물은 같은 날 아침 뒤따랐다.

이번 발표에서 가장 중대한 문장은 어떤 정리에 대한 것이 아니다. OpenAI는 "AI 시스템이 전적으로 생성한 증명에 대해 인간 저자성을 주장하는 것은 그 시스템의 기여와 진정한 인간 지적 작업의 성격을 모두 왜곡하게 된다"고 썼다. 지금까지 AI 보조 수학 논문은 모델을 감사의 말에 넣고 인간 이름으로 발표돼 왔다. OpenAI의 입장은 자사 직원들이 원고를 준비하고 정확성에 대한 책임은 지지만, 논증 자체는 기계의 것이라는 것이다.

10개 결과가 다루는 내용

군론 항목은 유출된 그 내용이며, Benjamin Weiss가 2000년에 그 성질을 '소픽'이라고 이름 붙인 이후 열려 있던 질문을 닫는다. 군은 루빅 큐브의 회전처럼, 움직임들의 집합과 그것들을 결합하는 규칙으로 이뤄진다. 소픽이라는 것은 결합표의 어떤 유한한 조각이든 원하는 정확도로 유한한 카드 덱을 섞는 방식으로 모방될 수 있다는 뜻이다. 지금까지 시험된 모든 군은 이를 만족했고, 토요일 전까지는 반례가 알려져 있지 않았다.

나머지는 군론을 훨씬 넘어선다. 구 채우기 장은 고차원 공간에서 공들이 얼마나 촘촘하게 공간을 채울 수 있는지에 대한 일반적 상한을 1978년 이후 처음으로 개선했다고 주장한다. 또 다른 장은 연산자 대수에서 코네스의 강직성 추측을 반박한다. 하나는 에르되시 문제 183을 해결한다. 또 하나는 양자내성 암호의 기반에 놓인 격자 문제인 최근접 벡터 문제에 대해 새로운 난해성 결과를 증명한다.

검증할 수 있는 것과 없는 것

7월과 달리 이번 작업은 이를 검증할 장치를 갖추고 나왔다. OpenAI는 원고들, 모델 추론에 대한 설명, 그리고 각 논증에 대한 Lean 인증서를 공개했다. Lean certificate는 컴퓨터가 모든 단계를 검증할 수 있도록 작성된 증명으로, 유명한 추측의 증명 주장들을 무너뜨리는 은밀한 공백을 배제한다. 다만 형식화된 진술이 수학자들이 관심을 두는 바로 그 추측임을 입증하지는 않으며, 동료 심사도 아니다.

7월의 선례는 기억해둘 가치가 있다. OpenAI는 7월 10일 Cycle Double Cover Conjecture의 증명을 GPT-5.6 Sol Ultra의 공로로 돌렸고, Jim Geelen과 Sang-il Oum은 각각 그 논증에 대한 해설을 정리해 발표했다 . Wolfram MathWorld에 따르면 그 주장은 월말까지도 심사를 거친 출판물에 도달하지 못했다. 검증은 뉴스 사이클이 아니라 수개월 단위로 진행된다.

이런 일에서 OpenAI만 있는 것도 아니다. Anthropic의 Claude Fable 5와 함께 발견된 한 반례는 87년 된 3변수 Jacobian 추측을 끝냈고, Terence Tao는 이를 공개적으로 검토했다 7월 21일에.

OpenAI가 경쟁사들에 없는 것을 갖고 있다면, 그것은 회사 밖 누구도 시험할 수 없는 모델이다. Sam Altman은 이번 주 워싱턴에서 아스트라 제품군을 미리 소개했다 . 그곳에서 Astra는 단일 응답이 아니라 수시간 또는 수일, 그리고 다중 에이전트에 걸쳐 실행되는 작업용으로 제시됐다. 출시일도, 벤치마크 점수도, 가격도 없고, 이름조차 확정되지 않았으며, 2,000달러라는 수치도 다른 모델의 요율을 기준으로 한 추정치다.

OpenAI에서 AI를 연구하는 Sébastien Bubeck은 이번 공개를 기념하며 이렇게 적었다 . 그는 AI가 2030년쯤 자신을 수학에서 앞지를 것이라 예상했지만 실제로는 2026년에 그렇게 됐다고 했다. 회사가 자체 보고한 수치는 이전에도, 예를 들어 자체 보고한 38.3% ARC-AGI-3 결과처럼, 추가 해석이 필요했다. 하지만 이번에는 증명, Lean 파일, 그리고 추론 추적을 내놓았다. 다음 차례는 수학자들의 몫이다.