인터넷은 지금 그 수학을 교체하는 한가운데 있다. 대형 양자 컴퓨터가 등장할 경우 현재 은행 서비스, 소프트웨어 업데이트, 암호화된 트래픽을 보호하는 대부분의 암호체계가 무력화될 수 있기 때문에, 미국 국립표준기술연구소(NIST)는 이를 대체할 기술을 선정하기 위해 거의 10년에 걸쳐 공개 경쟁을 진행해 왔다.
그 경쟁 중 하나는 아직 진행 중이다. 5월 14일, NIST는 9개 알고리즘을 진전시켰다 새로운 디지털 서명 체계를 위한 3차 검토 단계로 올렸다. 디지털 서명은 메시지, 결제, 또는 소프트웨어 업데이트가 실제로 주장된 발신자로부터 왔음을 증명하는 수학적 메커니즘이다. 살아남은 9개 알고리즘의 팀들은 8월 14일까지 설계에 대한 최종 변경 사항을 제출해야 한다.
그 마감 시한 때문에 화요일 발표는 일반적인 AI 연구 보도자료와는 다르게 다가온다.
7월 28일, Anthropic은 두 편의 논문을 발표했다 회사가 공개적으로 판매하지 않는 최전선 모델 Claude Mythos Preview가 두 개의 암호 알고리즘에 대한 새로운 수학적 공격을 찾아냈다고 주장하는 내용이다. 그중 하나가 HAWK이며, HAWK는 그 9개 중 하나다.
회사가 강조하는 이 구분이 핵심이다. 지금까지 Claude의 보안 작업은 구현 버그, 즉 프로그래머가 알고리즘을 작동하는 코드로 옮기는 과정에서 만든 실수를 찾아내는 것이었다. 그런 사례는 주요 소프트웨어 전반, 암호 라이브러리를 포함해 수천 건 발견돼 왔다. 이는 비뚤게 설치된 튼튼한 자물쇠와 같다. 이번에 Anthropic이 주장하는 것은 Claude가 "알고리즘 자체의 수학적 결함을 찾아낼 수 있다"는 점이다. 자물쇠 설계가 잘못된 것이며, 아무리 신중히 설치해도 소용이 없다는 뜻이다.
HAWK가 무엇이며, 이 공격이 하는 일
HAWK는 수백 차원의 점 격자를 다루는 기하학의 한 분야인 격자(lattice) 기반으로 구축된 유일한 남은 후보이다. 그 매력은 실용성에 있었다. 가장 낮은 보안 수준에서 서명 크기는 555바이트로, NIST가 이미 승인한 표준보다 더 작고, 설계상 경쟁 체계들이 잘못 구현되기 쉽게 만드는 까다로운 십진 연산을 피한다.
이 공격은 HAWK의 격자에 숨겨진 대칭성을 찾아내는 방식으로 작동한다. 지난해 발표된 학술 연구는 그런 대칭성이 존재할 경우 키 복구 문제를 대략 절반으로 줄일 수 있음을 증명했지만, 아무도 그것을 찾아내지 못했다. 모델은 찾아냈다.
HAWK-256의 경우, 이는 HAWK 설계자들이 공격자들의 목표물로 제시한 의도적으로 축소된 구성인데, 비밀 키 탈취 비용이 약 180경 번의 연산에서 약 2,750억 번으로 떨어진다. Anthropic은 단일 96코어 서버에서 4시간 이내에 이러한 키를 종단간으로 복구하는 코드를 공개했다.
NIST가 실제로 평가하는 두 구성인 HAWK-512와 HAWK-1024는 깨지지 않았다. 이들에 대한 추정 공격 비용도 낮아지지만, 둘 다 여전히 현실적으로 구축 가능한 범위를 훨씬 벗어난다. 원래의 보안 여유를 회복하려면 키 크기를 두 배로 늘려야 하는데, 그렇게 되면 HAWK를 선택할 가치가 있었던 대부분의 장점도 사라지게 된다.
이 결과가 보여주지 않는 것
모델이 그 작업을 해냈다는 주장은 여기서 상당한 무게를 떠받치고 있다. Anthropic 자체 표현은 "대체로 자율적으로"였고, 이 모델은 이전 연구에서 이미 정확히 이런 종류의 대칭성에 취약할 가능성이 있다고 지목된 체계를 대상으로 삼았다. 그 이전 논문의 저자 중 한 명은 HAWK의 설계자이기도 하다.
검증은 여전히 인간의 일이며, 비용도 많이 든다. Anthropic은 결과 하나당 컴퓨팅 비용을 약 10만 달러로, HAWK의 경우 60시간으로 제시했다. 이후 연구진은 두 번째 결과를 확인하는 데 수백 시간을 더 들였고, 그중 두 명은 확신에 이르기까지 거의 한 달이 걸렸다.
외부 검증은 시작됐지만 아직 충분하지 않다. Anthropic은 이 공격을 NIST의 공개 메일링 리스트에 게시했고, 그곳에서 암호학자 Daniel Apon은 자신이 독립적으로 검토한 결과 수학적으로 타당하다고 답했다. 그 외에는, 해커 뉴스는 보도했다 키 복구에 대한 독립적 재현 사례를 찾지 못했으며, NIST도 HAWK의 지위가 바뀌는지 여부를 밝히지 않았다고.
두 번째 발견은 헤드라인이 시사하는 것보다 약하다. 이는 대부분의 암호화 트래픽을 보호하는 암호 AES에 대한 공격을 200배에서 800배까지 가속하지만, 전체 10라운드 암호가 아니라 단순화된 7라운드 연구용 버전을 겨냥한다. 또한 공격자가 동일한 키로 암호화된 약 400옥틸리언 개의 메시지를 확보할 수 있다고 가정한다. Anthropic은 전체 공격을 실행하지 않았다. 구성 요소를 측정하고 나머지는 추정했다.
Anthropic은 또한 이 모델이 처음에는 AES 문제를 거부하며, 대상이 너무 잘 연구돼 있어 개선의 여지가 없다고 주장했다고 밝혔다. 연구진은 계속 진행하도록 유도하는 오탈자 가득한 자체 프롬프트를 공개했다.
경쟁 구도를 감안하면 이는 겉보기만큼 이례적인 일은 아니다. Google은 Erdős 컬렉션의 공개 문제들에 Gemini를 투입해 왔고, Anthropic은 이달 공개 모델이 Jacobian Conjecture를 해결했다고 밝혔다. 암호학은 주장된 결과를 코드를 실행해 검증할 수 있는 분야일 뿐이다.
Mythos Preview는 구매할 수 없다. 이 모델은 Project Glasswing를 통해 조직들에 제공되며, 이는 Anthropic의 비공개 보안 프로그램이다.
이것을 수학 이야기가 아니라 투자 논지로 추적하는 사람에게 중요한 숫자는 6,700만이 아니다. 그것은 100,000달러이며, 그것이 계속 하락하는지 여부다.
