Claude, 제타 하한을 67%로

이번 Claude 수학 뉴스는 AI가 세기의 난제를 단번에 풀었다는 이야기로 읽으면 안 된다.

Anthropic은 8월 10일 미공개 연구용 Claude에게 리만 가설을 진지하게 시도하게 한 자료를 공개했다. 가설 자체는 풀지 못했지만 관련 하한을 높였다고 밝혔다. 리만 제타 함수 영점 중 가설을 만족한다고 알려진 비율의 하한이 41.6%에서 67.2%로 이동했다.

경계부터 정리

리만 가설은 여전히 미해결이다. Claude의 결과는 임계선 위에 있다고 증명할 수 있는 영점 비율이라는 더 좁은 질문이다.

자료는 연구 글, Claude가 쓴 기술 논문, 전문가용 요약, 표준 검증기를 통과한 Lean 형식화로 구성된다. Anthropic은 사내 수학자 두 명이 검토했고 Brian Conrey와 Dan Goldston도 짧은 기간 안에 확인했다고 설명했다.

시작 문장은

“Take a real stab at the Riemann hypothesis.”

였다. Claude에게 정말로 리만 가설을 시도해 보라고 한 셈이다.

67.2%의 출처

41.6%는 기존 하한, 67.2%는 Claude가 제시한 새 하한, 1859년과 100만 달러 상금은 더 큰 미해결 문제의 배경이다.

작업 규모도 크다. Claude는 처음 650개 아이디어를 냈지만 실패했다. 이후 하루 반 동안 약 60개 Claude 서브 Agent를 조율하고, 2400개 shell 명령, 수백 개 Python 스크립트, 54편 arXiv 논문 검토를 수행했다. 출력은 3100만 token이었다.

수학자는 남아 있다

수학자의 역할은 사라지지 않았다. 모델은 탐색 공간을 넓혔고, 인간은 기존 연구와의 연결을 판단했으며, Lean은 일부 주장을 기계 검증 가능한 대상으로 바꿨다.

연구 Agent의 다음 시험

이제 독립적인 공개 검토, Lean 형식화 범위, 다른 문제에서의 재현성이 핵심 확인 지점이다.

출처: Anthropic Research, Claude 기술 논문, Lean 형식화 저장소, Clay Mathematics Institute, CocoLoop, 관련 arXiv 논문; 41.6% 및 67.2% 하한, 31 million output tokens, 650 ideas, 60 subagents, 2400 shell commands, 54 papers, Lean comparator 상태를 확인.