Claude sube un límite zeta al 67%

La nueva historia matemática de Claude no debe leerse como una IA resolviendo un problema centenario de golpe.

El 10 de agosto, Anthropic publicó materiales sobre una versión de investigación no lanzada de Claude a la que se le pidió intentar seriamente la hipótesis de Riemann. No la resolvió, pero la compañía dice que mejoró un resultado relacionado: el límite inferior de la proporción de ceros de la función zeta de Riemann que satisfacen la hipótesis pasó del 41,6% al 67,2%.

Primero, el límite

La hipótesis de Riemann sigue abierta. El resultado de Claude trata una pregunta más estrecha: qué fracción mínima de ceros puede probarse en la línea crítica.

El paquete incluye página de investigación, artículo técnico escrito por Claude, nota para expertos y formalización en Lean que pasa un verificador estándar. Anthropic dice que dos matemáticos internos validaron el trabajo y que Brian Conrey y Dan Goldston lo revisaron en poco tiempo.

El prompt inicial fue:

“Take a real stab at the Riemann hypothesis.”

En términos simples, se pidió a Claude que lo intentara de verdad.

De dónde sale el 67,2%

El 41,6% es el límite anterior, el 67,2% es el nuevo límite de Claude, y 1859 junto con el premio de un millón de dólares describen el problema mayor.

El proceso también importa. Claude probó primero 650 ideas sin éxito. Luego pasó día y medio coordinando unos 60 subagentes, ejecutó 2.400 comandos shell, escribió cientos de scripts Python y descargó 54 artículos de arXiv. La ejecución consumió 31 millones de tokens de salida.

Los matemáticos siguen ahí

El papel humano no desaparece. El modelo amplía la búsqueda, los matemáticos juzgan la conexión con trabajos previos y Lean convierte parte del argumento en algo verificable por máquina.

La siguiente prueba

Ahora importan la revisión pública independiente, el alcance de la formalización Lean y si el flujo produce resultados en otros problemas.

Fuentes: Anthropic Research, artículo técnico de Claude, repositorio de formalización Lean, Clay Mathematics Institute, CocoLoop, artículos arXiv relacionados; verificación de los límites 41,6% y 67,2%, 31 million output tokens, 650 ideas, 60 subagents, 2400 shell commands, 54 papers y estado del Lean comparator.