Claude mejora el límite cero de la hipótesis de Riemann del 41,6% al 67,2%

✍️ OpenClawRadar📅 Publicado: 11 de agosto de 2026🔗 Source
Ad

La versión de investigación no publicada de Claude de Anthropic ha mejorado una cota inferior de larga data para la proporción de ceros de la función zeta de Riemann que se encuentran en la línea crítica (donde la hipótesis de Riemann predice que están todos los ceros). La cota salta del 41,6% al 67,2%, un salto que sorprendió a los investigadores. Aunque la IA no demostró la hipótesis de Riemann en sí, su resultado es un avance notable en la teoría analítica de números.

El avance

La idea clave de Claude fue combinar resultados de Baluyot, Goldston, Suriajaya y Turnage-Butterbaugh (trabajos que adaptan las técnicas de Montgomery de 1973 sin asumir la hipótesis de Riemann) con un artículo de 2000 de Bombieri. En términos simples, Claude construyó un espacio adecuado de funciones con una forma cuadrática inducida por Weil, y consideró subespacios definidos positivos y negativos correspondientes a ceros en y fuera de la línea. Al escribir una desigualdad sobre el rango de la forma cuadrática usando información de primer y segundo momento, logró la nueva cota.

Según la nota de Anthropic, el enfoque trata todo el espacio en conjunto, permitiendo que la forma cuadrática no sea diagonal, un paso que permite la conclusión a partir de trabajos previos. Dos matemáticos de Anthropic validaron el artículo y produjeron una nota informal para expertos, y los expertos externos Brian Conrey y Dan Goldston también lo revisaron con poca antelación.

Ad

Cómo trabajó Claude

El resultado provino de dos sesiones en Claude Code, usando un total de 31 millones de tokens de salida. Jarred Sumner, miembro del personal de Anthropic (y no matemático), incitó a Claude a "hacer un intento serio" con la hipótesis de Riemann en sí, dejando las elecciones matemáticas al modelo. Inicialmente, Claude generó 650 ideas que fracasaron, lo que provocó otra ejecución. En la segunda sesión, Claude coordinó alrededor de 60 subagentes durante un día y medio, ejecutando 2.400 comandos de shell y escribiendo cientos de scripts en Python. Los subagentes realizaron miles de comprobaciones numéricas contra los ceros conocidos de la función zeta y revisaron el trabajo de los demás.

Una prueba formalmente verificable

Cabe destacar que Claude también produjo una prueba formalmente verificable de su resultado, complementando la nota informal para expertos. Esto añade plausibilidad al hallazgo, aunque el equipo no espera que las técnicas resuelvan la hipótesis de Riemann en sí.

Para los desarrolladores que usan agentes de IA, este es un ejemplo concreto de hasta dónde ha llegado el razonamiento matemático, y de cómo un no matemático puede guiar a un agente para hacer una contribución de investigación genuina.

📖 Lee la fuente completa: HN AI Agents

Ad

👀 Ver también

Granite 4.1: El modelo denso de 8B de IBM iguala al MoE de 32B en pruebas
Noticias

Granite 4.1: El modelo denso de 8B de IBM iguala al MoE de 32B en pruebas

El modelo denso Granite 4.1 8B de IBM iguala o supera al anterior modelo MoE 32B en ArenaHard, BFCL V3, GSM8K y más, gracias a la mejora en la calidad de los datos de entrenamiento.

OpenClawRadar
La discusión en Reddit destaca los desafíos de depuración con código generado por IA.
Noticias

La discusión en Reddit destaca los desafíos de depuración con código generado por IA.

Un debate en Reddit en r/ClaudeAI detalla problemas específicos que enfrentan los desarrolladores con el código generado por IA, incluyendo vulnerabilidades de seguridad, alucinaciones lógicas y depuración que puede tomar más tiempo que escribir el código manualmente.

OpenClawRadar
Claude Code v2.1.133: reversión de worktree.baseRef, rutas de sandbox, corrección de proxy para MCP OAuth
Noticias

Claude Code v2.1.133: reversión de worktree.baseRef, rutas de sandbox, corrección de proxy para MCP OAuth

Anthropic lanza la v2.1.133 de Claude Code CLI con una nueva configuración worktree.baseRef que por defecto es fresh (rama desde origin/default), sandbox.bwrapPath y sandbox.socatPath para binarios personalizados de bubblewrap/socat, corrección de proxy/mTLS para el flujo OAuth de MCP, y varias correcciones de errores.

OpenClawRadar
Decaimiento de Restricciones: Por qué los Agentes LLM Fallan en Código de Backend Estructurado
Noticias

Decaimiento de Restricciones: Por qué los Agentes LLM Fallan en Código de Backend Estructurado

Una nueva investigación introduce la 'degradación por restricciones': a medida que se acumulan los requisitos estructurales, el rendimiento de los agentes LLM cae drásticamente — los agentes capaces pierden 30 puntos en tasas de aprobación de aserciones, los más débiles se acercan a cero. Perspectivas prácticas para cualquier persona que use agentes de IA para codificación.

OpenClawRadar