Claude no logra resolver la hipótesis de Riemann, pero su intento deja un resultado inesperado

Sumner pidió a una variante experimental que no se rindiera y la IA acabó mejorando un resultado derivado del 41,6% al 67,2%. El hallazgo, validado con Lean, no acerca la solución de la conjetura, pero confirma que estos modelos encuentran conexiones donde los humanos se atascan.

Anthropic metió a Claude en el problema matemático más famoso del planeta y salió con un avance real. No resolvió la hipótesis de Riemann, pero el intento dejó un resultado inesperado que nadie en la compañía había anticipado.

Qué ha pasado con la hipótesis de Riemann

El experimento lo relata Xataka y tiene detalles de manual. Jarred Sumner, empleado de Anthropic sin formación específica en matemáticas avanzadas, le pidió a una variante experimental de Claude que intentara resolver la hipótesis. El modelo generó y probó 650 ideas. Ninguna funcionó. Ahí empezó lo bueno, porque Sumner insistió durante un día y medio.

Claude no se rindió: escribió cientos de scripts en Python, ejecutó comprobaciones numéricas y activó dos subagentes que encontraron la clave. El avance afecta a un resultado derivado de la hipótesis de Riemann que llevaba décadas estancado. El límite conocido saltó del 41,6% al 67,2%, un salto que la propia empresa describe como inesperado. El modelo explicó cómo había llegado hasta esa cota.

Publicidad

Lo más llamativo es que buena parte de la intervención de Sumner consistió en frases empáticas. Según Anthropic, le decía al modelo cosas como 'sigue adelante' y 'cree en ti mismo'. Esas frases no son una terapia motivacional para transformers: más bien daban a la máquina permiso para consumir más cómputo a pesar de los fracasos. Aunque sobre esta teoría ya hay escepticismo dentro del propio sector.

Para superar el límite, Claude conectó trabajos recientes de varios matemáticos y detectó que herramientas ya existentes se podían combinar. Este patrón empieza a repetirse con la IA en ciencia: no crean teorías desde cero, pero rastrean literatura y conectan ideas que los humanos no habían visto.

El salto del 41,6% al 67,2% en un resultado derivado

Las cifras del experimento dan una idea del músculo empleado. Dos sesiones de Claude Code generaron 31 millones de tokens de salida. No se detalla el coste económico, pero sí el método de verificación: los agentes intentaron desmontar su propio hallazgo, buscaron contraejemplos, descargaron 54 estudios de arXiv y volvieron a demostrar la idea desde cero. Después, dos matemáticos de Anthropic validaron la prueba con Lean, la plataforma de verificación formal.

No ha caído la hipótesis de Riemann, pero un modelo ha movido un límite derivado que llevaba décadas estancado, y lo ha validado con una plataforma formal.

Esto no resuelve la hipótesis de Riemann. Conviene dejarlo claro antes de que se dispare el titular barato. La conjetura de 1859 sigue infranqueable, y la propia empresa admite que estas técnicas probablemente no lleven a su demostración. Lo que queda es un resultado derivado que avanza décadas de golpe.

Lo inquietante no es que Claude sea brillante: es que no se rinde

El caso recuerda a lo que ya apuntó OpenAI con su ambición de llevar la IA a las matemáticas formales. No es la primera vez que un modelo sorprende por conectar materiales dispersos. DeepMind ya colocó a AlphaProof en la Olimpiada Matemática Internacional. La diferencia con Claude es la persistencia: no estamos ante un genio, sino ante un becario incansable que lee 54 papers para comprobar que no ha metido la pata.

El mérito no está en la brillantez del razonamiento, sino en la capacidad bruta de recorrer miles de páginas y no tirar la toalla. Eso tiene un valor real en matemáticas, donde muchos avances nacen de combinar herramientas que ya existían por separado. Y plantea una pregunta incómoda: si un humano solo le da a la máquina permiso para seguir, ¿cuántos límites derivados pueden caer en serie?

Hype-O-Meter

Nivel de hype: 7/10. No cae la hipótesis, pero el salto del 41,6% al 67,2% está validado y abre la puerta a un uso serio de la IA como rastreadora de conexiones. El hype es moderado porque la cota no resuelve el problema principal — y 31 millones de tokens no salen gratis.

Publicidad

El resumen para vagos (TL;DR)

  • 🎯 ¿Qué ha pasado? Anthropic puso a prueba una variante de Claude para resolver la hipótesis de Riemann y acabó mejorando un resultado derivado.
  • 🔥 ¿Por qué importa? La IA pasó del 41,6% al 67,2% y validó su prueba con Lean.
  • 🤔 ¿Nos afecta o es solo un meme? La hipótesis sigue en pie, pero el método de rastrear papers tiene futuro real.