En 1997 Deep Blue doblegó a Kasparov; ahora OpenAI lanza Astra para repetir la hazaña en matemáticas. Y con una factura que casi da risa.
OpenAI acaba de presentar una versión interna de Astra, un modelo de IA generativa que ha conseguido resolver —o avanzar significativamente— diez problemas matemáticos que llevaban al menos una década sin progreso, y en la mayoría de los casos llevaba mucho más tiempo. El momento Deep Blue de las matemáticas ya no es ciencia ficción: es un comunicado de prensa. Lo ha hecho, además, por menos de 2.000 dólares en tokens, usando los precios de la API de GPT-5.6 Sol.
Los problemas abarcan desde el empaquetamiento de esferas en alta dimensión hasta la criptografía basada en retículos. Pero el resultado más llamativo —y el que ha dejado con la boca abierta a los expertos— es la refutación de las cotas exponenciales, que corresponde al problema 21 de la teoría de Ramsey y al 183 de Erdős. Thomas Bloom, el matemático que mantiene el sitio erdosproblems.com, confesó en X que este era el que más le sorprendió de toda la lista.
Matemáticas a precio de menú del día (y con ayuda humana)
OpenAI combinó a Astra con supervisión humana: el modelo generaba argumentos matemáticos, y los expertos los convertían en manuscritos para luego formalizarlos en Lean, un sistema que verifica automáticamente la corrección de las demostraciones. Además, la compañía ha publicado un documento generado por su IA que reconstruye todo el razonamiento seguido en cada prueba. La transparencia es total, dicen ellos, aunque la letra pequeña llegará con la revisión por pares.
Lo que de verdad ha descolocado a la comunidad es el coste. 2.000 dólares. Un café con aguacate y tostada de masa madre en Palo Alto. Mientras Anthropic se gasta 100.000 dólares en tokens para que Mythos Preview encuentre debilidades criptográficas, OpenAI ha despachado diez problemas históricos por una fracción. Algunos ya hablan de "la democratización del razonamiento". Otros, de "ver para creer".
2.000 dólares por diez problemas. Anthropic se dejó cien mil para encontrar fallos de seguridad. La pelea por el trono de la IA se libra a golpe de token y ego matemático.
Del asombro a la duda: la sombra del error
Pero no todo son campanas al vuelo. La investigadora Jenny Lorraine Nielsen ha señalado en X que al menos una de esas demostraciones contiene un error. Y el matemático Ital Sher fue un paso más allá: propuso que debería ser obligatorio publicar la lista completa de problemas que se intentaron y no se resolvieron, no solo los éxitos, para poder calibrar de verdad la capacidad del sistema. Bharath Ramsundar advirtió que estamos construyendo "una torre de resultados de IA 'quizás verdaderos'" y que es imprescindible que los matemáticos humanos revisen y alcancen un consenso.
Es decir: la demostración de fuerza es innegable, pero el sello de calidad todavía es provisional. Como en 1997, cuando Deep Blue venció a Kasparov pero todos discutían las condiciones y los posibles fallos del humano. La historia se repite con menos madera y más silicio.
Por qué esto es (casi) un antes y un después
Si los resultados resisten el escrutinio, Astra habrá hecho con las matemáticas lo que Deep Blue con el ajedrez: demostrar que una máquina puede superar el razonamiento humano en un campo que creíamos único. Pero, a diferencia de 1997, aquí la máquina no juega sola: trabaja codo con codo con matemáticos humanos. Terence Tao, "el Mozart de las matemáticas", lleva meses usando la IA como aliada —y no es el único. El paradigma ya no es "hombre vs máquina", sino "hombre + máquina". Y eso, quizá, sea más inquietante que cualquier partida de ajedrez.
La jugada tiene miga: OpenAI se adelanta a Anthropic justo cuando la guerra por el razonamiento alcanza temperaturas de horno crematorio. Mythos Preview encontró debilidades criptográficas; Astra resuelve problemas matemáticos. Ganar la batalla narrativa es tan importante como la científica.
Hype-O-Meter
Nivel de hype: 8.5/10. La capacidad es real, los problemas son gordos y el coste es irrisorio. Si la revisión por pares confirma que las pruebas son sólidas, estaremos ante un hito. Pero el error detectado y la falta de transparencia sobre los fallos nos obligan a ser cautos. Por ahora, aplauso moderado y un ojo puesto en la letra pequeña.
El resumen para vagos (TL;DR)
- 🎯 ¿Qué ha pasado? OpenAI ha presentado Astra, una IA que ha resuelto diez problemas matemáticos históricos.
- 🔥 ¿Por qué importa? Porque por menos de 2.000 dólares ha hecho lo que décadas de esfuerzo humano no habían logrado, rozando un hito tipo Deep Blue.
- 🤔 ¿Nos afecta o es solo un meme? Si las demostraciones aguantan la revisión, cambia la forma de investigar en matemáticas. Si no, será un aviso para navegantes.



