OpenAI presenta Astra, modelo IA que avanza en diez problemas matemáticos de larga data

OpenAI ha anunciado Astra, una versión interna de su nuevo modelo generativo, que según la propia compañía ha resuelto o avanzado en diez problemas matemáticos sin progreso durante al menos una década. El anuncio llegó después de que modelos como GPT‑5.4 y Fable 5 de Anthropic ya hubieran contribuido a resolver conjeturas de gran relevancia en los últimos meses. El equipo de OpenAI describe que Astra operó bajo supervisión humana en varias fases. La IA generó argumentos que expertos transformaron en manuscritos, y cada argumento se formalizó mediante un certificado Lean, un sistema que verifica automáticamente la corrección de la demostración. Además, OpenAI publicó un documento adicional generado por la IA que reconstruye el proceso de razonamiento seguido en cada prueba. Los diez problemas abordados incluyen el empaquetamiento de esferas en alta dimensión y la criptografía basada en retículos. Uno de los resultados más destacados es la refutación de las “cotas exponenciales”, identificada como el problema 21 de la teoría de Ramsey y el problema 183 de Erdös. Thomas Bloom, responsable del sitio erdosproblems.com, señaló en X que este hallazgo fue el que más le sorprendió de la lista divulgada por OpenAI. A pesar del entusiasmo, la comunidad académica muestra cautela. El matemático Bharath Ramsundar advirtió que se está construyendo rápidamente una “torre de resultados de IA ‘quizás verdaderos’” y pidió esperar la revisión y consenso de matemáticos humanos antes de aceptar los descubrimientos. Ital Sher propuso que, junto a los éxitos, se publique también la lista completa de problemas intentados sin solución para evaluar la capacidad real del sistema. Jenny Lorraine Nielsen comentó en X que al menos una de las demostraciones contiene un error. El coste total de los tokens empleados para generar las pruebas asciende a menos de 2 000 dólares, usando la tarifa de la API de GPT‑5.6 Sol. Este lanzamiento se produce días después de que Anthropic afirmara que su modelo Mythos Preview había encontrado nuevas debilidades criptográficas tras invertir 100 000 dólares en tokens, evidenciando una creciente competencia entre empresas de IA por superar los límites de la capacidad humana en matemáticas y seguridad.