OpenAI anuncia su próximo modelo principal, Astra, resolviendo diez problemas matemáticos

OpenAI está trabajando en una nueva familia de modelos de inteligencia artificial denominada "Astra", diseñada para gestionar tareas de larga duración y problemas complejos mediante la coordinación de múltiples agentes que trabajan de forma conjunta. El CEO Sam Altman ya ha presentado Astra en Washington, D.C. Actualmente, los modelos se encuentran en fase de pruebas y serán los primeros en someterse al nuevo proceso de revisión gubernamental de los Estados Unidos, que requiere aprobación oficial antes de cualquier lanzamiento público.

Este proyecto refleja la ambición más amplia de OpenAI por desarrollar sistemas de IA capaces de trabajar en problemas de manera continua durante horas o incluso días. La compañía ha publicado su informe matemático, confirmando por primera vez el nombre Astra para lo que definen como su "próxima familia de modelos principales". Según OpenAI, una versión interna de Astra logró resolver diez problemas abiertos en matemáticas y ciencias de la computación teórica.

Los resultados abarcan campos que van desde la geometría de alta dimensión y la teoría de codificación hasta la teoría de grupos, la complejidad cuántica, la criptografía de redes y la combinatoria extremal. Una de las demostraciones establece la existencia de grupos no sofísticos, resolviendo una cuestión abierta fundamental en la teoría de grupos.

Gráfico de representación de problemas matemáticos resueltos por IA
Gráfico de representación de problemas matemáticos resueltos por IA

Thomas Bloom, matemático de la Universidad de Manchester que gestiona erdosproblems.com, calificó los resultados como "grandes noticias" en X. Considera que son más significativos que el contraejemplo a la conjetura de distancia unitaria publicado en mayo. "Quizás no sea más grande de lo que hubiera sido una prueba de la distancia unitaria, pero en términos de construcciones, esto es importante", escribió Bloom.

Bloom también rechazó la idea de que la IA esté reemplazando a los matemáticos, argumentando que tal afirmación carece de sentido cuando la IA se basa en más de un siglo de teoría matemática, fue construida por matemáticos y fue entrenada con todo lo que los matemáticos han escrito jamás.

Noam Brown, uno de los investigadores detrás de la tecnología de razonamiento durante el tiempo de ejecución utilizada por Astra, comentó en X que OpenAI también intentó y falló en otros problemas importantes. "Lamentablemente, todavía no hay problemas del Premio del Milenio", escribió. El Clay Mathematics Institute ofrece 1 millón de dólares por resolver cada uno de los siete Problemas del Premio del Milenio, pero solo uno ha sido resuelto desde que se anunciaron los premios en el año 2000. Brown añadió: "Pero tampoco gastamos mucho en cada problema. Es posible llevar el cómputo durante el tiempo de ejecución mucho más lejos". Calificó a Astra como un "paso importante para el razonamiento científico".

Las soluciones de Astra costarían unos 2.000 USD a tarifas de API

OpenAI afirma que los tokens utilizados para generar las diez soluciones habrían costado aproximadamente 2.000 dólares a las tarifas de la API de Sol. Después de que el modelo produjo sus argumentos, los humanos trabajaron con el mismo modelo para convertirlos en artículos de investigación. El modelo también formalizó cada prueba en Lean, creando certificados verificables por máquina de la corrección matemática, y OpenAI publicó un recorrido del proceso de razonamiento del modelo para cada solución.

Diagrama del flujo de trabajo de razonamiento de Astra
Diagrama del flujo de trabajo de razonamiento de Astra

OpenAI señaló que sus investigadores ayudaron a preparar los artículos y a formalizar las pruebas, y que la empresa asume la responsabilidad de su precisión. Sin embargo, los argumentos matemáticos en sí provinieron de Astra. La empresa argumentó que reclamar la autoría humana para una prueba generada enteramente por IA tergiversaría tanto la contribución del sistema como la naturaleza del trabajo intelectual humano genuino, señalando a la Declaración de Leiden sobre IA y Matemáticas como referencia para determinar cómo se debe asignar el crédito en la investigación asistida por IA.

¿Astra será el primer modelo bajo el nuevo marco regulatorio de EE. UU.?

Según The Information, los modelos ya están en fase de pruebas. Se espera que sean los primeros en pasar por el nuevo marco de IA planeado por la administración Trump, el cual requeriría que los modelos de IA sean presentados ante el gobierno federal antes de su lanzamiento al público. La administración tiene como objetivo finalizar este marco para finales de esta misma semana.

Una cuestión clave es si los modelos pueden evitar errores compuestos durante flujos de trabajo de larga duración y corregirse a sí mismos cuando un proceso se desvía a medida que el contexto sigue creciendo. Esa sigue siendo una debilidad importante en los sistemas agentes actuales. Las configuraciones de múltiples agentes como Astra también pueden rendir peor en tareas estrechamente vinculadas, como la planificación, debido a que el costo de coordinación y los errores acumulados pueden anular cualquier ganancia.

¿Hacia una investigación de IA totalmente autónoma?

Los rumores sobre Astra coinciden con declaraciones anteriores de la empresa. El científico jefe, Jakub Pachocki, dijo en el podcast oficial de OpenAI el verano pasado que la compañía quiere construir sistemas de IA capaces de trabajar en un problema durante horas o días. Los sistemas actuales suelen limitarse a tareas cortas, pero OpenAI quiere modelos que puedan planificar, razonar y experimentar en horizontes temporales más largos. A finales del año pasado, la compañía incluso planteó la pregunta de cómo pensar en sistemas que pudieran resolver tareas que a un humano le tomarían siglos completar.

Para marzo de 2028, OpenAI quiere tener un investigador de IA totalmente autónomo capaz de ejecutar proyectos de investigación por su cuenta, y ese sistema también dependerá de procesos de IA de larga duración. Tan pronto como este septiembre, la compañía planea tener un sistema de IA con habilidades equivalentes a las de un pasante de investigación que aceleraría significativamente el trabajo de los científicos humanos. Astra podría terminar siendo ese sistema.

Pachocki también mencionó que estos sistemas necesitarán mucha más capacidad de cómputo. Los planes de infraestructura a largo plazo de OpenAI reflejan esa ambición. Si los ingresos de la startup crecerán lo suficientemente rápido como para financiar esa construcción masiva sigue siendo una pregunta abierta.

Vía The Information.