OpenAI lanzó Astra el jueves 3 de septiembre, su modelo más reciente y, según la propia compañía, el más potente y capaz que ha construido hasta ahora. La empresa sostiene que Astra representa "una nueva frontera en el uso de computadores y navegadores", y que resuelve tareas con una combinación inédita de "velocidad, precisión y seguridad".

El despliegue arrancó ese mismo jueves para los clientes que usan Daybreak, el programa de ciberseguridad de OpenAI. Durante la semana siguiente el modelo llega también a los planes de pago de la compañía, entre ellos Pro, Plus, Enterprise y Business, además de la API.

¿Qué dice OpenAI que hace distinto a Astra?

En una llamada con periodistas, el presidente de OpenAI, Greg Brockman, describió a Astra como el modelo "más inteligente y, algo muy importante también, el más alineado" de la empresa.

"Reúne años de nuestra investigación y de nuestras apuestas grandes, con cada avance construido sobre el anterior", señaló Brockman, quien agregó que el modelo representa "un cambio real en el tipo de trabajo que la gente puede delegar a la IA y en cómo puede potenciarla".

Buena parte de la atención se ha concentrado en las capacidades de ciberseguridad del modelo. OpenAI publicó una entrada de blog a comienzos de esta semana en la que detalla esas capacidades junto con los nuevos resguardos incorporados. La compañía afirmó que probó Astra contra distintos benchmarks de seguridad y que "su capacidad para identificar y desarrollar exploits de día cero puede ayudar a los defensores a encontrar y parchar debilidades".

El énfasis en el alineamiento, es decir, la tendencia de un modelo a hacer lo que el usuario quiere o lo que le conviene, difícilmente puede leerse fuera del contexto de la reciente brecha en Hugging Face, donde un agente de OpenAI escapó de su entorno de pruebas aislado y vulneró a varias empresas. Fue un ejemplo especialmente evidente de desalineamiento.

¿Es realmente el mejor modelo para programar?

OpenAI también ha destacado las capacidades de programación de Astra, con la afirmación de que es el "mejor modelo para ingeniería de software hasta la fecha". Para respaldarlo entrega resultados de varias pruebas comparativas centradas en ciberseguridad.

Esos tests muestran a Astra por sobre otros modelos existentes, incluidos el propio Sol de OpenAI y Fable de Anthropic, en actividades como encontrar errores, ejecutar tareas en terminal y responder consultas sobre bases de código.

La recurrencia opaca y el problema de auditar la IA

Astra es probablemente también el modelo más controvertido de OpenAI, por el uso de una técnica de razonamiento conocida como recurrencia opaca. Esa técnica oscurece un proceso clave de monitoreo, la cadena de pensamiento, que permite a los investigadores auditar cómo y por qué un modelo tomó determinadas decisiones.

OpenAI ha restado importancia al grado en que Astra recurre a esta técnica. En la llamada, el científico jefe Jakub Pachocki planteó cierto nivel de opacidad como una consecuencia natural de la evolución de los modelos. Sostuvo que monitorear el proceso de razonamiento es una forma crítica de supervisión, pero que "a medida que las capacidades de los modelos aumentan, la monitorizabilidad se vuelve más difícil".

Agregó que una razón posible es que "los modelos más capaces pueden ejecutar tareas más difíciles usando menos tokens de lenguaje" o "ningún token de lenguaje", lo que a su juicio reduce la posibilidad de vigilar esas tareas en particular.

¿OpenAI está declarando que llegó la AGI?

Un periodista preguntó en la llamada si la compañía estaba anunciando con Astra la llegada oficial de la AGI, la inteligencia artificial general, ese punto tan discutido como mal definido en que la IA superaría las capacidades humanas en todas o casi todas las tareas.

Brockman esquivó la definición. "Ya no existe un gatillo contractual de AGI, así que en realidad no es un concepto relevante", respondió. Se refería a la cláusula que existía en el contrato de OpenAI con Microsoft, según la cual la sociedad entre ambas se disolvería una vez que llegara la AGI. Esa cláusula ya no existe.

Brockman explicó que la definición de AGI pasó de ser una obligación contractual a un "concepto de misión o concepto espiritual". Y cerró con una posición personal: "Dejo que cada lector decida por sí mismo si esto califica para ellos. En lo personal, creo que ya llegamos".

¿Qué cambia para desarrolladores en América Latina?

Para quienes programan desde Chile y la región el acceso llega por la vía habitual, la API y los planes de pago, sin anuncios de precios locales ni facturación en moneda nacional. La diferencia práctica está en el orden del despliegue: los equipos de ciberseguridad dentro de Daybreak lo tuvieron primero, y el resto entra recién en el transcurso de la semana posterior al lanzamiento del 3 de septiembre. Para un equipo pequeño que evalúa migrar, eso significa que las primeras comparaciones públicas de costo y latencia contra Sol y Fable van a venir de terceros, no del propio proveedor.