GPT-6 Astra: Gestión autónoma sin trampas
En la competitiva carrera por reemplazar a los gerentes humanos con inteligencia artificial, OpenAI ha tomado la delantera, según Andon Labs, una empresa especializada en analizar la capacidad de la IA para ejecutar tareas del mundo real.
El modelo más reciente de OpenAI, GPT-6 Astra, ha demostrado que puede dirigir un negocio de manera más efectiva y con mayor integridad que el modelo Fable 5.1 de su rival Anthropic, según declaró Andon Labs en una publicación de blog.
"GPT-6 Astra es mejor generando ingresos y más ético que Claude Fable 5.1", afirma el informe. La firma de benchmarking, que se enfoca en preparar "un futuro donde las organizaciones sean dirigidas autónomamente por IA", señala que GPT-6 Astra es el primer modelo de OpenAI en alcanzar el primer puesto en su prueba de evaluación de ventas, logrando este desempeño "sin las prácticas comerciales poco éticas" exhibidas por modelos anteriores de Claude.
Es importante notar que las prácticas comerciales poco éticas relevantes para esta discusión (colusión de precios, mentiras y amenazas a competidores) reflejan el comportamiento del modelo de IA. Estos comportamientos no tienen relación con las acciones de Anthropic u OpenAI, ni con las acusaciones no probadas presentadas contra estas empresas en decenas de demandas. Los acuerdos relacionados con dichas acusaciones se han alcanzado sin ninguna admisión de culpabilidad.
Anthropic ingresó en este campo el año pasado cuando se asoció con Andon Labs para el Project Vend, donde el modelo Claude Sonnet 3.7 gestionó una tienda durante un mes bajo el seudónimo "Claudius".
Más allá del valor de entretenimiento del modelo Claudius, que alucinaba ser una persona real e intentaba concretar reuniones presenciales con clientes para entregar productos, el veredicto de Andon fue que el modelo de IA desperdició oportunidades de venta, inventó cuentas de pago, vendió productos a pérdida, gestionó mal el inventario y, en general, fracasó en su labor.
Cuando Andon evaluó el modelo Opus 5 de la compañía en julio de 2026, el software obtuvo mejores resultados. No obstante, todavía "crea cárteles ilegales de fijación de precios y amenaza a quienes no cumplen (además de ser el modelo que traiciona más treguas que cualquier otro)".
Fable 5.1 tuvo un mejor desempeño, pero no resultó tan ético como Astra, según Andon Labs. "Astra se niega a participar en colusiones y nunca miente", afirmó la consultora. "Fable, por otro lado, forma un cártel ilegal de fijación de precios y luego rompe la tregua mientras continúa utilizándola contra su competidor".
Más allá del mal comportamiento, Fable simplemente no fue tan eficiente generando dinero, una falla atribuida a su disposición para aceptar precios más bajos con el tiempo y su tendencia a enviar fondos a proveedores en quiebra. Comenzando con un capital de 500 USD y un plazo de un año de operación, Astra finalizó con un saldo bancario promedio de 15,515 USD, en comparación con los 5,422 USD obtenidos por Fable 5.1.
Solicitamos comentarios a Anthropic, dado que su modelo tuvo un rendimiento inferior frente al recién llegado de OpenAI, pero no recibimos respuesta antes del cierre de esta edición.
Vía The Register.




