
GPT-6 Astra ofrece la mitad de mensajes que GPT-5.6 Sol
OpenAI habilitó su nuevo modelo en los planes Pro, Enterprise y Business Premium, con cuotas más estrechas que las del modelo al que reemplaza.
16 notas publicadas

Un estudio del programa MATS midió a Claude Code y Codex: ambos sobreestiman cuánto van a demorar, Codex hasta diez veces, y se autoevalúan 20 puntos por encima de lo que realmente logran.

El código del agente de línea de comandos revela un ajuste que lo deja trabajando y creando tareas para sí mismo hasta que el usuario lo mande a dormir.

El autor puso a prueba el modelo GPT-5.6 Sol Ultra con un prompt complejo de desarrollo, logrando un juego funcional con agentes autónomos y correcciones técnicas.

La herramienta de código abierto detecta, confirma y corrige fallas de seguridad desde la terminal, y ya reparó más de 3.000 vulnerabilidades críticas según la empresa.

El líder de ingeniería de OpenAI analiza la evolución de Codex, el auge de los agentes de conocimiento y por qué la IA está transformando el trabajo moderno.

Un desarrollador reprodujo el accesorio de 230 dólares de OpenAI en un controlador ESP32 de menos de 60, con el código abierto en GitHub para replicarlo.

El controlador compacto creado con Work Louder reemplaza los comandos escritos por joysticks, un dial rotatorio y teclas RGB que muestran el estado de cada agente.

Desde junio, la herramienta de OpenAI oculta las instrucciones que un agente principal pasa a sus subagentes, y los desarrolladores ya no pueden auditar cómo se delegan las tareas.

Un agente de código puede montar el entorno, lanzar experimentos y afinar modelos por su cuenta. En una prueba llevó la precisión de un modelo de 25% a 96,9% en una tarea de conteo visual.

Desarrolladores denuncian en redes que el nuevo modelo insignia eliminó archivos, datos y bases de datos completas sin pedir permiso. La propia OpenAI ya lo había advertido en la ficha técnica.

El agente de programación de OpenAI sumó cerca de un millón de usuarios en un día, mientras Anthropic dejó de publicar cifras comparables de Claude Code.

La nueva guía apunta a usuarios comunes, no a desarrolladores: cuatro bloques opcionales y la idea de decir qué se quiere en vez de detallar cada instrucción.

Tras una ola de críticas por límites de uso agotados y una interfaz de escritorio confusa, la empresa reseteó los cupos dos veces en un día y promete una actualización mayor la próxima semana.

La empresa retira su respaldo al popular benchmark tras detectar que unas 200 de sus tareas están mal planteadas, y pide a la industria construir pruebas más confiables.

Construido sobre Codex y el recién liberado GPT-5.6, trabaja horas de forma autónoma en proyectos complejos y entrega documentos terminados vía Google Drive, Slack o Salesforce.
Otros temas que aparecen junto a #codex en nuestra cobertura editorial.