
IA
OpenAI dice que GPT-5.6 Sol supera a Opus 5 en ARC-AGI-3
La empresa afirma que su modelo alcanza 38,3% frente al 30,2% de Claude Opus 5, pero solo cuando corre con dos ajustes propios de su API en lugar del entorno de prueba oficial.
The Decoder
2 notas publicadas
Otros temas que aparecen junto a #benchmarks ia en nuestra cobertura editorial.