
IA
Claude Opus 5 lidera el benchmark ARC-AGI-3 con 30.2% de puntaje
El nuevo modelo de Anthropic alcanza un 30.2% en el benchmark ARC-AGI-3, superando por amplio margen el 7.8% obtenido previamente por el GPT-5.6 Sol de OpenAI.
The Decoder
1 nota publicada
Otros temas que aparecen junto a #razonamiento logico en nuestra cobertura editorial.