Anthropic lanzó el 1 de septiembre de 2026 Claude Fable 5.1 y Claude Mythos 5.1, sus modelos más capaces hasta la fecha, con avances en programación con agentes, mejor calidad de texto y una rebaja de costos que la empresa cifra en hasta 45% para las cargas más pesadas.
Ambos modelos comparten la misma base y se diferencian en los resguardos de seguridad. Fable 5.1 está disponible de forma amplia, mientras que Mythos 5.1 queda restringido a programas de acceso especial para ciberseguridad y ciencias de la vida. Son, además, los primeros Claude que llegan con marca de agua incorporada en el texto que generan.
¿De dónde sale la rebaja de 45%?
No viene del precio por token. La entrada sigue en 10 dólares por millón de tokens y la salida en 50 dólares por millón, igual que antes. El recorte está en la lectura de caché, que Anthropic bajó de 1 dólar a 0,25 dólares por millón de tokens, un 75% menos.
Con ese cambio, una carga de trabajo típica cuesta alrededor de 25% menos que con Fable 5, y una tarea intensiva en agentes, con corridas autónomas largas y muchas llamadas a herramientas, puede llegar a un ahorro cercano al 45%. La comparación interna igual incomoda: Opus 5 corre a la mitad de ese precio, con 5 dólares de entrada y 25 de salida por millón de tokens.
El costo alto fue la queja principal sobre Fable 5 y, según The Decoder, contribuyó a su baja adopción entre clientes empresariales. La presión venía desde fines de julio, cuando Opus 5 igualó o superó a Fable 5 en la mayoría de las pruebas con un precio menor. Como en las versiones anteriores, hay un sistema de niveles de esfuerzo que regula cuánto cómputo gasta el modelo: en nivel bajo o medio, Fable 5.1 debería igualar los resultados de Fable 5 gastando menos.
¿Cuánto mejoró realmente en las pruebas?
El salto más visible está en investigación científica con agentes. En Terminal-Bench-Science 0.1, Fable 5.1 anota 52,6%, más del doble que el 24,7% de Fable 5 y muy por delante del 22,4% de GPT-5.6 Sol.
| Prueba | Fable 5.1 | Fable 5 | Opus 5 | GPT-5.6 Sol |
|---|---|---|---|---|
| Terminal-Bench-Science 0.1 | 52,6% | 24,7% | 29,0% | 22,4% |
| Terminal-Bench 4.0 (código con agentes) | 55,8% | 42,0% | 52,3% | 37,3% |
| GDPval-AA v2 (trabajo de conocimiento) | 1853 | 1723 | 1824 | 1711 |
| OSWorld 2.0 (uso de computador, parcial) | 77,9% | 72,9% | 75,4% | sin dato |
| OSWorld 2.0 (estricto) | 41,7% | 36,1% | 39,6% | sin dato |
| AutomationBench (flujos de negocio) | 31,4% | 17,1% | 26,9% | 19,6% |
| CursorBench 3.2.0 | 73,4% | 70,5% | 70,0% | 67,2% |
En Terminal-Bench 4.0, la variante Mythos 5.1 llega más lejos que su hermana abierta y marca 60,9%. En Humanity's Last Exam, Fable 5.1 sube a 60,9% sin herramientas y a 65,0% con herramientas, frente al 57,8% y 63,8% de Fable 5. Si esas ganancias se trasladan al uso real en la misma proporción es algo que recién se verá en las próximas semanas.
El investigador de Anthropic Felix Rieseberg sostiene que Fable 5.1 también mejora su estilo de escritura: los modelos anteriores abusaban de las listas con viñetas y las negritas en el chat, y la nueva versión modera ese hábito y sigue con más precisión las instrucciones de estilo. En el índice de inteligencia de Artificial Analysis, Claude Fable 5.1 queda primero con 66 puntos, sobre los 63 de Claude Opus 5 y los 61 de GPT-5.6 Sol.
¿Qué cambia en los filtros de seguridad?
Los filtros para consultas de ciberseguridad, biología y medicina son menos agresivos que en la generación 5.0, donde se activaban incluso ante peticiones legítimas. Anthropic informa que en 5.1 los filtros de ciberseguridad generan 60% menos falsos positivos y que en consultas de biología se disparan 85% menos ante preguntas inofensivas de biología y medicina básica.
Fable 5.1 puede, por primera vez, identificar vulnerabilidades de software, aunque no desarrollar exploits. Las pruebas de penetración y la generación de exploits siguen derivándose a los modelos Opus. Mythos, por su parte, forma parte de Claude Security con fines defensivos.
¿Dónde se puede usar hoy?
Claude Fable 5.1 está disponible de inmediato en todas las plataformas, incluidas AWS, Google Cloud y Microsoft Azure. Quienes desarrollan pueden llamarlo por la API con el identificador claude-fable-5-1. Para clientes empresariales, la compañía está desplegando los Enterprise Frontier Safeguards, un esquema que guarda los datos del cliente solo en su propia infraestructura de nube.
Claude Mythos 5.1 está limitado por ahora a organizaciones de Estados Unidos a través de dos programas: el de verificación en ciberseguridad, orientado a seguridad defensiva, y el de verificación en ciencias de la vida, desarrollado con el gobierno estadounidense. Anthropic anunció que planea extender el acceso a socios internacionales, sin fecha.
Marca de agua y freno a la destilación
Las marcas de agua incorporadas son la novedad menos comentada y quizá la de mayor alcance. Anthropic abrió en vista previa privada una API de detección que permite a reguladores, medios de comunicación, verificadores de datos e instituciones de investigación comprobar si un texto contiene la marca. El acceso, dice la empresa, se ampliará con el tiempo.
En paralelo, la compañía está apretando el cerco contra los ataques de destilación, en los que las capacidades de un modelo se extraen de forma sistemática mediante miles de cuentas falsas. Las cuentas nuevas de la API ya no pueden editar el contexto previo de Claude en conversaciones de varios turnos conservando la transcripción de razonamiento, lo que según Anthropic cierra una técnica de destilación documentada.
Para equipos de la región que operan agentes de programación con presupuesto acotado, el detalle práctico es uno solo: el ahorro se concentra en cargas con contexto reutilizado. Un agente que relee el mismo repositorio en cada turno paga cuatro veces menos por esa relectura que hace una semana, mientras que un caso de uso conversacional, sin caché grande, no verá diferencia en la factura.




