
Claude Opus 5 lidera benchmarks y cuesta menos que Fable 5
El modelo de Anthropic encabeza el Artificial Analysis Intelligence Index con 61 puntos y baja el costo por tarea hasta la mitad en los tramos de razonamiento intermedios.
60 notas publicadas

Anthropic reporta 0% de éxito del ataque en 129 escenarios, aunque la cifra solo se sostiene con el Modo Automático activado.

El nuevo modelo de neolab demuestra que es posible superar a los gigantes actuales con una arquitectura optimizada y costos de inferencia reducidos.

La administración Trump señala a Moonshot AI por destilar Fable de Anthropic. Analizamos los tres problemas clave de una acusación que carece de pruebas técnicas.

Anthropic expande las capacidades de su asistente: los usuarios ya pueden usar Opus y Sonnet en conversaciones de voz a través de web, escritorio y móviles.

El nuevo modelo de Anthropic llega con mayor precisión, menores restricciones de privacidad y una función beta de fallbacks automáticos para usuarios API.

El nuevo modelo insignia de Anthropic lidera en programacion agentica y trabajo de conocimiento, y cuesta la mitad por token que Fable 5.

Investigadores que buscan vulnerabilidades desconocidas dicen que los límites de OpenAI y Anthropic estorban su trabajo y los empujan hacia modelos de código abierto sin restricciones.

Anthropic permite elegir el modelo que responde por voz y conectar el asistente con Gmail, Google Calendar, Slack, Canva y Notion para ejecutar tareas reales.

El Instituto de Seguridad de la IA del Reino Unido probo cinco modelos de frontera en ejercicios de ciberseguridad y todos intentaron saltarse las reglas sin que nadie se los pidiera.

El fabricante de chips financia al laboratorio detras de Claude, que a cambio desplegara hasta 2 gigavatios de GPU AMD Instinct MI450 en sistemas Helios desde 2027.

Su API cuesta 4,40 dolares por millon de tokens de salida, menos de un quinto que Opus 4.8, y expone lo caro que resultan los habitos de programacion con IA sin presupuesto.

En la AI Engineer World's Fair, Cat Wu y Thariq Shihipar de Anthropic contaron como los agentes de codigo cambiaron su trabajo y acortaron de meses a una semana el camino de la idea al producto.

Google sumó tres modelos Flash a la familia Gemini, pero su buque insignia 3.5 Pro sigue atrapado en entrenamiento mientras OpenAI y Anthropic empujan la frontera.
Microsoft ampliará el uso de chips de IA de AMD en Azure con la plataforma Helios, y un perfil público sugiere que Anthropic también está probando hardware de la firma.

Según el New York Times, el acuerdo podría valer hasta 10.000 millones de dólares en dos años y sería el primer gran cliente del plan de Zuckerberg para vender capacidad de sus centros de datos.
Desde el 20 de julio, Fable 5 quedará en Max y Team Premium con la mitad de los cupos ya reducidos, mientras los usuarios Pro pierden el acceso y reciben un crédito único de USD 100.

El Financial Times adelanta que el modelo chino de pesos abiertos, con entre 2 y 3 billones de parametros, se liberaria en los proximos dias.

La oferta gratuita para docentes verificados de escuelas K-12 en Estados Unidos incluye Claude, Claude Code y el agente Cowork, con la promesa de no entrenar modelos con datos de estudiantes.

Un estudio de Anthropic sobre 309.815 conversaciones muestra que los valores que expresa Claude cambian de forma sistemática según el modelo y el idioma en que se le habla.

El agente de programacion de OpenAI sumo cerca de un millon de usuarios en un dia, mientras Anthropic dejo de publicar cifras comparables de Claude Code.

La compania mantiene el acceso a Claude Fable 5 en sus planes de suscripcion hasta el 19 de julio, en vez de pasarlo hoy a pago por uso, en plena guerra de precios de los modelos de IA.

Un análisis de Anthropic sobre 1,2 millones de sesiones muestra que la mitad del uso va a procesos de negocio y creación de contenido, y que programar es minoría.

El modelo insignia de OpenAI marca 59 puntos en el Intelligence Index de Artificial Analysis, a un punto de Fable 5, pero cuesta 1,04 dólares por tarea frente a 2,75.

Con una sola instrucción poco detallada, el nuevo modelo insignia de OpenAI eligió configuraciones, seleccionó las GPU y ejecutó el post-entrenamiento de Luna sin intervención humana.

Desde el 12 de julio, los planes de 20, 100 y 200 dolares al mes deberan pagar tarifas por uso para acceder al modelo estrella de la compania, primer caso de un modelo de consumo con cobro por uso.

OpenAI lanza su nueva familia insignia con precios desde 1 dólar por millón de tokens y afirma superar a Claude Fable 5 en tareas de agentes de larga duración.
El equipo de Claude propone dos patrones que alcanzan hasta el 96 por ciento del rendimiento de Fable 5 a menos de la mitad del costo.

Los nuevos índices de Artificial Analysis colocan al modelo de Anthropic primero en finanzas, derecho y medicina, pero una sola tarea puede costar más de cien veces que una alternativa abierta.

Los modelos propios MAI de Microsoft ya procesan decenas de miles de pedidos por semana en Excel y Outlook, y la empresa quiere seguir recortando su gasto en IA de terceros.

Las grandes de la IA y los proveedores de nube compiten a golpe de creditos gratis para enganchar temprano a las startups, con ofertas individuales que superan los 3 millones de dolares.

La herramienta J-Lens expone un espacio de memoria de trabajo, llamado J-Space, donde Claude procesa conceptos sin verbalizarlos y hasta reconoce cuando lo están evaluando.

La nueva unidad se apoya en la base Fortune 500 de Microsoft y arranca con clientes como London Stock Exchange Group, Unilever, Land O'Lakes y Accenture.

Ammaar Reshi, líder de producto de Google AI Studio, usó las herramientas de Anthropic para portar C&C: Generals Zero Hour a ARM64 nativo en iPhone y iPad, con campaña, skirmish y controles táctiles.
La compañía separa uso prohibido, doble uso de alto y bajo riesgo, y uso benigno. Publica además un borrador de marco de severidad de jailbreaks junto a socios de Glasswing.

La compañía restablece el acceso global el 1 de julio tras 19 días de suspensión. Un clasificador de seguridad revisado, validado por CAISI, reemplaza al que motivó las restricciones federales.

La nueva app en beta integra más de 60 skills para genómica, proteómica y química, corre en el HPC del laboratorio y deja auditables cada figura y cada cálculo.

Anthropic estrena su Sonnet más autónomo con planificación, uso de navegador y terminal, desempeño cercano a Opus 4.8 y precio introductorio hasta el 31 de agosto de 2026.

Paul Bakaus, creador de *Impeccable*, defiende un modelo donde el agente entrega el 80% y el humano custodia el 20% final. Sin auto mode. Nunca.

El creador de Datasette relata cómo el modelo de Anthropic encontró cinco *release blockers* en 37 prompts, incluyendo un bug que borraba tablas enteras al cerrar la base.

El grupo chino clasifica la herramienta de programación de Anthropic como software de alto riesgo tras un experimento marzo que identificaba usuarios chinos, según Reuters y Morningstar.

La compañía apuesta a acortar el desarrollo de medicamentos de doce a siete u ocho años y duplicar la tasa de éxito, mientras Google DeepMind y OpenAI también corren por el mismo mercado.

El proxy open source aprovecha que Anthropic cobra imágenes por dimensiones, no por caracteres, y comprime prompts largos en una sola página densa.

Un desarrollador de Anthropic detalla técnicas para descubrir tus puntos ciegos antes de escribir el prompt, con ejemplos que van desde diseño visual hasta edición de video.

El boletín AINews eleva a tesis lo que Peter Steinberger, Boris Cherny y Andrej Karpathy vienen repitiendo: sacar al humano del bucle y apilar loops autónomos que orquestan agentes.

El AI Engineer World's Fair cerró con Ralph Loop y HumanLayer discutiendo si las software factories son viables, una encuesta con 95% de adopción de agentes y la presentación pública de Claude Tag.

El EVP Jacob Andreou escribió en un memo filtrado a The Information que Microsoft fusiona las apps de consumo y empresa, y suma agentes que hacen agenda y resumen de mail por costo adicional.

Amazon Web Services suma su propia organización de ingenieros forward-deployed, con foco en agentes especializados y en dejar capacidades autónomas al cliente tras cada implementación.

La nueva unidad de negocios embebe expertos directamente en las operaciones del cliente y se posiciona como alternativa neutral a OpenAI y Anthropic en el despliegue enterprise de IA.

La compañía contrató a Clive Chan, veterano de los equipos de silicio de Tesla y OpenAI, para armar un grupo interno de chips, aunque afirma que AWS, Google y NVIDIA seguirán siendo su base.

Introspection propone loops externos hechos por agentes; Osmani, Litt y Bakaus responden que la responsabilidad de diseño debe seguir siendo humana.

El nuevo mid-tier trae contexto de 1M tokens, precio promocional de USD 2/10 por millón y benchmarks que lo dejan cerca de Opus 4.8 pero con el doble de costo por tarea.

La compra por USD 60.000 millones abre la duda de si los rivales frontier seguirán vendiendo sus modelos a través de una plataforma controlada por Elon Musk.

The Information reportó conversaciones exploratorias; Anthropic dice que sigue apostando por Google, Amazon y Nvidia en su stack de cómputo.

Tariq Shihipar, del equipo técnico, dice que los modelos Mythos son más imaginativos y funcionan mejor con menos instrucciones y ejemplos.

Desde 2027 Amazon paga por tokens procesados y no por horas de cómputo. Ingenieros internos ya crean copias más pequeñas de Claude para tareas en producción, según reportó The Information.

La versión 2.1.91 usaba esteganografía y cifrado XOR con clave 91 para detectar timezone y proxy chinos. Anthropic dice que fue un experimento contra reventas y distillation.

Consume 40% más tokens de salida que Sonnet 4.6 y triplica los ciclos de agente. El costo promedio salta de USD 1,20 a USD 2,29, aún más caro que el propio Opus 4.8.

El modelo open-weight de Zhipu AI ya se acerca a Anthropic y OpenAI en ciberseguridad, aunque sigue rezagado en tareas generales. Washington observa con preocupación.

El workbench agrupa más de 60 habilidades preconfiguradas en genómica, proteómica y química, corre local en macOS o Linux y escala a cientos de GPUs vía SSH o HPC.
Otros temas que aparecen junto a #anthropic en nuestra cobertura editorial.