El viernes, Anthropic lanzó su modelo Opus 5, la versión más reciente de su arquitectura de gran escala. Aunque es un modelo más compacto que Fable 5, Opus 5 resulta ser más económico y cuenta con menos restricciones, lo que probablemente lo convierta en la opción preferida para la mayoría de los casos de uso.

Es importante destacar que Opus 5 supera a Fable 5 en diversos benchmarks incluidos en el anuncio oficial de la compañía.

Opus 5 llega al mercado apenas dos meses después de Opus 4.8, lanzado el 28 de mayo. Dado que Mythos 5, Fable 5 y Sonnet 5 debutaron durante el mes de junio, solo queda pendiente la actualización de la serie 5 para el modelo ligero Haiku.

En una publicación anunciando el nuevo modelo, Anthropic enfatizó que Opus 5 es "mucho más capaz de verificar su propio trabajo e iterar cuidadosamente hasta lograr el éxito". Como ejemplo, citaron pruebas donde Opus 5 escribió su propio pipeline de visión artificial tras recibir una instrucción incompleta.

Un aspecto crucial es que Opus 5 está libre de muchas de las restricciones que han afectado a Fable desde su lanzamiento. Al igual que su predecesor, Opus 5 no está sujeto a la política de retención de datos de 30 días que aplica a Fable y Mythos, una norma que había generado inquietud entre los usuarios preocupados por su privacidad.

No obstante, aún existen salvaguardas significativas en Opus, especialmente en tareas de ciberseguridad como la generación de exploits y pruebas de penetración. Por ejemplo, los filtros de Opus 5 impiden que sea utilizado para escanear vulnerabilidades en binarios de software, aunque sí se permite la búsqueda de fallos en código fuente, ya que esta última tarea suele tener fines defensivos.

En términos generales, Anthropic estima que estos clasificadores de seguridad se activarán un 85% menos en Opus 5 en comparación con Fable 5, reflejando un enfoque más flexible para el modelo de menor capacidad.

Adicionalmente, Anthropic está implementando una nueva herramienta para hacer que las salvaguardas sean menos disruptivas cuando se activan. Los usuarios ahora pueden optar por una función beta llamada Automatic Fallbacks, que redirige automáticamente las solicitudes a un modelo menos potente cuando un prompt activa el clasificador de seguridad. El resultado es que los usuarios de la API obtendrán una respuesta funcional en lugar de un mensaje de error.

Vía TechCrunch.