Anthropic anunció una actualización a los resguardos de biología de Claude Fable 5 que reduce de manera sustancial los falsos positivos. En sus pruebas internas, el cambio bajó cerca de un 85% los reenvíos relacionados con biología a través de todas las superficies de producto de la empresa.
En la práctica, esto significa que quienes usan Fable 5 verán muchos menos de esos saltos a un modelo menos capaz cuando pregunten por temas cotidianos de salud o educación: interpretar resultados de laboratorio, entender síntomas o estudiar biología en un contexto formativo. Los profesionales de la salud, además, podrán apoyarse más en el modelo para tareas clínicas.
Lo que no cambió es el terreno de doble uso. Fable 5 sigue derivando a Opus 5 las solicitudes que la empresa considera sensibles, incluidas virología, toxicología y diseño molecular, por lo que todavía no sirve para investigación biológica profesional ni para desarrollo de fármacos.
¿Por qué existían resguardos tan estrictos?
El razonamiento que expone Anthropic es directo: Fable 5 ya supera a expertos humanos en algunas tareas biológicas de alta complejidad y entrega soporte operacional en otras. Eso puede significar ayuda genuina para alguien que desarrolla un tratamiento médico, pero las mismas capacidades en manos equivocadas podrían orientarse al desarrollo de un arma biológica.
Las evaluaciones de capacidad de la empresa muestran que el modelo podría entregar a un actor malicioso lo que en la jerga del sector se llama uplift: capacidades que esa persona no encontraría en ninguna otra parte.
El problema de fondo es que distinguir entre uso beneficioso y uso dañino en biología es genuinamente difícil. Anthropic entrega dos ejemplos concretos. Las vacunas vivas obligan a los científicos a cultivar el mismo patógeno que buscan prevenir. Y para desarrollar el captopril, un medicamento contra la hipertensión, hubo que aislar los componentes tóxicos del veneno de serpiente que hacen desplomar la presión arterial en humanos.
La empresa también cita la Evaluación Anual de Amenazas 2026 de la comunidad de inteligencia estadounidense, que advierte que los avances en biotecnología, incluidas la biología sintética y la edición genómica, "podrían dar lugar a nuevas amenazas biológicas". El documento señala que varios actores estatales mantendrían programas ofensivos activos de armas biológicas y químicas.
Por esa razón Fable 5 se lanzó con casi todas las consultas de biología bloqueadas. Anthropic asumió el costo de una tasa alta de falsos positivos a cambio de poder liberar el modelo para el resto de los dominios, apoyándose en que el costo de un mal uso en un área de doble uso podría ser catastrófico.
¿Cómo funciona el mecanismo de bloqueo?
El componente central son los clasificadores de seguridad: sistemas de IA más pequeños y automatizados que detectan cuándo se le pide a Fable 5 una tarea biológica resguardada o cuándo el modelo está por producir una salida dañina. Anthropic ya había publicado sobre clasificadores equivalentes en ciberseguridad.
Cuando el clasificador se activa, el modelo redirige la solicitud a Opus 5, que es capaz pero no tiene el mismo nivel de capacidad biológica. Ese redireccionamiento es el "fallback" que ve el usuario.
Afinar un clasificador no es trivial. Tiene que aprender la frontera entre lo que está dentro y fuera de alcance, evitando a la vez los falsos positivos (se dispara con contenido inocuo) y los falsos negativos (deja pasar contenido riesgoso). Y además debe resistir intentos de evasión.
Durante las últimas semanas el equipo reescribió la constitución del clasificador, el conjunto de reglas que le permite discernir entre contenido resguardado y permitido, detallando con más cuidado los usos benignos. Recogieron comentarios de expertos internos y externos, generaron datos de entrenamiento nuevos a partir de esa constitución, reentrenaron el clasificador y verificaron que siguiera activándose ante contenido dañino y de doble uso.

¿Cuánto baja el bloqueo en cada producto?
El dato de 85% corresponde solo a los reenvíos de origen biológico. Anthropic detalla en una nota al pie el efecto sobre el total de reenvíos, por cualquier motivo, en cada superficie:
| Superficie | Reducción total de reenvíos |
|---|---|
| Claude.ai | Cerca de 67% |
| Cowork | 55% |
| Claude Code | 17% |
| Plataforma Claude | 7% |
La lectura de esa tabla es interesante por sí sola: muestra qué proporción del bloqueo total en cada producto venía del filtro biológico. En la interfaz de consumo, donde la gente pregunta por sus exámenes y sus síntomas, la biología explicaba dos tercios de todos los reenvíos. En la plataforma para desarrolladores, apenas un 7%.
Lo que esto cambia para LatAm
El ángulo regional es concreto y poco discutido: en Chile y el resto de LatAm, una porción relevante del uso de asistentes de IA en salud ocurre en el hueco que deja el sistema, con personas que consultan un resultado de laboratorio antes de conseguir una hora médica. Cada falso positivo en ese escenario no era una molestia técnica, era una respuesta degradada en el peor momento posible.
Al mismo tiempo, la parte que sigue bloqueada mantiene fuera a la investigación biomédica profesional de la región. Los laboratorios universitarios latinoamericanos que quisieran usar el modelo para trabajo serio en virología o diseño molecular siguen en la misma posición que antes, a la espera de las vías de acceso confiable que la empresa dice estar construyendo.
Lo que falta
Anthropic reconoce que quedan falsos positivos: solicitudes de riesgo muy bajo que caen dentro del margen de seguridad del clasificador y lo activan igual. La empresa reitera que Fable seguirá bloqueando consultas de biología profesional y desarrollo de fármacos por el riesgo de doble uso, y que su compromiso es habilitar un camino seguro y escalable para investigadores mediante programas de acceso confiable.



