Anthropic actualizó los sistemas de seguridad de Fable 5 para reducir en aproximadamente 85% los bloqueos incorrectos en consultas de biología. El modelo podrá responder más preguntas de salud y educación, aunque seguirá restringido para investigaciones profesionales de uso dual.
Anthropic anunció una actualización de los sistemas de seguridad de Fable 5, su modelo de inteligencia artificial de frontera, que permitirá ampliar significativamente el tipo de consultas relacionadas con biología que puede atender. Según la compañía, el cambio redujo en aproximadamente 85% los bloqueos incorrectos —conocidos como false positives— en consultas de biología.
La actualización apunta a resolver uno de los problemas más complejos para el desarrollo de modelos avanzados de IA aplicados a la ciencia: distinguir entre una solicitud legítima y otra que, aunque pueda parecer similar, podría contribuir a actividades peligrosas.
Hasta ahora, Fable 5 utilizaba clasificadores de seguridad deliberadamente amplios. Cuando el sistema detectaba una consulta relacionada con determinados ámbitos de la biología, podía derivarla automáticamente a Opus 5, un modelo considerado menos capaz en este campo. Ese mecanismo, denominado fallback, buscaba limitar el riesgo de que Fable 5 fuera utilizado para proporcionar asistencia operativa en investigaciones potencialmente dañinas.
Con la nueva actualización, Anthropic asegura que los usuarios experimentarán muchos menos fallbacks. Esto incluye consultas cotidianas relacionadas con salud y educación, como interpretar resultados de laboratorio, comprender síntomas o estudiar conceptos de biología.
También habrá una mayor capacidad de asistencia para profesionales de la salud en determinadas tareas clínicas.
El desafío de la biología de uso dual
Anthropic sostiene que la biología representa una de las áreas con mayor potencial para que la inteligencia artificial tenga un impacto positivo, pero también una de las que presentan mayores riesgos.
Según la compañía, Fable 5 puede superar a expertos en algunas tareas biológicas altamente complejas y proporcionar asistencia operativa en otras. Esa capacidad puede ser utilizada por investigadores que trabajan en nuevos tratamientos médicos, pero también podría ser aprovechada por actores maliciosos.
El problema se vuelve especialmente complejo en investigaciones de uso dual, es decir, aquellas que pueden tener aplicaciones beneficiosas o perjudiciales.
Anthropic utiliza como ejemplo el desarrollo de vacunas y medicamentos. En determinadas investigaciones médicas puede ser necesario trabajar con compuestos o agentes biológicos peligrosos para desarrollar tratamientos contra ellos. La compañía menciona el desarrollo del captopril, utilizado para tratar la hipertensión, como un caso histórico en el que científicos aislaron componentes tóxicos del veneno de serpiente que provocan una fuerte caída de la presión arterial.
Por ese motivo, la empresa afirma que debe evitar que las nuevas capacidades de sus modelos generen riesgos antes de que puedan materializarse sus beneficios científicos.
Cómo funciona el nuevo sistema de seguridad
Los mecanismos de protección de Fable 5 se apoyan en clasificadores de seguridad, sistemas de IA más pequeños diseñados para detectar cuándo un usuario intenta solicitar una capacidad protegida o cuándo el modelo puede estar generando una respuesta potencialmente dañina.
Cuando uno de estos clasificadores se activa, Fable 5 deriva la consulta hacia Opus 5. El objetivo es que el usuario pueda continuar recibiendo asistencia, pero sin acceder al mismo nivel de capacidades biológicas que ofrece Fable 5.
Anthropic reconoce que diseñar estos clasificadores implica encontrar un equilibrio delicado. Si son demasiado restrictivos, bloquean consultas legítimas; si son demasiado permisivos, pueden dejar pasar solicitudes peligrosas.
En el primer lanzamiento de Fable 5, la compañía optó deliberadamente por un clasificador muy amplio. Esa decisión generó una cantidad elevada de falsos positivos, pero permitió poner el modelo a disposición de los usuarios mientras Anthropic continuaba desarrollando mecanismos de seguridad más precisos.
Durante las últimas semanas, la empresa reescribió las reglas utilizadas por el clasificador, incorporando una definición más detallada de los usos permitidos. También solicitó opiniones a expertos internos y externos, desarrolló nuevos datos de entrenamiento, volvió a entrenar el sistema y comprobó que continuara detectando contenidos peligrosos y de uso dual.
El resultado, según Anthropic, es un sistema capaz de diferenciar mejor entre consultas benignas y aquellas que requieren restricciones.
La frontera todavía está cerrada para algunas investigaciones
La actualización no significa que Fable 5 haya quedado completamente habilitado para el trabajo profesional en biología.
Anthropic señala que el modelo todavía deriva a Opus 5 las consultas de uso dual relacionadas con virología, toxicología, diseño molecular y otras áreas sensibles. Por lo tanto, Fable 5 aún no está disponible para determinados trabajos profesionales de investigación biológica y desarrollo de medicamentos.
La compañía asegura que trabaja en mecanismos de acceso controlado que permitan ofrecer a investigadores capacidades más avanzadas sin eliminar las barreras de seguridad.
El desafío incluye además la posibilidad de que usuarios con intenciones maliciosas intenten presentar sus solicitudes como investigaciones científicas legítimas. Anthropic advierte que actores sofisticados pueden explotar precisamente esa frontera ambigua entre una investigación beneficiosa y una aplicación peligrosa.
La empresa cita la Evaluación Anual de Amenazas de 2026 de la Comunidad de Inteligencia de Estados Unidos, que señala que los avances en biotecnología, incluida la biología sintética y la edición genómica, podrían generar nuevas amenazas biológicas.
Un equilibrio entre capacidad y seguridad
Para Anthropic, el objetivo no consiste simplemente en bloquear la mayor cantidad posible de consultas relacionadas con biología. Una política excesivamente restrictiva también impediría que investigadores, médicos, estudiantes y otros usuarios aprovechen las capacidades de un modelo avanzado.
Por eso, la actualización de Fable 5 busca desplazar la frontera de seguridad para permitir un mayor número de consultas benignas, manteniendo bloqueadas aquellas que presentan un riesgo significativo.
La compañía reconoce que el sistema todavía tendrá falsos positivos y que algunas solicitudes de bajo riesgo continuarán siendo bloqueadas como medida de precaución.
La estrategia de Anthropic apunta ahora a desarrollar una vía de acceso más segura y escalable para investigadores que necesiten utilizar las capacidades más avanzadas de Fable 5 en biología.
El objetivo final es resolver una de las tensiones centrales de la IA aplicada a la ciencia: cómo entregar modelos cada vez más capaces a quienes pueden utilizarlos para acelerar descubrimientos médicos sin proporcionar esas mismas capacidades a quienes podrían emplearlas con fines dañinos.

