Anthropic reduce en 85% los bloqueos biológicos de Fable 5

Anthropic reduce en 85% los bloqueos biológicos de Fable 5

Anthropic reduce cerca de 85% los bloqueos biológicos de Fable 5, pero mantiene límites para investigación.

Por Humberto Toledo el 7 de agosto del 2026 a las 1:39 pm PDT

✨︎ Resumen (TL;DR):

  • Anthropic reescribió el clasificador de biología de Claude Fable 5 y reportó una caída cercana a 85% en los reenvíos automáticos por ese tema.
  • El total de reenvíos por cualquier motivo bajó alrededor de 67% en Claude.ai, 55% en Cowork, 17% en Claude Code y 7% en Claude Platform.
  • Virología, toxicología y diseño molecular siguen desviándose a Opus 5, así que Fable 5 todavía no sirve para investigación biológica profesional ni desarrollo de fármacos.

Anthropic reescribió el clasificador de biología de Claude Fable 5 y publicó el 7 de agosto de 2026 que, según sus propias pruebas, los reenvíos automáticos por consultas biológicas bajaron cerca de 85%. El ajuste busca que las preguntas de salud y educación encuentren menos bloqueos, pero mantiene los desvíos de virología, toxicología y diseño molecular hacia Opus 5.

Fallback es un mecanismo de seguridad que reenvía automáticamente una consulta desde Fable 5 hacia un modelo menos capaz cuando un clasificador detecta que la pregunta entra en una zona restringida. El usuario recibe un aviso cada vez que ocurre.

Fable 5 llegó el 9 de junio de 2026 con casi todas las consultas de biología bloqueadas a propósito. Anthropic describió entonces esa decisión como el costo de sacar el modelo semanas o meses antes de contar con controles finos.

La versión inicial también tenía clasificadores para ciberseguridad, biología, química y destilación.

Satya Nadella explota contra los filtros de Claude Fable 5
Te podría interesar:
Satya Nadella explota contra los filtros de Claude Fable 5
Dos hombres están bajo un cielo nocturno melancólico con nubes oscuras, iluminados por una luz azul fría y una luz roja cálida.
Foto: Nurlan Tortbayev / Pexels

Menos desvíos en Claude.ai, pero no en toda la plataforma

El anuncio separa dos mediciones. La caída cercana a 85% corresponde a los fallbacks activados por biología en todas las superficies de producto. La reducción total, que suma los reenvíos por biología y por cualquier otra causa, quedó así:

  • Claude.ai: alrededor de 67%.
  • Cowork: 55%.
  • Claude Code: 17%.
  • Claude Platform, la API para desarrolladores: 7%.

La diferencia permite estimar cuánto pesaba la biología en cada superficie. Si ese filtro bajó cerca de 85% y el total de Claude.ai cayó 67%, el cálculo indica que la biología explicaba aproximadamente cuatro de cada cinco reenvíos allí.

En Claude Platform, la proporción sería de alrededor de uno de cada doce. Ambas aproximaciones parten de que las reducciones se midieron sobre la misma base, así que no son un desglose publicado directamente por Anthropic.

El orden de magnitud sí cambia la lectura para quien usa la API: sus reenvíos casi nunca eran biológicos, por lo que seguirá encontrando frenos parecidos. Los clasificadores de ciberseguridad y destilación quedaron intactos.

Salud y educación ganan margen

Anthropic menciona cuatro usos que deberían tropezar menos con el filtro:

  • Interpretar resultados de laboratorio.
  • Entender síntomas.
  • Aprender biología en un contexto educativo.
  • Dar más apoyo a profesionales de la salud en tareas clínicas.

La compañía presenta esos cambios como un beneficio para el usuario, no como un aval médico. Para una persona que estudia o intenta comprender un resultado, la conversación debería llegar con menos frecuencia al modelo de respaldo.

La frontera sigue en la biología de doble uso

Las consultas de virología, toxicología y diseño molecular siguen desviándose a Opus 5. La propia Anthropic reconoce que Fable 5 “todavía no es utilizable para investigación biológica profesional y desarrollo de fármacos”.

Son áreas de doble uso: la misma información puede ayudar a tratar una enfermedad o a causar daño. Anthropic pone dos ejemplos. Las vacunas vivas obligan a cultivar el mismo patógeno que se quiere prevenir; el captopril, un antihipertensivo, surgió de aislar los componentes tóxicos del veneno de serpiente que reducen la presión arterial.

El anuncio también cita la Evaluación Anual de Amenazas de 2026 de la comunidad de inteligencia de Estados Unidos, que advierte que los avances en biología sintética y edición genómica “podrían dar lugar a nuevas amenazas biológicas”.

Anthropic advierte que seguirán existiendo falsos positivos. El clasificador conserva un margen de seguridad que puede bloquear por precaución incluso una consulta de riesgo muy bajo. Virología, toxicología y diseño molecular siguen enviándose a Opus 5.

Reescribir las reglas tomó varias semanas

El trabajo técnico tomó varias semanas. Anthropic reescribió la constitución del clasificador, es decir, el conjunto de reglas con el que ese modelo pequeño distingue lo permitido de lo restringido.

La empresa pidió opinión a expertos internos y externos, generó nuevos datos de entrenamiento con esas reglas, reentrenó el clasificador y comprobó que siguiera activándose ante contenido dañino.

El proceso es costoso y no es la única vía. El texto señala que Mistral liberó, tres días antes del anuncio, una herramienta que persigue el mismo objetivo por la vía contraria.

El 85% proviene de las pruebas de Anthropic

La cifra proviene de las pruebas de la propia Anthropic. RuntimeWire señaló que el anuncio no publica el tamaño de la muestra, el conjunto de prueba, la distribución de prompts ni la tasa de falsos negativos detrás de ese porcentaje.

Ese último dato es el que más importa para evaluar el ajuste. Recortar falsos positivos solo sirve si el clasificador nuevo sigue atrapando el contenido peligroso.

Anthropic dice haberlo verificado, pero no detalla con qué frecuencia se le escapa algo, cómo resiste intentos deliberados de evasión ni si una entidad ajena a la empresa revisó el sistema nuevo.

La discusión sobre quién audita estas mediciones tampoco tiene un árbitro público. Hace unos días se supo que la Casa Blanca no publicará su marco para evaluar modelos de IA.

El destino del fallback cambió de Opus 4.8 a Opus 5

Hay un detalle que cambia la comparación con el lanzamiento. En junio, el destino del reenvío era Opus 4.8; el texto publicado el 7 de agosto describe el mismo mecanismo apuntando a Opus 5.

El costo de activar el filtro ya no es el de hace dos meses, aunque Opus 5 siga un escalón por debajo de Fable.

Para investigación profesional, la espera continúa

El cambio reduce los tropiezos en consultas cotidianas de salud, educación y tareas clínicas. No resuelve la falta de acceso para investigación biológica profesional ni para desarrollo de fármacos.

Anthropic promete cerrar esa brecha con programas de acceso confiable, pero todavía no define los requisitos de elegibilidad ni el calendario de solicitudes.

En las próximas semanas, la experiencia real de los usuarios permitirá contrastar las cifras del anuncio. Para el trabajo biológico profesional, la decisión sigue pendiente: Anthropic aún no ha dicho quién podrá solicitar ese acceso ni cuándo.

Fuentes: 1, 2, 3, 4

+ Temas Relacionados

Más de AI

Feed