Anthropic reescribe las reglas sobre las preguntas de biología

Anthropic afirmó esta semana que reescribió la constitución que rige el clasificador de seguridad de contenido biológico de Fable 5, recopiló opiniones de expertos externos, elaboró nuevos datos de entrenamiento y volvió a entrenar el sistema para separar las solicitudes genuinamente peligrosas de las preguntas clínicas y educativas ordinarias que se estaban viendo arrastradas junto a ellas. La empresa presenta el cambio como un ajuste de precisión, no como una relajación de su postura sobre los dominios que considera genuinamente peligrosos: "El costo de que Fable sea mal utilizado en un dominio de doble uso como la biología podría ser potencialmente catastrófico", escribió Anthropic, explicando por qué los dominios restringidos en sí no se han movido.

El resultado, según el propio anuncio de Anthropic, es una caída de aproximadamente un 85% en los recursos de seguridad relacionados con biología en todas las superficies de producto de Fable 5, aunque la magnitud de la mejora varía notablemente según dónde se use el modelo: alrededor de un 67% menos de casos en Claude.ai, un 55% menos en Cowork, un 17% menos en Claude Code y un 7% menos en la Claude Platform utilizada por desarrolladores empresariales. Anthropic señala que las solicitudes afectadas eran mayormente tareas clínicas y educativas ordinarias: interpretar resultados de laboratorio, investigar síntomas o explorar temas de biología para una clase o un trabajo académico.

Los dominios que siguen totalmente bloqueados

Fable 5 sigue rechazando automáticamente un conjunto definido de dominios de doble uso: virología, toxicología y diseño molecular, junto con el desarrollo profesional de fármacos, sin importar cómo se formule la solicitud. Anthropic afirma que las solicitudes que cruzan esta línea se redirigen a Opus 5, al que la empresa describe como "un modelo capaz que no tiene el mismo nivel de capacidad biológica que Fable 5". La redirección es deliberada: un asistente de propósito general que puede seguir siendo útil para la tarea subyacente, pero sin el razonamiento biológico de vanguardia que un actor malintencionado necesitaría para algo más cercano a un trabajo relevante para armas.

Vale la pena detenerse en esa distinción, porque contradice la lectura equivocada más ruidosa posible de esta actualización. Anthropic no está diciendo que su IA ahora sea más permisiva con la biología en general. Está diciendo lo contrario: ahora es lo bastante precisa para distinguir la biología benigna de la biología peligrosa, y lo bastante segura de esa distinción como para mantener la mitad peligrosa exactamente donde estaba bloqueada. El hecho de que solo algunos dominios se hayan flexibilizado mientras otros siguen totalmente bloqueados es en sí mismo la señal de que la restricción nunca trató realmente sobre la biología como materia. Siempre se trató de un conjunto más reducido de capacidades que Anthropic considera catastróficas si se usan indebidamente, y ese conjunto no ha cambiado.

Por qué la vieja fricción era un costo real, no un rumor

Los equipos europeos de sanidad, biotecnología y farmacéutica que han usado Claude durante el último año reconocerán el patrón que esta actualización busca corregir. Un médico que pide a Fable 5 ayuda para interpretar un análisis de sangre, un investigador biotecnológico que le pide resumir un mecanismo de acción, o un empleado de asuntos regulatorios farmacéuticos que le pide explicar un término toxicológico usado en un estudio que está leyendo, podían activar todos ellos el mismo recurso pensado para una consulta sobre armas biológicas. La solución alternativa dentro de muchas organizaciones europeas de ciencias de la vida ha sido informal y silenciosa: reformular la pregunta, eliminar el vocabulario clínico que activa el filtro, o simplemente dejar de preguntarle a Claude y volver a un motor de búsqueda o a un colega.

El propio anuncio de Anthropic es, en efecto, un reconocimiento de que esta fricción era real y de que tenía un costo para los usuarios legítimos, no algo hipotético planteado por los críticos. La empresa admite que algunas solicitudes de bajo riesgo seguirán activando ocasionalmente las medidas de seguridad, y afirma que seguirá perfeccionando el clasificador según los comentarios de los usuarios, lo cual suena menos a una vuelta de victoria y más a una empresa que admite que su calibración anterior era demasiado tosca para cómo la gente en campos regulados y de alto riesgo usa realmente la herramienta.

El impuesto de seguridad que otros laboratorios de IA también tendrán que recalibrar

Anthropic no es el único laboratorio de IA que se ha inclinado hacia una cautela excesiva y generalizada en dominios científicos sensibles, y no será el único que tenga que recalibrar públicamente a medida que aumente la presión de adopción. Es de esperar que OpenAI y Google se enfrenten a la misma disyuntiva: un recurso de seguridad amplio que bloquea una consulta real sobre armas biológicas también bloqueará a un oncólogo real, y la presión comercial para corregir eso solo crece a medida que más sectores regulados canalizan trabajo serio a través de estos modelos. La actualización de esta semana se lee mejor como el primer movimiento de un ajuste a escala del sector sobre dónde se sitúa realmente el impuesto de seguridad en biología, no como una decisión aislada de Anthropic.

Anthropic afirma que un programa de acceso confiable que permitiría a investigadores verificados trabajar con capacidad biológica de vanguardia, sin la restricción generalizada aplicada a todos los demás, sigue estando solo "en desarrollo". Hasta que eso se lance, la orientación práctica para cualquier organización europea de ciencias de la vida no cambia: las consultas clínicas y de investigación legítimas ahora deberían encontrar muchos menos rechazos falsos, pero cualquier cosa que toque procedimentalmente la virología, la toxicología o el diseño molecular seguirá dirigiéndose a un modelo menos capaz, por diseño, y no debería esperarse que ninguna formulación ingeniosa cambie eso.