Anthropic herschrijft de regels voor biologievragen
Anthropic maakte deze week bekend dat het de grondregels die de veiligheidsclassifier voor biologie-inhoud van Fable 5 sturen heeft herschreven, feedback van externe experts heeft verzameld, nieuwe trainingsdata heeft opgebouwd en het systeem opnieuw heeft getraind om werkelijk gevaarlijke verzoeken te scheiden van de gewone klinische en educatieve vragen die er tot dusver mee werden meegenomen. Het bedrijf presenteert de wijziging als een precisiecorrectie, niet als een versoepeling van zijn standpunt over de domeinen die het echt gevaarlijk acht: "De kosten van misbruik van Fable in een domein met dubbel gebruik zoals biologie zouden potentieel catastrofaal kunnen zijn", schreef Anthropic, ter verklaring waarom de beperkte domeinen zelf niet zijn veranderd.
Het resultaat is, volgens Anthropics eigen aankondiging, een daling van ongeveer 85% in biologiegerelateerde veiligheidsterugvallen over alle productoppervlakken van Fable 5, al varieert de omvang van de verbetering sterk naargelang waar mensen het model gebruiken: ongeveer 67% minder op Claude.ai, 55% minder op Cowork, 17% minder op Claude Code en 7% minder op het Claude Platform dat door zakelijke ontwikkelaars wordt gebruikt. Anthropic zegt dat de betrokken verzoeken vooral gewone klinische en educatieve taken waren: labresultaten interpreteren, symptomen opzoeken of biologie-onderwerpen verkennen voor een les of een werkstuk.
De domeinen die volledig op slot blijven
Fable 5 weigert nog steeds automatisch een vastgestelde reeks domeinen met dubbel gebruik: virologie, toxicologie en moleculair ontwerp, samen met professionele geneesmiddelenontwikkeling, ongeacht hoe het verzoek is geformuleerd. Anthropic zegt dat verzoeken die deze grens overschrijden in plaats daarvan worden doorgestuurd naar Opus 5, dat het bedrijf omschrijft als "een capabel model dat niet hetzelfde niveau van biologische capaciteit heeft als Fable 5". Deze doorverwijzing is bewust: een algemene assistent die nog steeds nuttig kan zijn voor de onderliggende taak, maar zonder de biologische redeneervaardigheid op het hoogste niveau die een kwaadwillende actor nodig zou hebben voor iets dat dichter bij wapenrelevant werk ligt.
Dat onderscheid verdient aandacht, omdat het ingaat tegen de meest luidruchtige mogelijke misinterpretatie van deze update. Anthropic zegt niet dat zijn AI nu in het algemeen soepeler is met biologie. Het bedrijf zegt het tegenovergestelde: nu precies genoeg om onschuldige biologie van gevaarlijke biologie te onderscheiden, en zeker genoeg van dat onderscheid om de gevaarlijke helft precies op slot te houden waar die al was. Het feit dat slechts sommige domeinen versoepeld zijn terwijl andere volledig op slot bleven, is op zichzelf het teken dat de beperking nooit echt over biologie als onderwerp ging. Het ging altijd om een kleinere reeks vaardigheden die Anthropic bij misbruik als catastrofaal beschouwt, en die reeks is niet veranderd.
Waarom de oude wrijving een reële kost was, geen gerucht
Europese teams in de zorg, biotech en farmacie die Claude het afgelopen jaar hebben gebruikt, zullen het patroon herkennen dat deze update moet oplossen. Een arts die Fable 5 vraagt te helpen bij het interpreteren van een bloedonderzoek, een biotech-onderzoeker die vraagt om een werkingsmechanisme samen te vatten, of een medewerker regulatoire zaken bij een farmaceutisch bedrijf die vraagt om een toxicologische term uit een studie uit te leggen, konden allemaal dezelfde terugval activeren die bedoeld was voor een vraag over biowapens. De omweg binnen veel Europese life-sciences-organisaties was informeel en stilzwijgend: de vraag herformuleren, de klinische terminologie schrappen die het filter activeert, of Claude simpelweg niet meer raadplegen en teruggrijpen naar een zoekmachine of een collega.
Anthropics eigen aankondiging is in feite een erkenning dat deze wrijving reëel was en een kost had voor legitieme gebruikers, geen hypothese van critici. Het bedrijf erkent dat sommige laagrisico-verzoeken de veiligheidsmaatregelen af en toe nog zullen activeren, en zegt de classifier te blijven verfijnen op basis van gebruikersfeedback, wat minder klinkt als een overwinningsronde en meer als een bedrijf dat toegeeft dat zijn eerdere afstelling te grof was voor de manier waarop mensen in gereguleerde sectoren met hoge inzet het instrument daadwerkelijk gebruiken.
De veiligheidsheffing die ook andere AI-labs zullen moeten herijken
Anthropic is niet het enige AI-lab dat is doorgeschoten naar algemene overvoorzichtigheid op gevoelige wetenschappelijke domeinen, en het zal niet het enige zijn dat publiekelijk moet herijken naarmate de adoptiedruk toeneemt. Verwacht dat OpenAI en Google voor dezelfde afweging komen te staan: een brede veiligheidsterugval die een echte vraag over biowapens blokkeert, blokkeert ook een echte oncoloog, en de commerciële druk om dat te verhelpen groeit alleen maar naarmate meer gereguleerde sectoren serieus werk via deze modellen laten lopen. De update van deze week leest het best als de openingszet in een sectorbrede herijking van waar de veiligheidsheffing voor biologie eigenlijk ligt, niet als een eenmalige beslissing van Anthropic.
Anthropic zegt dat een programma voor vertrouwde toegang, dat gescreende onderzoekers zou laten werken met biologische mogelijkheden op het hoogste niveau, zonder de algemene beperking die voor iedereen anders geldt, nog steeds slechts "in ontwikkeling" is. Tot dat er is, blijft het praktische advies voor elke Europese life-sciences-organisatie ongewijzigd: legitieme klinische en onderzoeksvragen zouden nu op veel minder valse weigeringen moeten stuiten, maar alles wat procedureel te maken heeft met virologie, toxicologie of moleculair ontwerp blijft doelbewust doorgestuurd naar een minder krachtig model, en er mag niet worden verwacht dat slimme formuleringen daar iets aan veranderen.
Lees hierna: De crawler blokkeren publiceerde uw gesprekken | Claudes storingen worden pas in 2027 verholpen



