Anthropic omskriver reglerne for biologispørgsmål
Anthropic oplyste i denne uge, at virksomheden har omskrevet den forfatning, der styrer sikkerhedsklassifikatoren for biologisk indhold i Fable 5, indsamlet feedback fra eksterne eksperter, opbygget nye træningsdata og genoptrænet systemet til at adskille reelt farlige forespørgsler fra de almindelige kliniske og uddannelsesmæssige spørgsmål, der tidligere blev fanget sammen med dem. Virksomheden fremstiller ændringen som en præcisionsjustering, ikke som en lempelse af sin holdning til de domæner, den anser for reelt farlige: "Omkostningen ved, at Fable bliver misbrugt i et domæne med dobbelt anvendelse som biologi, kunne potentielt være katastrofal", skrev Anthropic og forklarede dermed, hvorfor de begrænsede domæner selv ikke har ændret sig.
Resultatet er ifølge Anthropics egen meddelelse et fald på omkring 85% i biologirelaterede sikkerhedsfallbacks på tværs af Fable 5's produktflader, selvom omfanget af forbedringen varierer kraftigt afhængigt af, hvor modellen bruges: omkring 67% færre på Claude.ai, 55% færre på Cowork, 17% færre på Claude Code og 7% færre på Claude Platform, som bruges af virksomhedsudviklere. Anthropic siger, at de berørte forespørgsler for det meste var almindelige kliniske og uddannelsesmæssige opgaver: fortolkning af prøvesvar, research om symptomer eller udforskning af biologiemner til undervisning eller en opgave.
De domæner, der forbliver helt spærret
Fable 5 afviser fortsat automatisk et defineret sæt af domæner med dobbelt anvendelse: virologi, toksikologi og molekylært design, sammen med lægemiddeludvikling på professionelt niveau, uanset hvordan forespørgslen er formuleret. Anthropic siger, at forespørgsler, der overskrider denne grænse, i stedet omdirigeres til Opus 5, som virksomheden beskriver som "en kapabel model, der ikke har samme niveau af biologisk kapacitet som Fable 5". Omdirigeringen er bevidst: en generel assistent, der stadig kan være nyttig til den underliggende opgave, men uden den biologiske ræsonnementsevne i verdensklasse, som en ondsindet aktør ville have brug for til noget tættere på våbenrelevant arbejde.
Denne skelnen er værd at hæfte sig ved, fordi den modsiger den mest højlydte mulige fejllæsning af denne opdatering. Anthropic siger ikke, at virksomhedens AI generelt er blevet mere tilladende over for biologi. Den siger det modsatte: nu præcis nok til at skelne uskadelig biologi fra farlig biologi, og sikker nok i den skelnen til at holde den farlige halvdel spærret præcis dér, hvor den var. Det forhold, at kun nogle domæner er blevet lempet, mens andre forbliver helt spærret, er i sig selv beviset på, at begrænsningen aldrig reelt handlede om biologi som fag. Den handlede altid om et snævrere sæt af kapaciteter, som Anthropic anser for katastrofale ved misbrug, og det sæt har ikke ændret sig.
Hvorfor den gamle friktion var en reel omkostning, ikke et rygte
Europæiske teams inden for sundhed, bioteknologi og medicinalindustri, der har brugt Claude gennem det seneste år, vil genkende det mønster, denne opdatering skal rette op på. En kliniker, der beder Fable 5 om hjælp til at fortolke en blodprøve, en biotekforsker, der beder den om at opsummere en virkningsmekanisme, eller en medarbejder inden for regulatoriske forhold i medicinalindustrien, der beder den om at forklare et toksikologisk udtryk brugt i et studie, kunne alle udløse den samme fallback, der var beregnet på en forespørgsel om biovåben. Omvejen inden for mange europæiske life science-organisationer har været uformel og stille: omformulere spørgsmålet, fjerne det kliniske ordforråd, der udløser filteret, eller simpelthen holde op med at spørge Claude og gå tilbage til en søgemaskine eller en kollega.
Anthropics egen meddelelse er reelt en indrømmelse af, at denne friktion var reel, og at den havde en omkostning for legitime brugere, ikke en hypotetisk problemstilling rejst af kritikere. Virksomheden anerkender, at nogle lavrisikoforespørgsler lejlighedsvis stadig vil udløse sikkerhedsforanstaltningerne, og siger, at den vil fortsætte med at forfine klassifikatoren baseret på brugerfeedback, hvilket lyder mindre som en sejrsrunde og mere som en virksomhed, der indrømmer, at dens tidligere kalibrering var for grov til den måde, folk i regulerede brancher med høj risiko faktisk bruger værktøjet på.
Sikkerhedsafgiften, som andre AI-laboratorier også bliver nødt til at rekalibrere
Anthropic er ikke det eneste AI-laboratorium, der har hældt mod generel overforsigtighed på følsomme videnskabelige domæner, og det bliver ikke det eneste, der offentligt må rekalibrere, efterhånden som presset for at tage teknologien i brug vokser. Man må forvente, at OpenAI og Google står over for præcis den samme afvejning: en bred sikkerhedsfallback, der blokerer en reel forespørgsel om biovåben, vil også blokere en reel onkolog, og det kommercielle pres for at rette op på det vokser kun, efterhånden som flere regulerede brancher lader alvorligt arbejde gå gennem disse modeller. Denne uges opdatering læses bedst som det første træk i et branchebredt opgør med, hvor biologiens sikkerhedsafgift reelt ligger, ikke som en enkeltstående beslutning fra Anthropic.
Anthropic siger, at et program for betroet adgang, der ville lade godkendte forskere arbejde med biologisk kapacitet i verdensklasse uden den generelle begrænsning, der gælder for alle andre, stadig kun er "under udvikling". Indtil det lanceres, er den praktiske vejledning for enhver europæisk life science-organisation uændret: legitime kliniske forespørgsler og forskningsforespørgsler bør nu møde langt færre falske afvisninger, men alt, der proceduremæssigt berører virologi, toksikologi eller molekylært design, vil fortsat blive sendt til en mindre kapabel model, med vilje, og ingen mængde snedig formulering bør forventes at ændre på det.
Læs videre: At blokere crawleren offentliggjorde dine samtaler | Claudes nedbrud bliver først rettet i 2027



