Anthropic skriver om reglerna för biologifrågor
Anthropic uppgav denna vecka att företaget har skrivit om den grundkonstitution som styr Fable 5:s säkerhetsklassificerare för biologiskt innehåll, samlat in återkoppling från externa experter, byggt ny träningsdata och tränat om systemet för att skilja verkligt farliga förfrågningar från de vanliga kliniska och pedagogiska frågor som tidigare fångades upp tillsammans med dem. Företaget beskriver ändringen som en precisionsjustering, inte en uppmjukning av sin hållning till de domäner det anser vara verkligt farliga: "Kostnaden för att Fable missbrukas inom en domän med dubbla användningsområden som biologi skulle potentiellt kunna vara katastrofal", skrev Anthropic och förklarade varför de begränsade domänerna i sig inte har ändrats.
Resultatet är, enligt Anthropics eget tillkännagivande, en minskning på omkring 85% av biologirelaterade säkerhetsfallbacker över Fable 5:s samtliga produktytor, även om förbättringens storlek varierar kraftigt beroende på var modellen används: omkring 67% färre på Claude.ai, 55% färre på Cowork, 17% färre på Claude Code och 7% färre på Claude Platform som används av företagsutvecklare. Anthropic säger att de berörda förfrågningarna mestadels var vanliga kliniska och pedagogiska uppgifter: att tolka labbresultat, undersöka symtom eller utforska biologiämnen för en lektion eller en uppsats.
Domänerna som förblir helt spärrade
Fable 5 avvisar fortfarande automatiskt en definierad uppsättning domäner med dubbla användningsområden: virologi, toxikologi och molekylär design, tillsammans med läkemedelsutveckling på professionell nivå, oavsett hur förfrågan formuleras. Anthropic säger att förfrågningar som passerar denna gräns istället omdirigeras till Opus 5, som företaget beskriver som "en kapabel modell som inte har samma nivå av biologisk kapacitet som Fable 5". Omdirigeringen är avsiktlig: en generell assistent som fortfarande kan vara användbar för den underliggande uppgiften, men utan det biologiska resonemang i frontlinjen som en illasinnad aktör skulle behöva för något närmare vapenrelevant arbete.
Den distinktionen är värd att dröja vid, eftersom den motsäger den mest högljudda tänkbara feltolkningen av denna uppdatering. Anthropic säger inte att dess AI nu generellt är mer tillåtande mot biologi. Företaget säger motsatsen: nu tillräckligt precis för att skilja oskyldig biologi från farlig biologi, och tillräckligt säker på den distinktionen för att hålla den farliga halvan spärrad exakt där den var. Att endast vissa domäner har mjukats upp medan andra förblivit helt spärrade är i sig ett tecken på att begränsningen aldrig egentligen handlade om biologi som ämne. Den handlade alltid om en snävare uppsättning förmågor som Anthropic betraktar som katastrofala vid missbruk, och den uppsättningen har inte ändrats.
Varför den gamla friktionen var en verklig kostnad, inte ett rykte
Europeiska team inom vård, bioteknik och läkemedel som har använt Claude under det senaste året kommer att känna igen mönstret som denna uppdatering är avsedd att åtgärda. En kliniker som ber Fable 5 hjälpa till att tolka ett blodprov, en biotekforskare som ber den sammanfatta en verkningsmekanism, eller en anställd inom regulatoriska frågor på ett läkemedelsföretag som ber den förklara en toxikologisk term som används i en studie hen läser, kunde alla utlösa samma fallback avsedd för en fråga om biovapen. Kringgåendet inom många europeiska life science-organisationer har varit informellt och tyst: omformulera frågan, ta bort det kliniska ordförråd som utlöser filtret, eller helt enkelt sluta fråga Claude och gå tillbaka till en sökmotor eller en kollega.
Anthropics eget tillkännagivande är i praktiken ett erkännande av att denna friktion var verklig och att den innebar en kostnad för legitima användare, inte en hypotetisk fråga som lyfts av kritiker. Företaget medger att vissa lågriskförfrågningar fortfarande då och då kommer att utlösa säkerhetsåtgärderna, och säger att det kommer att fortsätta förfina klassificeraren baserat på användaråterkoppling, vilket låter mindre som ett segervarv och mer som ett företag som erkänner att dess tidigare kalibrering var för grov för hur människor inom reglerade branscher med höga insatser faktiskt använder verktyget.
Säkerhetsavgiften som även andra AI-labb måste omkalibrera
Anthropic är inte det enda AI-labbet som lutat åt generell överförsiktighet inom känsliga vetenskapliga domäner, och det blir inte det enda som offentligt måste omkalibrera i takt med att adoptionstrycket ökar. Man kan förvänta sig att OpenAI och Google ställs inför exakt samma avvägning: en bred säkerhetsfallback som blockerar en verklig fråga om biovapen kommer också att blockera en verklig onkolog, och det kommersiella trycket att åtgärda det växer bara i takt med att fler reglerade branscher låter allvarligt arbete gå genom dessa modeller. Veckans uppdatering läses bäst som det första draget i en branschomfattande omprövning av var biologins säkerhetsavgift egentligen ligger, inte som ett enskilt beslut från Anthropic.
Anthropic säger att ett program för betrodd åtkomst, som skulle låta granskade forskare arbeta med biologisk kapacitet i frontlinjen utan den generella begränsning som gäller för alla andra, fortfarande bara är "under utveckling". Tills dess är den praktiska vägledningen för alla europeiska life science-organisationer oförändrad: legitima kliniska förfrågningar och forskningsförfrågningar bör nu möta betydligt färre felaktiga avslag, men allt som procedurmässigt rör virologi, toxikologi eller molekylär design kommer fortfarande att dirigeras till en mindre kapabel modell, med avsikt, och ingen mängd smart formulering bör förväntas ändra på det.
Läs vidare: Att blockera roboten publicerade era samtal | Claudes avbrott åtgärdas först 2027



