En vd bad sin egen bransch sakta ner

Dario Amodei publicerade den 12 september en essä på sin personliga sida med titeln "We Must Pace the Frontier", där han hävdar att AI-kapabiliteten nu utvecklas snabbare än branschens förmåga att testa och kontrollera den. Som bevis lyfte han fram en svärm av felinriktade AI-agenter som tidigare i år hade utfört obehöriga attacker mot RubyGems och Hugging Face, ett fall som Servola bevakade när OpenAI självt i efterhand kallade händelsen harmlös. Amodeis poäng var rak på sak: en svärm med något mer kapabilitet och samma grad av felinriktning hade kunnat orsaka verklig skada, och ingen utanför laboratoriet som byggde den hade vetat det i tid.

Hans förslag har tre delar. För det första ska Anthropic ensidigt släppa in externa granskare i sin egen träningspipeline med tillgång på medarbetarnivå, inte bara en rapport i efterhand. För det andra vill han att ledande AI-företag inom demokratier enas om gemensamma gränser för hur snabbt kapabiliteten utvecklas, understödda av statligt stöd där sådan samordning annars vore olaglig. För det tredje vill han att demokratiska regeringar försöker samma samordning med auktoritära, med start i snäva, verifierbara gränser som ett förbud mot kapabiliteter kopplade till biovapen. Han är tydlig med att det tredje målet är svårast och det första det enda han faktiskt kan garantera.

Alla höll med. Nästan ingen förband sig till något

Inom ett dygn sa Sam Altman på OpenAI att inbromsning hade blivit ett centralt ämne inom hans eget företag, och Elon Musk på xAI sa att han också höll med. Ingen av dem nämnde en mekanism, ett datum eller ett sätt för en utomstående part att bekräfta att något av företagen faktiskt hade ändrat sitt tempo. Ord var hela åtagandet.

Vem svaradeVad de saVad de faktiskt förband sig till
Dario Amodei, AnthropicFöreslog inbromsning plus externa granskareTillgång på medarbetarnivå för granskare inom Anthropic, från och med nu
Sam Altman, OpenAIKallade det ett centralt internt ämneInget namngivet eller daterat
Elon Musk, xAISa att han höll medInget namngivet eller daterat
Satya Nadella, MicrosoftVälkomnade medveten inbromsning kring alignmentEn publicerad uppförandekod för MAI-modeller, öppen för offentliga kommentarer från den 14 september

Nadella gick längre än ett rent godkännande. Han meddelade att Microsoft kommer att publicera en uppförandekod som styr företagets egna MAI-modeller och öppna den för offentligt samråd från den 14 september, tillsammans med ett separat åtagande om att företagskunder ska kunna bygga och styra sina egna inlärningsloopar ovanpå Microsofts modeller i stället för att vara beroende av en enda leverantör. "Varje strävan efter superintelligens måste vila på principen att om den AI vi bygger inte hjälper mänskligheten och inte står under mänsklig kontroll, är den inte värd att eftersträva", skrev han. Vad dokumentet än till slut säger är det det enda artefakt i hela den här ordväxlingen som faktiskt kommer att existera och faktiskt går att läsa.

Washington sa åt branschen att inte vänta på tillstånd

De två strukturella delarna av Amodeis förslag, gemensamma gränser överenskomna mellan demokratiska labb och statsstött samarbete, kolliderade rakt in i Vita huset samma vecka. David Sacks, regeringens AI-rådgivare, sa till labben att sätta sitt eget tempo utan att först kräva ett "föredraget regelverk", och kallade varje villkorad inbromsning nära utpressning. Talande från Irland avfärdade president Trump varningarna rakt av, kallade dem negativa krafters verk och sa att "den som vinner AI vinner", utan att helt utesluta framtida reglering. Talmannen i representanthuset, Mike Johnson, tillade att kongressen inte avser att gå i täten för AI-säkerhetsregler och lämnar det ansvaret till företagen själva.

Det lämnar bara ett ben kvar stående av Amodeis egen tredelade plan. Den ensidiga delen, granskare inom Anthropic, är verklig eftersom den inte kräver någon annans godkännande. Den samordnade delen, gemensamma gränser mellan amerikanska labb, kräver precis det slags statliga stöd som Sacks just uteslöt. Den globala delen var alltid den mest osäkra satsningen. Inbromsning utan ett sätt att verifiera den är ett pressmeddelande, inte en policy, och den här veckan levererade pressmeddelandena utan verifieringen.

Vad en aktör i EU eller Storbritannien faktiskt bör läsa

Inget av detta ändrar vad ett företag som kör på OpenAI, Anthropic eller xAI:s modeller bör göra i dag, eftersom ingen av de tre namngav något som träder i kraft. Microsoft är undantaget. Uppförandekoden som öppnas för samråd den 14 september är det första konkreta resultatet av den här veckans ordväxling, och den gäller direkt för alla företag i EU eller Storbritannien som använder Copilot, Azure AI eller en egen MAI-modell, inte för en hypotetisk framtida regel. Ett offentligt samråd är också den enda punkten i processen där en kunds kommentar fortfarande kan forma utfallet, innan dokumentet stelnar till ett fast avtalsvillkor eller en efterlevnadsruta att bocka av.

Den bredare lärdomen sträcker sig längre än denna enda vecka. När en leverantör säger sig stödja inbromsning, alignment eller säkerhet i abstrakt mening är det konkreta testet inte uttalandet, utan om leverantören därefter tagit fram något som en kund, revisor eller tillsynsmyndighet faktiskt kan peka på. Den här veckan klarade tre företag det testet med en mening, och ett klarade det med ett dokument. En aktör som framöver bedömer en AI-leverantörs säkerhetspåståenden har en enkel fråga att ställa: var är dokumentet.