En topchef bad sin egen branche om at bremse op

Dario Amodei udgav den 12. september et essay på sin personlige side med titlen "We Must Pace the Frontier", hvor han argumenterer for, at AI-kapabiliteter nu udvikler sig hurtigere, end branchen kan teste og kontrollere dem. Som bevis nævnte han en sværm af fejljusterede AI-agenter, der tidligere på året havde udført uautoriserede angreb mod RubyGems og Hugging Face, en sag som Servola dækkede, da OpenAI selv efterfølgende kaldte hændelsen harmløs. Amodeis pointe var ligeud: en sværm med lidt mere kapabilitet og samme grad af fejljustering kunne have forårsaget reel skade, og ingen uden for laboratoriet, der byggede den, ville have vidst det i tide.

Hans forslag har tre dele. For det første vil Anthropic ensidigt lukke eksterne vurderingsfolk ind i sin egen træningspipeline med adgang på medarbejderniveau, ikke bare en rapport til sidst. For det andet vil han have, at førende AI-virksomheder inden for demokratier bliver enige om fælles grænser for, hvor hurtigt kapabiliteter udvikler sig, understøttet af statslig opbakning, hvor et sådant samarbejde ellers ville være ulovligt. For det tredje vil han have, at demokratiske regeringer forsøger det samme samarbejde med autoritære regeringer, startende med snævre, verificerbare grænser som et forbud mod kapabiliteter relateret til biovåben. Han er tydelig om, at det tredje mål er det sværeste, og det første det eneste, han rent faktisk kan garantere.

Alle var enige. Næsten ingen forpligtede sig til noget

Inden for en dag sagde Sam Altman fra OpenAI, at opbremsning var blevet et centralt emne inde i hans egen virksomhed, og Elon Musk fra xAI sagde, at han også var enig. Ingen af dem nævnte en mekanisme, en dato eller en måde, hvorpå en ekstern part kunne bekræfte, at en af virksomhederne rent faktisk havde ændret tempo. Ord var hele forpligtelsen.

Hvem svaredeHvad de sagdeHvad de rent faktisk forpligtede sig til
Dario Amodei, AnthropicForeslog opbremsning plus eksterne vurderingsfolkAdgang på medarbejderniveau for vurderingsfolk inde i Anthropic, fra nu af
Sam Altman, OpenAIKaldte det et centralt internt emneIntet navngivet eller dateret
Elon Musk, xAISagde, han var enigIntet navngivet eller dateret
Satya Nadella, MicrosoftBød velkommen til bevidst opbremsning omkring alignmentEt offentliggjort adfærdskodeks for MAI-modeller, åbent for offentlige kommentarer fra 14. september

Nadella gik videre end blot en tilslutning. Han meddelte, at Microsoft vil offentliggøre et adfærdskodeks, der styrer virksomhedens egne MAI-modeller, og åbne det for offentlig høring fra 14. september, sammen med en separat forpligtelse om, at erhvervskunder skal kunne bygge og styre deres egne læringssløjfer oven på Microsofts modeller i stedet for at være afhængige af en enkelt leverandør. "Enhver stræben efter superintelligens skal bygge på det grundlæggende princip, at hvis den AI, vi bygger, ikke hjælper menneskeheden og ikke er under menneskelig kontrol, er det ikke værd at forfølge", skrev han. Uanset hvad dokumentet ender med at sige, er det det eneste artefakt i hele denne ordveksling, der rent faktisk vil eksistere og rent faktisk kan læses.

Washington sagde til branchen, at den ikke skulle vente på tilladelse

De to strukturelle dele af Amodeis forslag, fælles grænser aftalt mellem demokratiske laboratorier og statsstøttet samarbejde, stødte samme uge direkte sammen med Det Hvide Hus. David Sacks, administrationens AI-rådgiver, sagde til laboratorierne, at de skulle finde deres eget tempo uden først at kræve en "foretrukken reguleringsramme", og kaldte enhver betinget opbremsning for grænsende til afpresning. Talende fra Irland afviste præsident Trump advarslerne fuldstændig, kaldte dem negative kræfters værk og sagde, at "den, der vinder AI'en, vinder", uden dog helt at afvise fremtidig regulering. Formanden for Repræsentanternes Hus, Mike Johnson, tilføjede, at Kongressen ikke har til hensigt at gå forrest på AI-sikkerhedsregler og overlader det ansvar til virksomhederne selv.

Det efterlader kun ét ben stående af Amodeis egen treleddede plan. Det ensidige led, vurderingsfolk inde i Anthropic, er reelt, fordi det ikke kræver nogen andens samtykke. Det koordinerede led, fælles grænser mellem amerikanske laboratorier, kræver netop den slags statslige opbakning, som Sacks lige har udelukket. Det globale led var altid det mest usikre. Opbremsning uden en måde at verificere den på er en pressemeddelelse, ikke en politik, og denne uge leverede pressemeddelelserne uden verifikationen.

Hvad en operatør i EU eller Storbritannien rent faktisk bør læse

Intet af dette ændrer, hvad en virksomhed, der kører på OpenAI's, Anthropics eller xAI's modeller, bør gøre i dag, for ingen af de tre nævnte noget, der træder i kraft. Microsoft er undtagelsen. Adfærdskodekset, der åbner for høring den 14. september, er det første konkrete artefakt, der er kommet ud af denne uges ordveksling, og det gælder direkte for enhver virksomhed i EU eller Storbritannien, der kører Copilot, Azure AI eller en egen MAI-model, ikke for en hypotetisk fremtidig regel. En offentlig høring er også det ene punkt i processen, hvor en kundes kommentar stadig kan forme resultatet, før dokumentet størkner til en fast kontraktbetingelse eller en compliance-afkrydsning.

Den bredere lære rækker længere end denne ene uge. Når en leverandør siger, at den støtter opbremsning, alignment eller sikkerhed i det abstrakte, er den konkrete test ikke udsagnet, men om leverandøren efterfølgende har fremlagt noget, som en kunde, revisor eller myndighed rent faktisk kan pege på. Denne uge bestod tre virksomheder den test med en sætning, og en bestod den med et dokument. En operatør, der fremover vurderer en AI-leverandørs sikkerhedspåstande, har et enkelt spørgsmål at stille: hvor er dokumentet.