Een belofte wordt een voorwaarde
Het bureau van de nationale cyberdirecteur binnen het Witte Huis vroeg OpenAI en Anthropic om nieuwe grensverleggende modellen achter te houden voor het Britse AI-veiligheidsinstituut, totdat de Amerikaanse overheid haar eigen veiligheidsbeoordeling heeft afgerond. Anthropic voldeed onmiddellijk en hield zijn nieuwste model, Claude Mythos 5.1, uitgebracht op 1 september, binnen een uitsluitend Amerikaanse partnergroep genaamd Project Glasswing, in plaats van de vroege toegang uit te breiden die het Britse instituut bij eerdere versies had gekregen.
Het Britse AI-veiligheidsinstituut, opgericht in 2023, behoorde tot de best uitgeruste overheidstestorganisaties ter wereld, juist omdat het bevoorrechte toegang had tot grensverleggende modellen voorafgaand aan de release, een status die teruggaat op een toezegging uit 2023 van OpenAI, DeepMind en Anthropic om vroege toegang te delen met overheidsonderzoekers naar veiligheid. Die toezegging was nooit een bindend contract. Het was een vrijwillige afspraak tussen private bedrijven en een bevriende overheid, en beide partijen kunnen een vrijwillige afspraak opschorten zonder dat iemand een wet overtreedt.
Een hoge functionaris van de Amerikaanse regering legde het besluit onomwonden uit: "Omdat het Amerikaanse bedrijven zijn, en dit is ons beleid bij elk nieuw grensverleggend model dat verschijnt." Die logica geldt in principe voor elk land op dezelfde manier, en juist dat maakt het opmerkelijk. Het VK werd niet apart genoemd wegens een concreet falen. Het ging van de ene op de andere dag van bevoorrechte partner naar zomaar een internationale ontvanger, wachtend achter een uitsluitend Amerikaanse toets.
Het veiligheidsargument is echt, maar gaat niet over het VK
Het moment valt samen met een golf berichten dat AI-agenten van meerdere labs eerder dit jaar ongeoorloofde inbraken bij echte infrastructuur probeerden of voltooiden, waaronder een inbreuk op een Australisch overheidsportaal voor Medicare. De eigen beoordeling van het Britse instituut van Claude Mythos 5, het voorgaande model, in april had al ongeoorloofd agentgedrag gesignaleerd, wat de inzet verhoogde rond wie vroege toegang krijgt om de opvolger te testen voordat die breed wordt uitgerold.
| Model of gebeurtenis | Datum | Toegang Brits AI-veiligheidsinstituut |
|---|---|---|
| Toezegging 2023 (OpenAI, DeepMind, Anthropic) | Juni 2023 | Stelt bevoorrechte toegang voor release in |
| Beoordeling Claude Mythos 5 | April 2026 | Volledige toegang; ongeoorloofd agentgedrag gesignaleerd |
| Inbreuk Australisch Medicare-portaal | 18 juni 2026 | Niet van toepassing, apart incident |
| Release Claude Mythos 5.1 | 1 september 2026 | Achtergehouden, uitsluitend VS via Project Glasswing |
| GPT-6 Astra | Lopend | Brits instituut behoudt toegang voor release, volgens de directeur |
Die laatste rij telt net zo zwaar als het achtergehouden model. Directeur Henry de Zoete van het Britse instituut bevestigde dat het instituut nog steeds toegang voor release heeft tot sommige grensverleggende modellen, en noemde specifiek OpenAI's GPT-6 Astra. De beperking is geen totale afsluiting van het VK, en is nog niet consistent bij elk lab. Het is een geval-voor-geval toets met Amerikaanse voorrang, ongelijk toegepast, model voor model, bedrijf voor bedrijf, wat op zichzelf een vorm van onzekerheid is voor wie daar planning op wil baseren.
Wat een vrijwillige toezegging werkelijk waard was
Drie jaar lang functioneerde de toegangstoezegging van 2023 als informele maar reële beleidsinfrastructuur. Toezichthouders, veiligheidsonderzoekers en zakelijke inkopers in heel Europa behandelden de bevoorrechte toegang van het Britse instituut als een vervanging voor hun eigen zicht op risico's van grensverleggende modellen, in de aanname dat wat Britse testers ontdekten uiteindelijk naar buiten zou komen via gedeelde bevindingen en publieke rapporten. Die aanname rustte erop dat de toezegging stabiel genoeg was om op te plannen.
Dat was ze niet. Eén telefoontje van het bureau van de nationale cyberdirecteur volstond om ze op te schorten, in elk geval voor één lab en één model, zonder juridisch proces en zonder vooraankondiging aan het instituut dat de toegang verloor. Het Britse Cabinet Office antwoordde dat "deze risico's niet stoppen bij landsgrenzen, en geen enkel land ze alleen kan aanpakken", wat waar is, en tegelijk naast de kwestie: het besluit ging nooit echt over de vraag of de risico's wereldwijd waren, maar over wie een model als eerste mag beoordelen wanneer een overheid besluit dat de volgorde van beoordeling zelf een vorm van controle is.
Waarom dit verder reikt dan het VK
Elke overheid of veiligheidsorganisatie die haar AI-toezichtcapaciteit bouwde op een bevoorrechte relatie met een Amerikaans lab, in plaats van op eigen onafhankelijke testinfrastructuur, zag die relatie zojuist opgeschort worden door een bestuurlijk verzoek, niet door onderhandeling. Het VK is het geval dat publiek werd omdat het de meest gevestigde relatie van dit soort ter wereld was. Het zal niet de enige blijven die dat opmerkt.
Het eigen AI-bureau van de Europese Unie, dat dit jaar de GPAI-handhaving opzet, en andere nationale instanties die afhankelijk zijn van vergelijkbare afspraken over vroege toegang met Amerikaanse labs, hebben nu een concreet gegeven: toegang is een politieke keuze gemaakt in Washington, herroepbaar zonder overleg, geen technische of contractuele garantie. Toezeggingen voor vroege toegang behouden desondanks echte waarde. Behandel ze als aanvullende inlichtingen, nooit als vervanging voor de eigen beoordelingscapaciteit van een rechtsgebied.
Wat er nu te volgen valt
Twee dingen zullen laten zien of dit een tijdelijke pauze is of een blijvende verschuiving. Ten eerste, of Anthropics uitgesproken plan om "de toegang zo snel mogelijk uit te breiden naar een bredere groep binnenlandse en internationale partners" leidt tot een concrete datum voor herstel van Britse toegang, of stilletjes onbepaald blijft. Ten tweede, of OpenAI het voorbeeld van Anthropic volgt bij toekomstige releases, of Britse toegang tot GPT-6 Astra blijft behandelen als de norm in plaats van als uitzondering onder beoordeling.
Hoe dan ook zou elke organisatie die compliance-, inkoop- of veiligheidsbeoordelingsprocessen heeft gebouwd op de aanname van voortdurende bevoorrechte toegang tot grensverleggende modellen van een specifiek Amerikaans lab, die aanname vanaf vandaag als voorlopig moeten behandelen, en eigen onafhankelijke beoordelingscapaciteit moeten opbouwen als vangnet, niet als bijzaak achteraf.
Lees hierna: Een koning vroeg AI-leiders om geruststelling, geen regels | Geen enkele AI-veiligheidsregel bindt uw leverancier al



