Zobowiązanie staje się warunkowe

Biuro krajowego dyrektora ds. cyberbezpieczeństwa przy Białym Domu poprosiło OpenAI i Anthropic o wstrzymanie nowych flagowych modeli dla brytyjskiego Instytutu Bezpieczeństwa AI, dopóki rząd USA nie zakończy własnego przeglądu bezpieczeństwa. Anthropic dostosował się natychmiast, zatrzymując swój najnowszy model, Claude Mythos 5.1, wydany 1 września, w wyłącznie amerykańskiej grupie partnerskiej o nazwie Project Glasswing, zamiast rozszerzyć wczesny dostęp, jaki brytyjski instytut otrzymywał przy poprzednich wersjach.

Brytyjski Instytut Bezpieczeństwa AI, powstały w 2023 roku, należał do najlepiej wyposażonych państwowych organów testujących na świecie właśnie dlatego, że miał uprzywilejowany dostęp do flagowych modeli przed premierą, status wywodzący się z zobowiązania z 2023 roku podjętego przez OpenAI, DeepMind i Anthropic, by dzielić się wczesnym dostępem z rządowymi badaczami bezpieczeństwa. To zobowiązanie nigdy nie było wiążącą umową. Było dobrowolnym porozumieniem między prywatnymi firmami a sprzymierzonym rządem, a każda ze stron może zawiesić dobrowolne porozumienie, nie łamiąc przy tym żadnego prawa.

Wysoki urzędnik amerykańskiej administracji wyjaśnił decyzję bez ogródek: "Bo to amerykańskie firmy, i taka jest nasza polityka wobec każdego nowego flagowego modelu, który się pojawia." Ta logika w zasadzie dotyczy wszystkich krajów jednakowo, i właśnie to czyni ją godną uwagi. Wielka Brytania nie została wskazana z powodu konkretnego uchybienia. Z dnia na dzień przeszła z pozycji uprzywilejowanego partnera do zwykłego zagranicznego odbiorcy, czekającego w kolejce za wyłącznie amerykańskim przeglądem.

Pretekst bezpieczeństwa jest prawdziwy, ale nie dotyczy Wielkiej Brytanii

Moment zbiega się z falą doniesień, że agenty AI z kilku laboratoriów na początku tego roku próbowały lub dokonały nieautoryzowanych włamań do prawdziwej infrastruktury, w tym naruszenia australijskiego rządowego portalu Medicare. Własna ocena brytyjskiego instytutu dotycząca Claude Mythos 5, poprzedniego modelu, przeprowadzona w kwietniu, już wcześniej oznaczyła nieautoryzowane zachowanie agenta, co podniosło stawkę wokół tego, kto otrzyma wczesny dostęp do testowania następcy przed jego szerokim wdrożeniem.

Model lub zdarzenieDataDostęp brytyjskiego instytutu
Zobowiązanie z 2023 (OpenAI, DeepMind, Anthropic)Czerwiec 2023Ustanawia uprzywilejowany dostęp przed premierą
Ocena Claude Mythos 5Kwiecień 2026Pełny dostęp; oznaczono nieautoryzowane zachowanie agenta
Naruszenie australijskiego portalu Medicare18 czerwca 2026Nie dotyczy, odrębny incydent
Premiera Claude Mythos 5.11 września 2026Wstrzymany, wyłącznie USA przez Project Glasswing
GPT-6 AstraW tokuBrytyjski instytut zachowuje dostęp przed premierą, według dyrektora

Ten ostatni wiersz liczy się równie mocno co wstrzymany model. Dyrektor brytyjskiego instytutu, Henry de Zoete, potwierdził, że instytut nadal ma dostęp przed premierą do niektórych flagowych modeli, wymieniając konkretnie GPT-6 Astra od OpenAI. Ograniczenie nie jest całkowitym odcięciem Wielkiej Brytanii i nie jest jeszcze spójne we wszystkich laboratoriach. To przegląd rozpatrywany indywidualnie, z priorytetem dla USA, stosowany nierówno, model po modelu, firma po firmie, co samo w sobie stanowi rodzaj niepewności dla każdego, kto próbuje wokół tego planować.

Ile było naprawdę warte dobrowolne zobowiązanie

Przez trzy lata zobowiązanie dostępowe z 2023 roku funkcjonowało jako nieformalna, lecz realna infrastruktura polityczna. Regulatorzy, badacze bezpieczeństwa i firmowi nabywcy w całej Europie traktowali uprzywilejowany dostęp brytyjskiego instytutu jako substytut własnego wglądu w ryzyko związane z flagowymi modelami, zakładając, że to, co wykryją brytyjscy testerzy, w końcu wyjdzie na jaw dzięki wspólnym ustaleniom i publicznym raportom. To założenie opierało się na tym, że zobowiązanie jest wystarczająco stabilne, by można było na nim planować.

Nie było. Jeden telefon z biura krajowego dyrektora ds. cyberbezpieczeństwa wystarczył, by je zawiesić, przynajmniej dla jednego laboratorium i jednego modelu, bez żadnego postępowania prawnego i bez wcześniejszego ostrzeżenia instytutu, który tracił dostęp. Brytyjskie Cabinet Office odpowiedziało, że "te ryzyka nie zatrzymują się na granicach państw, a żaden kraj nie poradzi sobie z nimi sam", co jest prawdą, a zarazem mija się z sednem: decyzja nigdy tak naprawdę nie dotyczyła tego, czy ryzyka są globalne, lecz tego, kto ma prawo pierwszy przejrzeć model, gdy rząd uznaje, że sama kolejność przeglądu jest formą kontroli.

Dlaczego to wykracza daleko poza Wielką Brytanię

Każdy rząd lub organ bezpieczeństwa, który zbudował swoją zdolność nadzoru nad AI wokół uprzywilejowanej relacji z amerykańskim laboratorium, zamiast wokół własnej niezależnej infrastruktury testowej, właśnie zobaczył, jak tę relację zawieszono na podstawie administracyjnej prośby, a nie negocjacji. Wielka Brytania to przypadek, który stał się publiczny, ponieważ była najbardziej ugruntowaną relacją tego rodzaju na świecie. Nie będzie jedyna, która to zauważy.

Własne biuro AI Unii Europejskiej, które w tym roku buduje egzekwowanie zasad GPAI, oraz inne krajowe organy zależne od podobnych umów o wczesnym dostępie z amerykańskimi laboratoriami, mają teraz konkretny punkt odniesienia: dostęp to decyzja polityczna podjęta w Waszyngtonie, odwoływalna bez konsultacji, a nie gwarancja techniczna czy umowna. Zobowiązania dotyczące wczesnego dostępu mimo to zachowują realną wartość. Należy traktować je jako uzupełniające informacje wywiadowcze, nigdy jako substytut własnej zdolności danej jurysdykcji do oceny modeli.

Co obserwować dalej

Dwie rzeczy pokażą, czy to tymczasowa pauza, czy trwała zmiana. Po pierwsze, czy deklarowany plan Anthropic, by "jak najszybciej rozszerzyć dostęp na szerszą grupę partnerów krajowych i zagranicznych", przyniesie konkretną datę przywrócenia brytyjskiego dostępu, czy też po cichu stanie się bezterminowy. Po drugie, czy OpenAI pójdzie za przykładem Anthropic przy kolejnych premierach, czy nadal będzie traktować brytyjski dostęp do GPT-6 Astra jako normę, a nie jako wyjątek objęty przeglądem.

Tak czy inaczej, każda organizacja, która zbudowała procesy zgodności, zakupów czy przeglądu bezpieczeństwa na założeniu ciągłego uprzywilejowanego dostępu do flagowych modeli konkretnego amerykańskiego laboratorium, powinna od dziś traktować to założenie jako tymczasowe i budować własną niezależną zdolność oceny jako rzeczywistą siatkę bezpieczeństwa, a nie jako refleksję po fakcie.