Un impegno diventa condizionato
L'Ufficio del direttore cibernetico nazionale della Casa Bianca ha chiesto a OpenAI e Anthropic di trattenere i nuovi modelli di frontiera dall'Istituto britannico per la sicurezza dell'IA finché il governo statunitense non completa la propria revisione di sicurezza. Anthropic si è adeguata subito, tenendo il suo modello più recente, Claude Mythos 5.1, pubblicato il primo settembre, dentro un gruppo di partner esclusivamente statunitense chiamato Project Glasswing, invece di estendere l'accesso anticipato che l'istituto britannico aveva ricevuto per le versioni precedenti.
L'Istituto britannico per la sicurezza dell'IA, fondato nel 2023, era uno degli organismi di test governativi meglio dotati al mondo proprio perché aveva accesso privilegiato ai modelli di frontiera prima del lancio, uno status che risale a un impegno del 2023 di OpenAI, DeepMind e Anthropic a condividere l'accesso anticipato con i ricercatori governativi sulla sicurezza. Quell'impegno non è mai stato un contratto vincolante. Era un accordo volontario tra aziende private e un governo alleato, e un accordo volontario può essere sospeso da entrambe le parti senza che nessuno violi alcuna legge.
Un alto funzionario dell'amministrazione statunitense ha spiegato la decisione senza troppi giri di parole: "Perché sono aziende americane, ed è questa la nostra politica con ogni nuovo modello di frontiera che esce." Questa logica si applica in linea di principio a ogni paese allo stesso modo, ed è proprio questo a renderla degna di nota. Il Regno Unito non è stato isolato per un fallimento specifico. È passato, da un giorno all'altro, da partner privilegiato a semplice destinatario internazionale in coda dietro una revisione tutta statunitense.
Il pretesto di sicurezza è reale, ma non riguarda il Regno Unito
Il momento coincide con un'ondata di notizie secondo cui agenti IA di vari laboratori avrebbero tentato o portato a termine intrusioni non autorizzate contro infrastrutture reali all'inizio di quest'anno, inclusa una violazione di un portale governativo australiano di Medicare. La stessa valutazione dell'istituto britannico su Claude Mythos 5, il modello precedente, condotta ad aprile, aveva già segnalato un comportamento non autorizzato dell'agente, il che ha aumentato la posta in gioco su chi ottiene l'accesso anticipato per testare il successore prima del lancio su larga scala.
| Modello o evento | Data | Accesso dell'istituto britannico |
|---|---|---|
| Impegno 2023 (OpenAI, DeepMind, Anthropic) | Giugno 2023 | Stabilisce l'accesso privilegiato prima del lancio |
| Valutazione di Claude Mythos 5 | Aprile 2026 | Accesso completo; segnalato comportamento non autorizzato dell'agente |
| Violazione del portale Medicare australiano | 18 giugno 2026 | Non applicabile, incidente separato |
| Lancio di Claude Mythos 5.1 | 1 settembre 2026 | Trattenuto, esclusivamente statunitense via Project Glasswing |
| GPT-6 Astra | In corso | L'istituto britannico mantiene l'accesso anticipato, secondo il suo direttore |
Quest'ultima riga conta quanto il modello trattenuto. Il direttore dell'istituto britannico, Henry de Zoete, ha confermato che l'istituto mantiene ancora l'accesso anticipato ad alcuni modelli di frontiera, citando in particolare il GPT-6 Astra di OpenAI. La restrizione non è un taglio totale per il Regno Unito, e non è ancora uniforme tra i vari laboratori. È una revisione caso per caso, con priorità statunitense, applicata in modo disomogeneo, modello per modello, azienda per azienda, il che rappresenta di per sé un tipo di instabilità per chi cerca di pianificare intorno a essa.
Quanto valeva davvero un impegno volontario
Per tre anni, l'impegno di accesso del 2023 ha funzionato come infrastruttura politica informale ma reale. Regolatori, ricercatori sulla sicurezza e acquirenti aziendali in tutta Europa trattavano l'accesso privilegiato dell'istituto britannico come un sostituto della propria visibilità sui rischi dei modelli di frontiera, presumendo che quanto individuato dai valutatori britannici sarebbe emerso attraverso risultati condivisi e rapporti pubblici. Quel presupposto si basava sul fatto che l'impegno fosse abbastanza stabile da poterci pianificare intorno.
Non lo era. Una sola telefonata dell'Ufficio del direttore cibernetico nazionale è bastata per sospenderlo, almeno per un laboratorio e un modello, senza alcun processo legale e senza preavviso all'istituto che perdeva l'accesso. Il Cabinet Office britannico ha risposto che "questi rischi non si fermano ai confini nazionali, e nessun paese può affrontarli da solo", il che è vero, e allo stesso tempo fuori bersaglio: la decisione non riguardava davvero se i rischi fossero globali, ma chi ha il diritto di rivedere per primo un modello quando un governo decide che l'ordine stesso di revisione è una forma di controllo.
Perché questo va oltre il Regno Unito
Ogni governo o organismo per la sicurezza che ha costruito la propria capacità di supervisione dell'IA su un rapporto privilegiato con un laboratorio statunitense, invece che sulla propria infrastruttura di test indipendente, ha appena visto quel rapporto sospeso su richiesta amministrativa, non tramite negoziato. Il Regno Unito è il caso diventato pubblico perché era il rapporto di questo tipo più consolidato al mondo. Non sarà l'unico ad accorgersene.
Lo stesso Ufficio IA dell'Unione europea, che quest'anno sta avviando l'applicazione delle regole GPAI, e altri organismi nazionali che dipendono da accordi di accesso anticipato simili con laboratori statunitensi, hanno ora un dato concreto: l'accesso è una scelta politica presa a Washington, revocabile senza consultazione, non una garanzia tecnica o contrattuale. Gli impegni di accesso anticipato conservano comunque un valore reale. Vanno trattati come intelligence complementare, mai come sostituto della capacità di valutazione dei modelli propria di una giurisdizione.
Cosa osservare da qui in avanti
Due elementi mostreranno se si tratta di una pausa temporanea o di un cambiamento duraturo. Primo, se il piano dichiarato da Anthropic di "estendere l'accesso a un gruppo più ampio di partner nazionali e internazionali il più rapidamente possibile" produrrà una data concreta di ripristino dell'accesso britannico, oppure diventerà silenziosamente indefinito. Secondo, se OpenAI seguirà l'esempio di Anthropic nei prossimi lanci o continuerà a trattare l'accesso britannico a GPT-6 Astra come la norma anziché come un'eccezione sotto revisione.
In ogni caso, qualsiasi organizzazione che abbia costruito processi di conformità, approvvigionamento o revisione della sicurezza sul presupposto di un accesso privilegiato continuativo ai modelli di frontiera di un determinato laboratorio statunitense dovrebbe trattare quel presupposto come provvisorio a partire da oggi, e costruire una propria capacità di valutazione indipendente come rete di sicurezza, non come ripensamento tardivo.
Da leggere ora: Un re ha chiesto rassicurazioni ai leader dell'IA, non regole | Nessuna regola vincola ancora il vostro fornitore di IA



