Co ujawniło OpenAI
OpenAI opublikowało w tym tygodniu wpis zatytułowany "Odpowiadając na kolejną granicę krytycznych zdolności cybernetycznych", opisujący wyniki wewnętrznych testów swojego kolejnego dużego modelu o kryptonimie Astra. Axios opisał tę historię 7 sierpnia 2026 roku, jako pierwszy zewnętrzny przekaz tej decyzji. OpenAI poinformowało, że wstępne oceny wykazały wyniki na tyle wysokie, że firma "nie może wykluczyć" osiągnięcia przez Astrę klasyfikacji krytycznej w ścieżce cyberbezpieczeństwa jej Ramowego Systemu Gotowości (Preparedness Framework). Astra pozostaje niewydana, a OpenAI zapewniło, że model nie miał żadnego udziału w exploicie Hugging Face, który krążył w środowisku bezpieczeństwa tego lata. Firma nie ogłasza nowej daty premiery. Zamiast tego wstrzymuje wewnętrzne prace nad Astrą, które nie spełniają bardziej rygorystycznego zestawu zabezpieczeń, i spowalnia ogólny harmonogram rozwoju modelu, dopóki te zabezpieczenia nie zostaną wdrożone.
OpenAI potwierdza wstrzymanie prac
18 sierpnia 2026 roku, jedenaście dni po opisanym wyżej ujawnieniu, OpenAI opublikowało kolejny wpis zatytułowany "Pacing model development in an era of cyber-critical capabilities", potwierdzający, że spowolnienie stało się konkretnym, datowanym działaniem. Firma poinformowała, że wstrzymała na dwa tygodnie trening ze wzmocnieniem swoich najnowszych modeli przeznaczonych do wdrożenia, a jej największy planowany, przełomowy trening RL, ten uznawany za podstawę Astry, pozostaje zawieszony, podczas gdy trwają mniejsze treningi i ewaluacje. OpenAI podało, że rozszerzony monitoring, sprawdzający rozumowanie modelu przy każdym próbkowanym kroku i przekazujący wszystko, co niepokojące, ludzkim recenzentom w ciągu 30 minut, podnosi koszt obliczeniowy objętych nim treningów o około 20 procent. Dyrektor ds. badań, Jakub Pachocki, powiedział, że konieczne jest teraz rozpoczęcie budowy narzędzi do koordynowania tego rodzaju tempa między laboratoriami i między krajami, a dyrektor generalny, Sam Altman, powiedział, że to dobry moment, by zwolnić, i że dobre podejście do bezpieczeństwa liczy się bardziej niż konkurencyjny impet jakiejkolwiek firmy. OpenAI przedstawiło to wstrzymanie jako decyzję podjętą samodzielnie, bez czekania na powstanie wspólnego dla całej branży standardu tempa, jednocześnie wprost wzywając resztę branży do zbudowania takiego standardu.
Co faktycznie oznacza krytyczna zdolność cybernetyczna
Ramowy System Gotowości OpenAI (Preparedness Framework), opublikowany po raz pierwszy w 2023 roku i od tego czasu aktualizowany, definiuje krytyczny poziom cyberbezpieczeństwa jako model, który potrafi samodzielnie identyfikować i opracowywać funkcjonalne exploity zero-day, na różnych poziomach dotkliwości, wobec wielu dobrze zabezpieczonych systemów rzeczywistego świata, bez udziału operatora-człowieka, lub który potrafi zaprojektować i przeprowadzić całkowicie nowy cyberatak na dobrze zabezpieczony cel, mając do dyspozycji jedynie ogólny cel wysokiego poziomu. To konkretna, wąska granica, leżąca powyżej poziomu wysokiego, w którym oceniono obecnie oferowany model OpenAI, GPT-5.6 Sol. Rozróżnienie to ma znaczenie, ponieważ system na poziomie wysokim nadal wymaga wykwalifikowanego człowieka kierującego atakiem na kluczowych etapach; system na poziomie krytycznym już nie. Astra jest pierwszym modelem OpenAI, którego wewnętrzne testy zbliżyły się do tej granicy na tyle, że firma nie chce twierdzić, iż jej do niej zabrakło.
Zabezpieczenia, które teraz buduje OpenAI
Odpowiedź OpenAI składa się z trzech elementów. Prace rozwojowe nad Astrą dotyczące jej bardziej zaawansowanych zdolności są teraz ograniczone do izolowanych, silnie zabezpieczonych środowisk testowych, zamiast ogólnej infrastruktury inżynieryjnej OpenAI. Firma wdraża tak zwany uniwersalny monitoring obejmujący całe agentowe użycie Astry: zautomatyzowane systemy obserwujące własne kroki rozumowania modelu w czasie rzeczywistym, zbudowane tak, by przerywać działania wyglądające na niezgodne z zamierzeniami lub niebezpieczne, zanim zostaną dokończone. OpenAI zapowiada również zaangażowanie podmiotów zewnętrznych - agencji rządowych i niezależnych instytutów bezpieczeństwa AI - do testowania odporności zdolności Astry, zamiast polegania wyłącznie na własnych ocenach. Każdy z tych kroków jest odpowiedzią na lukę w zdolnościach, a nie deklaracją polityki; OpenAI nie twierdzi, że Astra jest bezpieczna, a jedynie że testuje ją teraz tak, jakby mogła nie być.
Co to oznacza dla przedsiębiorstw w UE i Wielkiej Brytanii
To pierwszy przypadek, gdy wiodące laboratorium AI publicznie spowolniło premierę swojego flagowego modelu konkretnie z powodu ofensywnych zdolności cybernetycznych, a nie z powodu stronniczości, treści związanych z nadużyciami czy ogólnych obaw o bezpieczeństwo, co tworzy nowy fakt, z którym muszą się zmierzyć europejskie i brytyjskie zespoły ds. ryzyka. Zgodnie z unijną dyrektywą NIS2 oraz nadchodzącymi przepisami DORA dla podmiotów finansowych, organizacje muszą oceniać i dokumentować ryzyko cybernetyczne związane z ich dostawcami ICT, w tym dostawcami AI. Do tej pory taka ocena nie miała się właściwie o co oprzeć: laboratoria AI publikują deklaracje bezpieczeństwa, a nie wyniki na poziomie zdolności. Przyznanie OpenAI daje zespołom ds. ryzyka i zakupów konkretny artefakt - nazwany próg z publicznym wynikiem - do umieszczenia w kwestionariuszu dla dostawcy: czy ten system został oceniony pod kątem krytycznego progu zdolności cybernetycznych i jaki był wynik tej oceny? W Polsce odpowiednikiem tego mechanizmu jest CSIRT NASK, krajowy zespół reagowania na incydenty bezpieczeństwa, a polskie banki i inne podmioty finansowe nadzorowane przez Komisję Nadzoru Finansowego (KNF) będą musiały uwzględnić taką ocenę dostawców AI w ramach wymogów DORA. Przedsiębiorstwa w Wielkiej Brytanii raportujące do National Cyber Security Centre oraz podmioty w UE podlegające NIS2 powinny spodziewać się, że tego rodzaju ujawnienia staną się stałym punktem w due diligence dostawców AI, podobnie jak raporty SOC 2 czy certyfikaty ISO 27001 są nim już dziś. Przedsiębiorstwa mające produkcyjny dostęp do najbardziej zaawansowanych modeli, zwłaszcza te uruchamiające agentową sztuczną inteligencję wobec sieci wewnętrznych, powinny już teraz zapytać swojego dostawcę, do jakiego poziomu zdolności oceniono używany przez nie model, zamiast czekać, aż dostawca ujawni to sam z siebie. Kolejny wpis OpenAI z 18 sierpnia, czyli potwierdzone wstrzymanie treningu, a nie tylko obietnica, jest już sam w sobie rodzajem dowodu, jakiego zespoły zakupowe powinny zacząć wymagać od każdego dostawcy AI.
Czytaj dalej: Zespoły Bezpieczeństwa UE Bez Głosu W Sprawie Astry | Włamanie zmusza OpenAI do nowych zasad



