Wat OpenAI heeft bekendgemaakt
OpenAI publiceerde deze week een bericht getiteld "Responding to the next frontier of critical cyber capabilities" (Reageren op de volgende grens van kritieke cybercapaciteiten), waarin het beschrijft wat de eigen interne tests hebben aangetoond over het volgende grote model, met de codenaam Astra. Axios berichtte op 7 augustus 2026 als eerste externe bron over het besluit. OpenAI zei dat voorlopige evaluaties een prestatieniveau lieten zien dat sterk genoeg was dat het bedrijf "niet kan uitsluiten" dat Astra de classificatie Kritiek bereikt op het cybersecurity-spoor van zijn Preparedness Framework. Astra is nog niet uitgebracht, en OpenAI zei dat het model geen rol speelde bij het Hugging Face-exploit dat deze zomer in veiligheidskringen circuleerde. Het bedrijf kondigt geen nieuwe releasedatum aan. In plaats daarvan pauzeert het intern werk aan Astra dat niet voldoet aan een strengere set beveiligingsmaatregelen, en vertraagt het de algehele ontwikkelingstijdlijn van het model totdat die maatregelen zijn ingevoerd.
OpenAI bevestigt de pauze
Op 18 augustus 2026, elf dagen na de hierboven beschreven bekendmaking, publiceerde OpenAI een vervolgbericht getiteld "Pacing model development in an era of cyber-critical capabilities", waarin het bevestigde dat de vertraging een concrete, gedateerde maatregel was geworden. Het bedrijf verklaarde dat het het reinforcement-learning-trainen van zijn meest recente, voor release bestemde modellen twee weken lang had gepauzeerd, en dat zijn grootste geplande grensverleggende RL-run, degene die geldt als de basis van Astra, in de wacht blijft terwijl kleinere trainings- en evaluatierondes doorgaan. OpenAI zei dat de uitgebreide monitoring, die de redenering van het model bij elke bemonsterde stap controleert en zorgwekkende signalen binnen 30 minuten doorstuurt naar menselijke beoordelaars, de rekenkosten van de betrokken trainingen met ongeveer 20 procent verhoogt. Chief research officer Jakub Pachocki zei dat het nu nodig is om te beginnen met het bouwen van middelen om dit soort tempo tussen laboratoria en tussen landen te coördineren, en ceo Sam Altman zei dat dit een goed moment was om te vertragen en dat veiligheid goed doen belangrijker is dan het concurrentievoordeel van welk bedrijf dan ook. OpenAI presenteerde de pauze als een eigen beslissing, genomen zonder te wachten op een sectorbrede tempo-norm, terwijl het de rest van de sector expliciet opriep om er zelf een te bouwen.
Wat een kritieke cybercapaciteit precies inhoudt
OpenAI's Preparedness Framework, voor het eerst gepubliceerd in 2023 en sindsdien bijgewerkt, definieert de Kritieke cyberveiligheidslaag als een model dat zelfstandig, over alle ernstniveaus heen, functionele zero-day exploits kan identificeren en ontwikkelen tegen veel geharde real-world systemen zonder menselijke operator, of dat een volledig nieuwe cyberaanval tegen een gehard doelwit kan bedenken en uitvoeren op basis van niet meer dan een doel op hoog niveau. Dat is een specifieke, nauwe grens, en die ligt boven de laag Hoog waarin het model dat OpenAI momenteel uitlevert, GPT-5.6 Sol, is ingedeeld. Het onderscheid is van belang omdat een systeem in de laag Hoog op cruciale momenten nog altijd een bekwame mens nodig heeft om de aanval aan te sturen; een systeem in de laag Kritiek niet. Astra is het eerste OpenAI-model waarvan de interne tests dicht genoeg bij die grens zijn gekomen dat het bedrijf niet durft te zeggen dat het model daaronder blijft.
De waarborgen die OpenAI nu opbouwt
OpenAI's aanpak bestaat uit drie onderdelen. Ontwikkelwerk aan Astra dat de meer geavanceerde vaardigheden raakt, is nu beperkt tot geïsoleerde, zwaar beveiligde testomgevingen in plaats van OpenAI's algemene technische infrastructuur. Het bedrijf zet wat het "universele monitoring" noemt in over het agentische gebruik van Astra: geautomatiseerde systemen die de eigen redeneerstappen van het model in real time volgen en die zijn gebouwd om acties te onderbreken die niet-uitgelijnd of gevaarlijk lijken voordat ze worden voltooid. OpenAI zegt ook externe partijen te zullen inschakelen, overheidsinstanties en onafhankelijke AI-veiligheidsinstituten, om de capaciteiten van Astra te stresstesten in plaats van uitsluitend op eigen evaluaties te vertrouwen. Elk van deze maatregelen is een reactie op een capaciteitskloof, geen beleidsverklaring; OpenAI beweert niet dat Astra veilig is, alleen dat het model nu wordt getest alsof dat misschien niet zo is.
Wat dit betekent voor bedrijven in de EU en het VK
Dit is de eerste keer dat een toonaangevend AI-lab de release van een vlaggenschipmodel publiekelijk vertraagt specifiek vanwege offensieve cybercapaciteiten, in plaats van vanwege bias, misbruik van content of algemene veiligheidszorgen, en dat schept een nieuw gegeven waarmee Europese en Britse risicoteams moeten werken. Onder de NIS2-richtlijn van de EU en de aankomende DORA-regels voor financiële entiteiten moeten organisaties het cyberrisico van hun ICT-leveranciers beoordelen en documenteren, inclusief AI-leveranciers. Tot nu toe had die beoordeling bijna niets concreets om naar te verwijzen: AI-labs publiceren veiligheidstoezeggingen, geen resultaten per capaciteitslaag. OpenAI's erkenning geeft risico- en inkoopteams een echt aanknopingspunt, een benoemde drempel met een publiek resultaat, om op te nemen in een leveranciersvragenlijst: is dit systeem getoetst aan een Kritieke cybercapaciteitsdrempel, en wat was de uitkomst? In Nederland ligt hier een directe rol voor het NCSC-NL (Nationaal Cyber Security Centrum): banken en andere financiële entiteiten die onder DORA vallen doen er goed aan dit soort AI-leveranciersbeoordelingen expliciet in hun toezichtdossiers op te nemen, en voor kritieke infrastructuur zoals de haven en logistieke sector van Rotterdam is dezelfde vraag relevant zodra AI-systemen toegang krijgen tot operationele netwerken. Britse bedrijven die rapporteren aan het National Cyber Security Centre en EU-entiteiten onder NIS2 moeten verwachten dat dit soort openheid een vast onderdeel wordt van due diligence bij AI-leveranciers, zoals SOC 2-rapporten en ISO 27001-certificaten dat nu al zijn. Bedrijven met productietoegang tot grensverleggende modellen, met name iedereen die agentische AI tegen interne netwerken laat werken, moeten hun leverancier nu al vragen welke capaciteitslaag het gebruikte model heeft gekregen, in plaats van te wachten tot een leverancier dit ongevraagd bekendmaakt. OpenAI's eigen vervolgbericht van 18 augustus, een bevestigde trainingspauze in plaats van alleen een belofte, is zelf al precies het soort bewijs dat inkoopteams voortaan van elke AI-leverancier zouden moeten eisen.
Lees hierna: EU-Beveiligingsteams Hebben Niets Te Zeggen Over Astra | Een inbreuk dwingt OpenAI tot nieuwe regels



