O que a OpenAI revelou
A OpenAI publicou esta semana um artigo intitulado 'Responding to the next frontier of critical cyber capabilities' ('Responder à próxima fronteira de capacidades cibernéticas críticas'), descrevendo o que os seus próprios testes internos revelaram sobre o seu próximo modelo principal, com o nome de código Astra. A Axios noticiou a história a 7 de agosto de 2026, o primeiro relato externo desta decisão. A OpenAI afirmou que as avaliações preliminares mostraram um desempenho suficientemente forte para que a empresa não possa 'excluir' a hipótese de o Astra atingir a classificação Crítica na vertente de cibersegurança do seu Preparedness Framework (quadro de preparação). O Astra continua por lançar, e a OpenAI afirmou que o modelo não teve qualquer participação na falha de segurança da Hugging Face que circulou em círculos de segurança este verão. A empresa não está a anunciar uma nova data de lançamento. Em vez disso, está a suspender o trabalho interno no Astra que não cumpra um conjunto mais rigoroso de controlos de segurança, e a abrandar o calendário geral de desenvolvimento do modelo até esses controlos estarem implementados.
A OpenAI Confirma a Pausa
A 18 de agosto de 2026, onze dias depois do anúncio descrito acima, a OpenAI publicou um artigo de seguimento intitulado "Pacing model development in an era of cyber-critical capabilities", confirmando que o abrandamento se tinha tornado numa medida concreta e datada. A empresa afirmou ter suspendido durante duas semanas o treino por reforço nos seus modelos mais recentes destinados ao lançamento, e que o seu maior treino RL de fronteira planeado, aquele que se entende estar na base do Astra, continua em pausa enquanto prosseguem treinos e avaliações de menor escala. A OpenAI disse que a sua monitorização alargada, que verifica o raciocínio do modelo em cada etapa amostrada e encaminha qualquer elemento preocupante para revisores humanos em 30 minutos, aumenta em cerca de 20 por cento o custo de cálculo dos treinos afetados. O responsável de investigação, Jakub Pachocki, afirmou que é agora necessário começar a construir ferramentas para coordenar este tipo de ritmo entre laboratórios e entre países, e o diretor executivo, Sam Altman, disse que este era um bom momento para abrandar e que fazer bem a segurança importa mais do que o impulso competitivo de qualquer empresa. A OpenAI apresentou a pausa como uma decisão tomada por conta própria, sem esperar que existisse uma norma do setor partilhada sobre o ritmo, ao mesmo tempo que pedia explicitamente ao resto do setor que construísse uma.
O que significa realmente uma capacidade cibernética Crítica
O Preparedness Framework da OpenAI, publicado pela primeira vez em 2023 e atualizado desde então, define o nível Crítico de cibersegurança como um modelo capaz de identificar e desenvolver, de forma independente, exploits de dia zero funcionais, em vários níveis de gravidade, contra numerosos sistemas reais protegidos, sem qualquer operador humano, ou capaz de conceber e executar um ciberataque inteiramente novo contra um alvo protegido a partir de nada mais do que um objetivo de alto nível. Trata-se de um patamar específico e estreito, situado acima do nível Alto em que foi classificado o modelo atualmente em produção da OpenAI, o GPT-5.6 Sol. A distinção é relevante porque um sistema de nível Alto ainda precisa de um operador humano qualificado a dirigir o ataque em etapas-chave; um sistema de nível Crítico não. O Astra é o primeiro modelo da OpenAI cujos testes internos se aproximaram o suficiente desse limiar para que a empresa não garanta que fica aquém dele.
As salvaguardas que a OpenAI está agora a construir
A resposta da OpenAI assenta em três partes. O trabalho de desenvolvimento no Astra que envolve as suas capacidades mais avançadas está agora confinado a ambientes de avaliação isolados e fortemente protegidos, em vez da infraestrutura geral de engenharia da OpenAI. A empresa está a implementar aquilo a que chama monitorização universal em toda a utilização agêntica do Astra: sistemas automáticos que observam em tempo real os próprios passos de raciocínio do modelo e que foram concebidos para interromper ações que pareçam desalinhadas ou perigosas antes de serem concluídas. A OpenAI afirma ainda que vai envolver entidades externas, agências governamentais e institutos independentes de segurança em IA, para testar sob pressão as capacidades do Astra, em vez de depender exclusivamente das suas próprias avaliações. Cada uma destas medidas é uma resposta a uma lacuna de capacidade, não uma declaração de política; a OpenAI não afirma que o Astra é seguro, apenas que o está agora a testar como se pudesse não ser.
O que isto significa para as empresas da UE e do Reino Unido
É a primeira vez que um laboratório de IA de fronteira atrasa publicamente o lançamento de um modelo emblemático especificamente por capacidade ofensiva de ciberataque, e não por enviesamento, conteúdo de utilização indevida ou preocupações gerais de segurança, o que cria um novo facto com que as equipas de risco europeias e britânicas têm de lidar. Ao abrigo da diretiva NIS2 da UE e das próximas regras DORA para entidades financeiras, as organizações têm de avaliar e documentar o risco cibernético que os seus fornecedores de TIC representam, incluindo fornecedores de IA. Até agora, essa avaliação quase não tinha nada de concreto a que recorrer: os laboratórios de IA publicam compromissos de segurança, não resultados por nível de capacidade. A admissão da OpenAI dá às equipas de risco e de compras um elemento real, um limiar identificado com um resultado público, para incluir num questionário a fornecedores: este sistema foi avaliado face a um limiar de capacidade cibernética Crítica, e qual foi a conclusão? Em Portugal, o Centro Nacional de Cibersegurança (CNCS) desempenha um papel equivalente na supervisão da resiliência cibernética, e o DORA aplica-se diretamente aos bancos e às restantes entidades financeiras portuguesas, pelo que este tipo de limiar deverá passar a integrar também os seus processos de diligência devida a fornecedores de IA. As empresas do Reino Unido que reportam ao National Cyber Security Centre e as entidades da UE ao abrigo do NIS2 devem esperar que este tipo de divulgação passe a ser um item permanente na diligência devida a fornecedores de IA, tal como já acontece com os relatórios SOC 2 e os certificados ISO 27001. As empresas com acesso em produção a modelos de fronteira, em particular as que utilizam IA agêntica contra redes internas, devem perguntar já ao seu fornecedor em que nível de capacidade foi classificado o modelo que utilizam, em vez de esperar que o fornecedor o divulgue sem ser questionado. O próprio seguimento da OpenAI de 18 de agosto, uma pausa de treino confirmada e não apenas uma promessa, é já o tipo de prova que as equipas de compras deveriam passar a exigir a qualquer fornecedor de IA.
Leia a seguir: Equipas De Segurança Da UE Sem Voz Sobre A Astra | Uma falha obriga a OpenAI a reescrever regras



