Lo que OpenAI ha revelado
OpenAI publicó esta semana un artículo titulado "Responding to the next frontier of critical cyber capabilities", en el que describe lo que sus propias pruebas internas encontraron en su próximo modelo principal, con nombre en clave Astra. Axios informó sobre el asunto el 7 de agosto de 2026, el primer relato externo de la decisión. OpenAI dijo que las evaluaciones preliminares mostraron un rendimiento lo bastante alto como para que la empresa "no pueda descartar" que Astra alcance la clasificación Crítica en el apartado de ciberseguridad de su Preparedness Framework. Astra sigue sin publicarse, y OpenAI aseguró que el modelo no tuvo ninguna participación en el exploit de Hugging Face que circuló este verano en círculos de seguridad. La empresa no ha anunciado una nueva fecha de lanzamiento. En su lugar, está pausando el trabajo interno en Astra que no cumple un conjunto más estricto de controles de seguridad, y ralentizando el calendario general de desarrollo del modelo hasta que esos controles estén en marcha.
OpenAI confirma la pausa
El 18 de agosto de 2026, once días después del anuncio anterior, OpenAI publicó un artículo de seguimiento titulado "Pacing model development in an era of cyber-critical capabilities", que confirmaba que la ralentización se había convertido en una medida concreta y fechada. La empresa afirmó que había pausado el entrenamiento por refuerzo en sus modelos más recientes destinados a producción durante dos semanas, y que su mayor entrenamiento RL de vanguardia previsto, el que se entiende como base de Astra, sigue en pausa mientras continúan entrenamientos y evaluaciones a menor escala. OpenAI dijo que su monitorización ampliada, que revisa el razonamiento del modelo en cada paso muestreado y traslada cualquier indicio preocupante a revisores humanos en 30 minutos, añade en torno a un 20 por ciento al coste de cómputo de los entrenamientos afectados. El director de investigación, Jakub Pachocki, afirmó que ahora es necesario empezar a construir herramientas para coordinar este tipo de ritmo entre laboratorios y entre países, y el consejero delegado, Sam Altman, dijo que este era un buen momento para ralentizar y que hacer bien la seguridad importa más que el impulso competitivo de cualquier empresa. OpenAI presentó la pausa como una decisión tomada por su cuenta, sin esperar a que existiera un estándar de ritmo compartido en el sector, mientras pedía explícitamente al resto de la industria que construyera uno.
Qué significa realmente una capacidad cibernética crítica
El Preparedness Framework de OpenAI, publicado por primera vez en 2023 y actualizado desde entonces, define el nivel Crítico de ciberseguridad como un modelo capaz de identificar y desarrollar de forma independiente exploits de día cero funcionales, en todos los niveles de gravedad, contra numerosos sistemas reales reforzados sin operador humano, o capaz de idear y ejecutar de principio a fin un ciberataque completamente nuevo contra un objetivo reforzado a partir de nada más que un objetivo de alto nivel. Es un listón muy concreto y estrecho, y se sitúa por encima del nivel Alto en el que quedó calificado GPT-5.6 Sol, el modelo que OpenAI comercializa actualmente. La diferencia importa porque un sistema de nivel Alto sigue necesitando a una persona experta dirigiendo los pasos clave del ataque, mientras que uno de nivel Crítico no. Astra es el primer modelo de OpenAI cuyas pruebas internas se acercan tanto a ese límite que la empresa no afirma quedar por debajo.
Las salvaguardas que OpenAI está construyendo ahora
La respuesta de OpenAI tiene tres partes. El trabajo de desarrollo sobre las capacidades más avanzadas de Astra queda ahora confinado a entornos de evaluación aislados y fuertemente vigilados, en lugar de la infraestructura general de ingeniería de OpenAI. La empresa está desplegando lo que llama monitorización universal sobre el uso agéntico de Astra: sistemas automatizados que observan en tiempo real los propios pasos de razonamiento del modelo y están diseñados para interrumpir acciones que parezcan desalineadas o peligrosas antes de que se completen. OpenAI también afirma que incorporará a agencias gubernamentales e institutos independientes de seguridad en IA para someter a Astra a pruebas de estrés, en lugar de depender solo de sus propias evaluaciones. Cada una de estas medidas responde a una brecha de capacidad, no es una declaración de política; OpenAI no afirma que Astra sea seguro, solo que ahora lo está probando como si pudiera no serlo.
Qué significa esto para las empresas de la UE y el Reino Unido
Es la primera vez que un laboratorio de IA de vanguardia ralentiza públicamente el lanzamiento de un modelo insignia específicamente por capacidad ofensiva ciberdelictiva, y no por sesgo, contenido de uso indebido o preocupaciones generales de seguridad, y eso crea un hecho nuevo con el que deben trabajar los equipos de riesgo en Europa y el Reino Unido. Bajo la directiva NIS2 de la UE y las próximas normas DORA para entidades financieras, las organizaciones deben evaluar y documentar el riesgo cibernético de sus proveedores de TIC, incluidos los proveedores de IA. Hasta ahora, esa evaluación apenas tenía nada concreto a lo que recurrir: los laboratorios de IA publican compromisos de seguridad, no resultados por nivel de capacidad. El reconocimiento de OpenAI da a los equipos de riesgo y compras un elemento real, un umbral con nombre y un resultado público, que incluir en un cuestionario de proveedores: se ha evaluado este sistema frente a un umbral crítico de capacidad cibernética, y cuál fue el resultado. Las empresas españolas sujetas a la supervisión del INCIBE y las entidades financieras bajo DORA deberían esperar que este tipo de divulgación se convierta en una línea habitual de la diligencia debida de proveedores de IA, igual que ya lo son los informes SOC 2 y los certificados ISO 27001. Las empresas con acceso en producción a modelos de vanguardia, en particular las que ejecutan IA agéntica contra redes internas, deberían preguntar ya a su proveedor en qué nivel de capacidad quedó calificado el modelo que usan, en lugar de esperar a que un proveedor lo revele sin que se lo pidan. El propio seguimiento de OpenAI del 18 de agosto, una pausa de entrenamiento confirmada y no solo una promesa, es ya el tipo de prueba que los equipos de compras deberían empezar a exigir a cualquier proveedor de IA.
Leer a continuación: Equipos De Seguridad De La UE Sin Voz Sobre Astra | Una brecha obliga a OpenAI a reescribir sus reglas



