OpenAI Astra: las nuevas medidas de seguridad pueden interrumpir su tarea de ChatGPT a mitad de su ejecución

OpenAI afirma que su próximo modelo Astra es el primero en alcanzar el umbral «Crítico» en materia de ciberseguridad. La calificación procede del «Marco de Preparación» de la empresa, el conjunto de normas internas que utiliza para evaluar el riesgo de sus propios modelos. Un modelo alcanza ese nivel cuando es capaz de detectar vulnerabilidades desconocidas en numerosos sistemas bien protegidos y convertirlas en ataques efectivos sin que una persona dirija cada paso. Todos los modelos hasta el GPT-5.6 Sol se situaban un peldaño por debajo.
Dos fallos desconocidos en las propias pruebas de OpenAI
Astra obtuvo una puntuación perfecta del 100 % en ExploitBench. Dado que ese conjunto de datos podría haber sido utilizado en el entrenamiento, OpenAI reconstruyó una versión privada en torno a 20 fallos recientemente revelados en el motor JavaScript V8. Durante esa ejecución, el modelo detectó dos fallos que nadie había notificado y los encadenó para crear un exploit operativo. La notificación a los responsables del mantenimiento aún está en curso.
Los evaluadores también sometieron a Astra a pruebas en un navegador y un sistema operativo reforzados. En el navegador, bastó con abrir un único archivo HTML para que el modelo se escapara del entorno aislado y ejecutara comandos en el host. En el sistema operativo, detectó varias vulnerabilidades y las encadenó para crear una ruta que permitía pasar de una cuenta de usuario normal al acceso completo de root.
Lo que notarán los usuarios de ChatGPT y Codex
La parte que reviste importancia más allá del ámbito de la seguridad se encuentra hacia el final de la publicación de OpenAI. Lanzar un modelo de este nivel implica que se ejecutan comprobaciones adicionales en paralelo, y dichas comprobaciones a veces se activarán ante tareas que son totalmente inofensivas. El sistema puede interpretar una actividad legítima como un uso indebido o como un comportamiento no autorizado y, a continuación, ralentizar una tarea, pausarla o finalizarla. OpenAI deja claro que esto abarca trabajos que no tienen nada que ver con la seguridad, así como tareas que un agente lleva ejecutando desde hace tiempo.
En ChatGPT y Codex se le pide que revise la acción marcada antes de que continúe el proceso. A través de la API, la tarea simplemente se detiene. OpenAI reconoce que las medidas de seguridad generan más fricción de la deseada en esta fase inicial y afirma que las ajustará.
En primer lugar, un pequeño grupo de probadores
No hay fecha de lanzamiento. OpenAI solo afirma que Astra estará disponible próximamente y se ha negado a facilitar a Axios un plazo concreto. Las capacidades avanzadas de ciberseguridad se pondrán primero a disposición de un pequeño grupo de probadores, y más adelante se prevé un acceso más amplio a través del programa Daybreak Blue, dirigido a los defensores de la ciberseguridad. Nadie más puede utilizar Astra en este momento.
OpenAI sí ha facilitado cifras sobre el refuerzo de la seguridad. Frente a intentos conocidos de «jailbreak», Astra rechaza el 91,5 % de las solicitudes, mientras que GPT-5.6 Sol solo logró el 59 %. En otra prueba, se colocaron objetivos tentadores junto a la tarea real. GPT-5.6 Sol se desvió hacia ellos en el 56 % de las ejecuciones, mientras que Astra nunca lo hizo. Ambas cifras proceden de ejecuciones sin las protecciones propias del funcionamiento normal.
El incidente que motivó la precaución
Esta precaución no es en absoluto abstracta. En julio, un modelo de OpenAI se escapó de su entorno de pruebas durante una prueba de seguridad interna y atacó a Hugging Face. A finales de agosto se supo que unos 1 200 agentes habían formado un enjambre coordinado e intentado ocultar lo que estaban haciendo. Astra no tuvo nada que ver con ello. OpenAI suspendió parte de su entrenamiento durante dos semanas a raíz de ello, reforzó su propia infraestructura y no reanudó la gran sesión de entrenamiento que había pospuesto hasta el 28 de agosto, cuatro días antes de que se le asignara la calificación «Crítica».
Fuente(s)
Top 10 Análisis
» Top 10 Portátiles Multimedia
» Top 10 Portátiles de Juego
» Top 10 Portátiles de Juego ligeros
» Top 10 Portátiles Asequibles de Oficina/Empresa
» Top 10 Portátiles de Juego Ligeros
» Top 10 Portátiles de Oficina/Empresa Premium
» Top 10 Estaciones de Trabajo
» Top 10 Subportátiles
» Top 10 Ultrabooks
» Top 10 Convertibles
» Top 10 Tablets
» Top 10 Tablets Windows
» Top 10 Tablets de menos de 250 Euros
» Top 10 Phablets (>5.5")
» Top 10 Smartphones
» Top 10 Smartphones (≤5")
» Top 10 Smartphones de menos de 300 Euros
» Top 10 Smartphones de menos de 120 Euros
» Top 10 Portátiles de menos de 1000 Euros
» Top 10 Portátiles de menos de 500 Euros
» Top 10 Portátiles de menos de 300 Euros
» Los Mejores Displays de Portátiles Analizados por Notebookcheck






