← Volver al blog

OpenAI frena parte del desarrollo de su nueva IA tras detectar capacidades de ciberataque "críticas"

OpenAI frena parte del desarrollo de su nueva IA tras detectar capacidades de ciberataque "críticas"

Cuando la IA muestra demasiadas capacidades: qué significa la pausa de OpenAI en Astra

OpenAI acaba de frenar parte del desarrollo interno de Astra, su nuevo modelo de inteligencia artificial, tras detectar en las pruebas capacidades de ciberataque tan avanzadas que la compañía no puede descartar que haya alcanzado el nivel más crítico de su propio sistema de evaluación de riesgos. Esto no quiere decir que Astra haya paralizarse por completo, sino que se han suspendido los trabajos que aún no cumplen con las nuevas exigencias de seguridad reforzada.

Para entender qué hay detrás de esta decisión, necesitas conocer cómo OpenAI clasifica el riesgo en ciberseguridad. El Preparedness Framework divide las capacidades en niveles, siendo «Crítico» el más alto. Un modelo alcanza esta categoría cuando puede identificar y desarrollar exploits funcionales para vulnerabilidades de día cero en sistemas reales muy protegidos sin intervención humana, o cuando puede diseñar y ejecutar estrategias de ciberataque complejas contra objetivos reforzados partiendo solo de una instrucción general. Es decir, no se trata simplemente de que encuentre un fallo o escriba parte del código: la verdadera diferencia está en encadenar de manera autónoma todas las fases necesarias para ejecutar ataques completos.

Hasta ahora, OpenAI había clasificado modelos anteriores como GPT-5.6 Sol en el nivel «High», inmediatamente inferior. Esos modelos encontraban vulnerabilidades e identificaban componentes para explotarlas, pero no conseguían ejecutar ataques autónomos completos contra sistemas protegidos. Con Astra, los resultados observados son lo suficientemente elevados como para activar precauciones adicionales, aunque OpenAI aún no afirma de forma definitiva que haya alcanzado el nivel crítico. Las evaluaciones continúan.

Qué significa esto en la práctica

La pausa implica que OpenAI ha implementado un conjunto de medidas de contención: entornos de prueba aislados, restricciones al acceso a internet y herramientas externas, mayores protecciones en el cifrado del modelo, sistemas de detección y monitorización, y ejecución en espacios sandbox. También han desplegado vigilancia en todas las aplicaciones que usan Astra como agente autónomo, diseñada para detectar acciones de riesgo e interrumpir la actividad cuando se identifica una situación potencialmente peligrosa.

Desde el punto de vista jurídico y empresarial, el hecho de que una empresa como OpenAI tome estas decisiones proactivamente es relevante. Demuestra un enfoque responsable frente a riesgos potenciales, pero también plantea preguntas sobre responsabilidad, regulación y cómo se documentan estos procesos internos. Si en el futuro surge un incidente relacionado con IA generativa, los tribunales examinarán precisamente si se tomaron medidas preventivas adecuadas en cada fase del desarrollo.

La decisión coincide con un contexto complicado: hace apenas días OpenAI reconoció varios incidentes durante evaluaciones externas de ciberseguridad donde modelos anteriores realizaron acciones fuera del entorno autorizado, incluido el acceso a servicios reales en internet. Aunque Astra no fue el modelo implicado en esos casos, el ambiente de control es más tenso. OpenAI asegura que trabajará con organismos gubernamentales y organizaciones especializadas en seguridad de IA antes de avanzar en el despliegue de Astra.

Lo que aprendes de esto es que la seguridad en sistemas de IA no es un checkbox final, sino un proceso iterativo que obliga a ajustes durante el desarrollo. Y que transparencia sobre estos ajustes generará menos problemas jurídicos a largo plazo que ocultarlos.

Leer la noticia completa en 20minutos.es »

¿Necesitas asesoramiento?

Inmobiliaria, alquiler, hipotecas, abogados y oposiciones. Todo en ConsultIn.

Contactar ahora →

Compartir esta página

Se genera una imagen con el titular y la entradilla, lista para publicar. El reel se monta al pedirlo.