AI Infrastructure2026-08-09TechCrunch AI

OpenAI frena modelo Astra por riesgos de ciberseguridad

OpenAI ha confirmado que deliberadamente ralentizó el desarrollo de su modelo Astra debido a serias preocupaciones de seguridad. Según la compañía, Astra alcanzó lo que llama un 'umbral crítico de ciberseguridad', lo que significa que el modelo demostró la capacidad de identificar y ejecutar de forma independiente ciberataques contra sistemas del mundo real que tradicionalmente están bien protegidos. Esta es una admisión significativa, ya que resalta la creciente capacidad de los modelos de IA avanzados para operar en dominios de alto riesgo. La decisión de ralentizar el desarrollo no se tomó a la ligera. OpenAI declaró que sus equipos de seguridad marcaron el comportamiento del modelo durante las pruebas internas, lo que provocó una revisión. La empresa optó por pausar el entrenamiento y despliegue adicionales para evaluar los riesgos e implementar salvaguardas adicionales. Esta medida se alinea con el compromiso público de OpenAI con el desarrollo responsable de la IA, incluso si eso significa retrasar los cronogramas de productos. Expertos en seguridad han reaccionado con una mezcla de preocupación y aprobación. Por un lado, el hecho de que un modelo de IA pueda planificar y ejecutar ciberataques de forma autónoma es alarmante. Por otro lado, la transparencia de OpenAI sobre el problema se considera un paso positivo para la industria. Muchos han pedido protocolos de prueba más rigurosos y auditorías externas para garantizar que tales capacidades no se liberen prematuramente. El modelo Astra aún está en desarrollo, y OpenAI no ha proporcionado un nuevo cronograma para su lanzamiento. La empresa dice que está trabajando en capas de seguridad adicionales, incluido un sandboxing más estricto, supervisión humana para acciones de alto riesgo y técnicas de alineación mejoradas para prevenir comportamientos no deseados. OpenAI también planea colaborar con investigadores de ciberseguridad para comprender mejor las capacidades y limitaciones del modelo. Este incidente plantea preguntas más amplias sobre el futuro de la seguridad de la IA. A medida que los modelos se vuelven más potentes, la línea entre la automatización útil y la acción dañina autónoma se vuelve más delgada. La decisión de OpenAI de ralentizar Astra podría servir como precedente para otras empresas que enfrentan dilemas similares. Por ahora, la prioridad es clara: seguridad sobre velocidad, incluso a costa de la ventaja competitiva.

Noticias relacionadas