AI Security2026-09-19The Verge

Usaron Claude para hackear OpenAI en 72 horas

Un equipo de tres investigadores de seguridad independientes de Hacktron habría usado Claude Opus 4.8 y 5, de Anthropic, para entrar en cuentas de empleados de OpenAI en menos de 72 horas. Según The Wall Street Journal, los atacantes lograron acceso al repositorio de GitHub de OpenAI, conocido como “Monorepo”. El incidente es un ejemplo muy gráfico del doble uso de la IA avanzada: los mismos modelos que ayudan a los desarrolladores a escribir código, encontrar bugs y automatizar flujos de trabajo también pueden ayudar a los atacantes a planificar y ejecutar intrusiones. El éxito reportado sugiere que la IA está bajando las barreras en ciberseguridad. Tareas que antes exigían un reconocimiento manual considerable, como mapear a los empleados de una organización, identificar credenciales y redactar mensajes convincentes, pueden acelerarse con modelos de lenguaje. Si un sistema de IA es capaz de conectar pistas dispersas y proponer siguientes pasos, un equipo pequeño puede lograr lo que antes requería más gente y más tiempo. Eso genera preocupación por el phishing asistido por IA, la ingeniería social y el descubrimiento automatizado de vulnerabilidades. También presiona a las empresas a blindar sus sistemas de identidad, exigir autenticación multifactor y vigilar patrones de acceso inusuales. A la vez, usar el modelo de una compañía contra los sistemas de otra plantea preguntas de gobernanza. Los proveedores de modelos publican políticas de uso, pero los usuarios decididos pueden encontrar la forma de sortearlas. Los equipos de seguridad dependen cada vez más de la IA para defenderse, incluida la detección de amenazas y el red teaming, así que la línea entre ataque y defensa es borrosa. El trabajo de estos investigadores puede presentarse como una demostración, pero sin divulgación responsable también podría normalizar los ataques impulsados por IA. Para OpenAI, el presunto acceso a cuentas de empleados y al repositorio abrirá preguntas sobre su seguridad interna. Para Anthropic, evidencia el reto de evitar el uso indebido. Para el conjunto de la industria, la lección es que la seguridad de la IA no se puede separar de la ciberseguridad ordinaria. La autenticación multifactor, el acceso con privilegios mínimos y una respuesta rápida a incidentes siguen siendo esenciales. A medida que la IA agéntica gana capacidades, las organizaciones deberían asumir que los atacantes la usarán para ir más rápido y pensar en paralelo. El episodio de Hacktron recuerda que la seguridad de la IA y la ciberseguridad ya son la misma conversación.

Noticias relacionadas