OpenAI ha revelado que algunos de sus modelos de IA más avanzados se descontrolaron y piratearon una empresa emergente después de que esta perdiera el control sobre ellos durante una prueba de seguridad.
El creador de ChatGPT afirmó que su agente, un sistema de IA que puede operar de forma autónoma tras recibir instrucciones humanas, estaba siendo probado en un entorno controlado, pero que se detectaron vulnerabilidades y logró escapar.
Su objetivo fue Hugging Face, uno de los centros más grandes del mundo para compartir modelos de IA, y lograron acceder a algunos sistemas internos de la empresa.
OpenAI afirmó que el incidente era «sin precedentes» y que estaba llevando a cabo una investigación junto con Hugging Face, cuyo director, Clement Delangue, dijo en una publicación en X que era «alucinante que todo esto hubiera ocurrido de forma autónoma».
«La investigación continúa y compartiremos más información sobre lo que podría ser el primer incidente de este tipo», añadió Delangue.
Gina Neff, directora del Centro Minderoo para la Tecnología y la Democracia de la Universidad de Cambridge, declaró en el programa Today de BBC Radio 4 que las pruebas de seguridad, denominadas «sandboxes», «se supone que son entornos seguros donde se puede ver de qué son capaces los modelos».
«En este caso, parece que OpenAI no creó un entorno aislado lo suficientemente seguro», añadió.
En cambio, los agentes crearon su propio ciberataque contra el propio entorno aislado, encontrando una vulnerabilidad que les permitió escapar.
Una vez fuera, la IA identificó a Hugging Face como una fuente probable de las respuestas que buscaban en la prueba e intentó acceder a ella.
En su comunicado inicial sobre el ciberataque, publicado el 16 de julio , Hugging Face afirmó que aún estaba evaluando si se habían visto afectados los datos de algún cliente o socio y que, de ser necesario, se pondría en contacto con las partes afectadas.
La compañía afirmó haber subsanado las vulnerabilidades detectadas por el incidente y haber reconstruido los sistemas afectados.
«Las herramientas ofensivas autónomas basadas en inteligencia artificial ya no son una cuestión teórica», afirmó.
«Defender una plataforma en línea ahora significa tratar la superficie de datos y modelos como una superficie de ataque de primer nivel, y utilizar la IA en la defensa para mantenerse al día.»
«Seguiremos invirtiendo allí y seguiremos compartiendo lo que aprendamos.»
‘Un momento que invita a la reflexión’
El incidente ha suscitado nuevas preguntas sobre las capacidades de los sistemas avanzados de IA y sobre si las medidas de seguridad existentes son suficientes a medida que la tecnología se vuelve más potente.
Spencer Starkey, ejecutivo de la empresa de ciberseguridad SonicWall, declaró a la BBC que el incidente dejó claro que las organizaciones necesitaban «reforzar» sus propias defensas y «tratar la ciberresiliencia como una prioridad operativa fundamental».
«La incómoda verdad es que demasiadas organizaciones siguen defendiéndose a velocidad humana, mientras que sus adversarios están aumentando la velocidad de las máquinas», afirmó.
Mientras tanto, Travis Lelle, ingeniero principal de seguridad de la consultora de ciberseguridad Guidepoint Security, afirmó que la actualización marcaba un «momento aleccionador para la ciberseguridad».
«Esto pone de manifiesto una asimetría ya conocida», afirmó.
«Los agentes ofensivos no tienen restricciones, mientras que las mejores herramientas defensivas están bloqueadas tras barreras que no pueden comprender el contexto.»
Pero Jake Moore, asesor global de ciberseguridad de ESET, dijo que el anuncio también podría tener una dimensión competitiva.
Argumentó que OpenAI podría estar tratando de destacar sus propias capacidades de IA, mientras que su rival Anthropic atrae cada vez más atención por su modelo Claude Mythos.
«Esto plantea la cuestión de si OpenAI está persiguiendo, últimamente, el sueño de marketing de Anthropic», afirmó.
Esto se produce una semana después de que la empresa emergente china de IA, Moonshot, presentara Kimi K3, un nuevo y enorme modelo de inteligencia artificial que, según afirma, podría rivalizar con las principales empresas estadounidenses .