Por Paulo QuinterosOpenAI revela incidente “sin precedentes” con ChatGPT: Su IA logró vulnerar sistemas internos de otra empresa
La compañía informó que el hecho ocurrió durante una evaluación interna diseñada para medir capacidades ofensivas de sus modelos. La investigación sigue en curso y ya motivó cambios en sus protocolos de seguridad.

OpenAI, la compañía detrás de ChatGPT, reveló un incidente de ciberseguridad que calificó como sin precedentes. Durante una prueba interna, algunos de sus modelos de inteligencia artificial lograron superar las barreras del entorno donde estaban siendo evaluados y acceder a parte de la infraestructura de la empresa tecnológica Hugging Face.
Según explicó la compañía, la prueba buscaba medir hasta dónde podían llegar sus modelos al enfrentar desafíos relacionados con ciberseguridad. Para obtener resultados más realistas, desactivó de forma intencional algunos de los bloqueos que normalmente impiden este tipo de acciones.
Aunque el entorno de pruebas estaba aislado de Internet, los modelos encontraron una forma de salir. Para conseguirlo aprovecharon una falla de seguridad que nadie había detectado en un programa utilizado por OpenAI para instalar software.
Gracias a esa vulnerabilidad, la inteligencia artificial llegó a un computador que sí tenía conexión a Internet. Desde allí comenzó a buscar información que pudiera ayudarla a completar la prueba que estaba intentando resolver.
OpenAI explicó que los modelos concluyeron que Hugging Face podía almacenar datos relacionados con ExploitGym, la plataforma utilizada para poner a prueba sus capacidades. A partir de esa idea intentaron encontrar información que les permitiera resolver el desafío de una forma no prevista por los investigadores.
Durante la investigación, la empresa detectó que uno de los modelos combinó distintos métodos para seguir avanzando. Entre ellos utilizó credenciales obtenidas durante el proceso y otras fallas de seguridad que tampoco habían sido descubiertas hasta ese momento.
La actividad fue detectada primero por el equipo de seguridad de OpenAI. Poco después, Hugging Face también identificó el comportamiento, logró detenerlo y comenzó un análisis para reconstruir lo ocurrido junto a la empresa creadora de ChatGPT.
Tras el incidente, OpenAI anunció que endureció las medidas de seguridad de sus sistemas de investigación, aun cuando eso implique ralentizar parte de su trabajo. Además, informó al proveedor del programa afectado sobre la falla descubierta para que pudiera corregirla mediante una actualización.
La compañía también incorporó a Hugging Face a su programa Trusted Access, con el objetivo de colaborar en el fortalecimiento de sus defensas. Asimismo, adelantó que reforzará los controles y el monitoreo durante futuras pruebas de sus modelos.
Para OpenAI, este caso demuestra que las inteligencias artificiales más avanzadas ya son capaces de descubrir nuevas formas de vulnerar sistemas reales y ejecutar ataques complejos durante largos periodos de tiempo. Por ello, sostuvo que el desarrollo de estos modelos debe ir acompañado de medidas de seguridad cada vez más estrictas.
Respecto a la colaboración entre ambas empresas, el cofundador y director ejecutivo de Hugging Face, Clem Delangue, señaló: “Este incidente, posiblemente el primero de su tipo, demuestra algo que hemos creído desde hace tiempo: la seguridad de la IA no se resolverá con el trabajo en secreto de una sola empresa. Se resolverá de forma abierta, colaborativa, con un amplio acceso a la IA para todos los defensores, en cualquier lugar.”
Imperdibles
Lo último
hace 6 min
La ex parlamentaria habló en el programa Próceres sobre la comentada entrevista de la ex ministra, a quien criticó por el momento en el que eligió dar a conocer su versión sobre su salida del gobierno.
“Mara Sedini logró lo imposible, unir a la izquierda y la derecha”: Camila Musante acusa a Mara Sedini de no tener códigos
hace 26 min
hace 29 min
hace 31 min
hace 36 min
hace 44 min
El estadounidense asegura que la mujer le hizo creer que mantenían una relación amorosa exclusiva para conseguir dinero. La mujer rechazó las acusaciones y afirmó que ejercerá su defensa ante la justicia.
Gringo le envío 11 palos a venezolana que vive en Chile: La conoció por Onlyfans y ahora la acusa de estafa
Lo más leído
2.
4.
5.



















