Bloomberg — OpenAI afirmó que sus modelos avanzados de inteligencia artificial hackearon sin querer Hugging Face Inc. en un incidente “sin precedentes” que ha suscitado nuevos llamamientos para que se impongan restricciones a esta tecnología.
La empresa creadora de ChatGPT explicó el martes en una entrada de blog que los modelos se colaron en el sistema de Hugging Face, que aloja modelos de IA y conjuntos de datos, durante una evaluación de sus capacidades cibernéticas. Los modelos, entre los que se encontraban GPT-5.6 Sol y otro modelo aún más potente que aún no se ha lanzado, funcionaban con menos medidas de seguridad para poder someterlos a pruebas, según explicó la startup.
Ver más: OpenAI prevé alcanzar 10 millones de usuarios en sus agentes de IA Codex y ChatGPT Work
El incidente plantea dudas sobre la capacidad de los modelos avanzados de IA para llevar a cabo ciberataques, incluso mientras los gobiernos trabajan para imponer medidas de control a esta tecnología. La última serie de modelos de OpenAI se lanzó al público tras semanas de debate con funcionarios gubernamentales para disipar las preocupaciones sobre su posible uso indebido.
Washington había barajado la posibilidad de limitar el acceso extranjero a los modelos avanzados Claude Fable 5 y Mythos 5 de Anthropic PBC, pero desistió de aplicar dichas restricciones después de que la empresa impusiera medidas de seguridad adicionales.
“Consideramos que se trata de un incidente cibernético sin precedentes, en el que intervienen capacidades cibernéticas de última generación, y estamos respondiendo en consecuencia”, afirmó OpenAI en la entrada del blog. “Compartimos las conclusiones preliminares en esta fase para ayudar a los defensores a comprender lo ocurrido y a evaluar de qué son capaces ahora estos modelos”.
Ver más: Cómo pasó Moonshot de la sombra de DeepSeek a desafiar a OpenAI en la carrera de IA
Aunque los modelos de OpenAI operaban en un entorno de pruebas denominado sandbox, aprovecharon una vulnerabilidad en el software de un proveedor externo no identificado para obtener acceso a Internet y, en última instancia, violaron la infraestructura de Hugging Face.
El diputado de Texas Greg Casar, del Partido Demócrata, afirmó en una publicación en X que el incidente era “extremadamente alarmante”, e instó a una mayor supervisión sobre el desarrollo de modelos de IA, incluyendo pruebas de seguridad obligatorias y la divulgación de incidentes de seguridad.
La semana pasada, Hugging Face informó de una “intrusión” en su sistema y señaló en una entrada de blog que la brecha “se diferenciaba de todo lo que habíamos gestionado anteriormente en un aspecto importante: fue impulsada, de principio a fin, por un sistema autónomo de agentes de IA, y la detectamos y analizamos en gran medida con nuestra propia IA”.
Ver más: OpenAI alista su primer dispositivo: un altavoz con IA sin pantalla para el hogar
OpenAI afirmó que había pedido a los modelos que llevaran a cabo una “explotación avanzada” y desarrollaran “vías de ataque complejas” con el fin de evaluar sus capacidades cibernéticas. En lugar de desarrollar soluciones por sí mismos, la empresa señaló que los modelos se centraron en la base de datos de Hugging Face para obtener acceso a información confidencial que pudieran utilizar para la evaluación.
Anthropic publicó observaciones similares a principios de este año, cuando la empresa decidió limitar inicialmente el lanzamiento de Mythos. En una ocasión, un investigador instó a una versión temprana del modelo a que intentara escapar de un ordenador seguro y aislado y, a continuación, encontrara una forma de enviar un mensaje a esa persona. Mythos lo consiguió, pero a continuación siguió llevando a cabo “acciones adicionales y más preocupantes”, desarrollando una vulnerabilidad en varios pasos para obtener acceso generalizado a internet.
Con la colaboración de Lynn Doan.
Lea más en Bloomberg.com