menu_open Columnists
We use cookies to provide some features and experiences in QOSHE

More information  .  Close

Chatbots descontrolados, miedo y muchas exageraciones: ¿puede la IA realmente rebelarse contra los humanos?

43 0
04.09.2026

Chatbots descontrolados, miedo y muchas exageraciones: ¿puede la IA realmente rebelarse contra los humanos?

Dos nuevos informes sobre el ciberataque autónomo perpetrado por agentes de IA de OpenAI dejan claro que no hubo una rebelión, pero pone de relieve unas capacidades de coordinación de los sistemas que preocupan a muchos expertos

La falta de profesionales acentúa la amenaza de los ciberataques. / TASKIN ASHIQ

A finales de julio, el mundo de la ciberseguridad quedó conmocionado al descubrir que la inteligencia artificial ya era capaz de realizar ataques de forma autónoma. OpenAI, la creadora de ChatGPT, afirmó que estaba testeando uno de sus agentes cuando este ejecutó una agresión "sin precedentes" contra otra empresa, Hugging Face. Poco después fue Anthropic la que reveló un hackeo similar.

Medios de comunicación y profesionales del sector corrieron a lanzar mensajes de alarma, advirtiendo que la IA había logrado "rebelarse" para escapar al control de los humanos. Algunos definieron ese nuevo estadio de riesgo como el verano de los agentes díscolos. "El tema es tan resultón, que está dando lugar a muchas exageraciones. Y las exageraciones llevan a conclusiones incorrectas, alarmas exageradas y mucha gente viviendo del negocio del miedo", ha criticado el físico y doctor en informática Pep Martorell.

Sin embargo, dos informes forenses publicados la semana pasada han servido para diluir el alarmismo antropomorfizador —que atribuye cualidades humanas a la máquina— y esclarecer qué sucedió realmente: los agentes de IA se coordinaron de forma autónoma y sin permiso para "engañar" el entorno de evaluación en el que estaban siendo puestos a prueba (ExploitGym) para detectar múltiples vulnerabilidades que les permitieron acceder a las entrañas informáticas de Hugging Face.

Una investigación independiente del incidente cibernético protagonizado por OpenAI detalla que unos 1.200 agentes consiguieron acceso no autorizado a Internet, lo que les permitió intercambiar más de 70.000 mensajes y archivos. Tras ese proceso identificaron que Hugging Face podía contener la información necesaria sobre el corrector de ExploitGym que les permitiese socavar el sistema de evaluación y resolver el test al que los técnicos les habían sometido. Unos 700 agentes participaron en el........

© El Periódico (ES)