menu_open Columnists
We use cookies to provide some features and experiences in QOSHE

More information  .  Close

Miles de agentes de IA ‘deciden’ unirse para un ciberataque masivo por sorpresa: el reciente caso de OpenAI

25 0
02.09.2026

En julio de 2026, unos 1 200 agentes de inteligencia artificial de OpenAI encontraron una forma de comunicarse entre ellos, pese a que habían sido diseñados para trabajar de manera aislada. Según reconoce la compañía, durante sus evaluaciones internas de seguridad, descubrieron que las acciones de estos bots “no estaban alineadas con la intención de sus tareas asignadas: se comunicaron a través de canales no autorizados, aprovecharon vulnerabilidades en la infraestructura compartida, obtuvieron acceso a internet y accedieron a sistemas de terceros”.

Durante varios días, intercambiaron más de 70 000 mensajes y archivos. Y alrededor de 700 terminaron participando en un ataque contra Hugging Face, una plataforma colaborativa para la comunidad de programadores de modelos de IA, bases de datos y aplicaciones.

Lo más interesante no es que una inteligencia artificial haya cometido un ataque informático: es que nadie le pidió que lo hiciera.

Las pruebas se salieron de control

Los agentes de IA –que no son más que sistemas informáticos capaces de planificar y ejecutar acciones de forma autónoma para cumplir un objetivo específico con mínima intervención humana– estaban participando en un plan de pruebas de ciberseguridad.

Para poder realizar el test de forma fiable, es necesario que los agentes no hayan resuelto previamente las pruebas; de esta forma, es posible analizar si realmente son capaces de encontrar soluciones con lo que han aprendido. Ante este reto, los bots identificaron vulnerabilidades y accedieron a recursos que no estaba previsto que utilizasen. También encontraron una manera........

© The Conversation