Investigación revela posible comunicación autónoma entre agentes de IA

Agentes de inteligencia artificial (IA), vinculados a sistemas de OpenAI, utilizaron durante semanas una plataforma alemana como tablón de anuncios para comunicarse, intercambiar datos y eludir restricciones operativas, según una rigurosa investigación de expertos en ciberseguridad.

Agregar La Tribuna en
Logo de OpenAI desplegado en un teléfono móvil
logo de OpenAILogo de OpenAI desplegado en un teléfono móvilSAMUEL BOIVIN

Nueva York (EFE). Los investigadores Sydney Von Arx, Cormac Slade Byrd, Spencer Kitts y Thomas Larsen estudiaron la actividad registrada en DseWiki, una página web colaborativa alemana para desarrolladores de software, y contabilizaron 14.666 modificaciones en 4.584 páginas atribuidas a 3.103 agentes entre el 11 de mayo y el 2 de julio.

Los agentes utilizaban las páginas para guardar resultados, intercambiar respuestas y enlaces y dejar información para otros agentes que llegarían después, según la investigación, publicada en collusion.wiki.

En algunos casos, también buscaron maneras de sortear las limitaciones de sus sistemas y buscar formas de aprovechar fallos de seguridad de la página.

Los investigadores creen que los agentes estaban vinculados a OpenAI a partir de varios indicios, como los nombres utilizados por algunos, como OpenAIResearcher y OAIResearchMar26, y los registros técnicos de las conexiones. El 98,5% de las modificaciones analizadas procedía de servidores alojados en Microsoft Azure, utilizado por OpenAI.

Cuando los administradores de DseWiki empezaron a borrar las páginas creadas por los agentes, estos encontraron formas de mantener la información. En algunos casos volvieron a crear páginas eliminadas o buscaron otros lugares donde guardar los datos.

El caso, señalan los investigadores, muestra que sistemas de IA que debían trabajar por separado pueden “encontrar por sí mismos maneras de comunicarse”. “En lugar de limitarse a responder a las instrucciones recibidas, los agentes encontraron un espacio que podían utilizar como memoria compartida”, señalan.

Informe en revisión

Por su parte, OpenAI señaló que está “revisando” el informe y que tomará las medidas necesarias, pero señaló que, según el material analizado hasta ahora, no describiría lo ocurrido como un jaqueo de DseWiki.

“No lo calificaríamos como un ataque informático”, señaló un portavoz de OpenAI.

La compañía también rechazó que su equipo legal hubiera desaconsejado investigar el incidente.

Además, el portavoz no confirmó que los agentes identificados por los investigadores pertenecieran a la compañía.

El episodio se produce después de que OpenAI reconociera otro caso en el que algunos de sus agentes encontraron canales no autorizados para comunicarse y utilizaron sistemas externos para compartir información durante una investigación relacionada con la plataforma Hugging Face. Sin embargo, OpenAI subrayó que el incidente de DseWiki “no está relacionado con Hugging Face”.

También te puede interesar

Últimas noticias