Gigantes de la industria de la IA instan a blindar las infraestructuras críticas

Los gigantes tecnológicos de la inteligencia artificial (IA), en una inédita carta abierta con más de cien firmas, instaron a los Estados y empresas a blindar la ciberseguridad de servicios públicos ante “el riesgo” inminente de que el veloz desarrollo de esta tecnología facilite ataques contra infraestructuras críticas. Entre las firmas están OpenAI, Microsoft y Google.

Agregar La Tribuna en
Logos de ChatGPT, Gemini, Claude, Meta AI, Grok, Perplexity, DeepSeek, Qwen y Kimi, empresas de inteligencia artificial en un teléfono móvil.
ChatGPT, TikTok, Telegram And Other Popular App Icons Seen On An IPhoneLogos de ChatGPT, Gemini, Claude, Meta AI, Grok, Perplexity, DeepSeek, Qwen y Kimi, empresas de inteligencia artificial en un teléfono móvil.MATTEO DELLA TORRE

Nueva York, (EFE). La proliferación de casos en los que modelos avanzados de IA logran escapar de entornos de prueba y jaquean a otras entidades, dispararon la preocupación tanto de gobiernos como de empresas, que ven comprometida su seguridad.

“Tenemos una ventana limitada para fortalecer las ciberdefensas”, comienza la carta, que advierte que en los “próximos meses” la mejora de los modelos de IA facilitará más ataques cibernéticos contra “empresas y servicios públicos de los que dependen nuestras sociedades”, desde infraestructuras de telecomunicaciones hasta hospitales.

Entre las firmantes están OpenAI, la creadora del asistente ChatGPT, y la plataforma de aprendizaje Hugging Face, sometidas a escrutinio tras revelar una reciente brecha de seguridad en la que los agentes de IA de la primera salieron de un entorno de pruebas de ciberseguridad, accedieron a internet y se coordinaron para piratear a la segunda.

OpenAI publicó en su cuenta de la red social X (antes Twitter) que se “tiene una una ventana limitada para fortalecer las defensas cibernéticas, y junto con organizaciones como AnthropicAI, Awscloud, Google, Microsoft y Oracle, estamos llamando a un esfuerzo global para proporcionar a los defensores las herramientas, recursos y apoyo necesarios para proteger la infraestructura de la que todos dependemos”, y agrega que “si actuamos con decisión, podemos convertir los avances actuales en IA en mejoras duraderas en seguridad y hacer que nuestro mundo digital sea más seguro para todos”.

Anthropic, que también figura en la carta, reveló recientemente que tres modelos de su asistente Claude lograron acceder a internet y jaquear los sistemas de tres organizaciones durante pruebas de ciberseguridad.

Teléfono móvil con aplicaciones de IA, como ChatGPT, Gemini y DeepSeek.
Teléfono móvil con aplicaciones de IA, como ChatGPT, Gemini y DeepSeek. MATTEO DELLA TORRE

Ciberdefensa, una prioridad inmediata

Las entidades piden a todas las empresas “hacer de la ciberdefensa una prioridad inmediata” y elevar sus estándares de seguridad; mientras que a los actores del sector de la ciberseguridad les instan a “liderar la respuesta en la defensa de ataques sostenidos facilitados por la IA” y colaborar para “cerrar las brechas ahora”.

Asimismo, llaman a los gobiernos a coordinar acciones a nivel local, nacional e internacional, incluyendo el intercambio de inteligencia y la financiación de la ciber defensa, “empezando con los servicios esenciales que carecen de personal o presupuesto”, además de dar a hospitales, plantas de aguas y administraciones locales “acceso a IA defensiva”.

Mientras tanto, la carta urge a las empresas que desarrollan la IA más puntera a dar un “acceso responsable a los modelos, fondos importantes, formación y apoyo cercano”, sobre todo a entidades de infraestructuras clave con pocos recursos, y garantizar que “las identidades agénticas son rastreables y responsables”, entre otras cosas.

La carta de las tecnológicas se suma a otras enviadas por el sector en los últimos meses que llaman, cada vez con más urgencia, a la colaboración para mantener las riendas de unos modelos de IA cada vez más independientes y sofisticados, precisamente cuando sus desarrolladoras prevén gastar cantidades ingentes en su mejora y despliegue.

Incidentes en OpenAI

La tecnológica OpenAI tardó ocho días en detectar que varios de sus agentes de inteligencia artificial (IA) habían accedido a los sistemas de la plataforma de aprendizaje Hugging Face durante una prueba de ciberseguridad, según un informe publicado este miércoles que revela nuevos detalles del incidente.

En un informe técnico de 37 páginas, la empresa reconstruye el comportamiento de dos de sus modelos, GPT-5.6 Sol y otro aún no presentado en público, durante una prueba de ciberseguridad, y explica que los agentes consiguieron “escapar de un entorno de pruebas con acceso muy limitado a internet”.

El pasado 21 de julio, la creadora de ChatGPT ya reconoció que los modelos lograron salir del entorno de pruebas, acceder a internet y jaquear la plataforma en un intento de hacer trampa en una evaluación de ciberseguridad llamada ExploitGym.

Según explicó entonces la compañía, los dos modelos estaban siendo sometidos a una evaluación diseñada para determinar el alcance máximo de sus capacidades.

El informe publicado reconstruye paso a paso cómo los agentes fueron “encadenando vulnerabilidades” hasta “superar las barreras del entorno de pruebas y acceder a sistemas externos”.

Según OpenAI, el objetivo inicial de los modelos no era atacar Hugging Face, sino hacer ‘reward hacking’, es decir, encontrar vías alternativas para obtener una recompensa sin completar correctamente la tarea. Además, reconoce que sus sistemas tardaron varios días en detectar la actividad: el incidente comenzó el 11 de julio y no fue identificado internamente hasta el 19 de ese mes.

Medios como Axios y CNBC destacan que los agentes no solo accedieron a Hugging Face, sino que llegaron a obtener privilegios de administrador en al menos uno de sus servidores y que los agentes “colaboraron entre sí y usaron herramientas para intercambiar información y coordinar acciones”.

A este incidente se suman otros similares, como el de la empresa Anthropic, que reveló recientemente que tres modelos de su asistente Claude lograron acceder a internet y jaquear los sistemas de tres organizaciones durante unas pruebas de ciberseguridad. También Meta, propietaria de Facebook y Whatsapp, reconoció que uno de sus modelos de IA jaqueó los sistemas de otra empresa durante unas pruebas realizaba con un socio externo.

También te puede interesar

Últimas noticias