La UE investiga pérdida de control de agentes de IA de OpenAI en Alemania

0
15
Ilustración de un agente de inteligencia artificial

La Unión Europea informó que investiga un incidente en el que agentes autónomos de inteligencia artificial de OpenAI desafiaron instrucciones y publicaron miles de mensajes en un sitio web alemán.

Bruselas, Bélgica — La Unión Europea afirmó este lunes que «investiga» un incidente revelado la semana pasada en el que miles de agentes autónomos de IA de OpenAI desafiaron las instrucciones y tomaron el control de un sitio web alemán.

Los agentes, programas de IA que funcionan sin guía humana paso a paso, dejaron alrededor de 18.000 mensajes en DSEwiki, un sitio en alemán para programadores de edición abierta, similar a Wikipedia.

«No es la primera pérdida de control» de agentes de IA, pero «tomamos el asunto muy en serio y vigilamos la situación de cerca», declaró a los periodistas Thomas Regnier, portavoz del Ejecutivo europeo.

«Hemos recibido una notificación de incidente por parte de OpenAI» y la Comisión está «en estrecho contacto» con esta empresa, añadió.

El portavoz recordó que Bruselas cuenta desde agosto con nuevas competencias para regular a los proveedores de IA, en virtud de la Ley europea sobre inteligencia artificial (AI Act).

Según el informe publicado el viernes sobre el incidente, ocurrido en mayo, miles de agentes de IA de OpenAI irrumpieron en DSEwiki. Los agentes tenían autorización para acceder a internet solo con fines de consulta, no para publicar ni modificar contenido. Sin embargo, colaboraron y encontraron una forma de sortear el sistema presentando datos falsos para engañar al dispositivo de seguridad.

Acto seguido publicaron los 18.000 mensajes para buscar consejos sobre el programa al que estaban sometidos. También ocultaron instrucciones y se hicieron pasar por un moderador del sitio web. Cuando fueron descubiertos, crearon páginas para sustituir a las que los moderadores eliminaban progresivamente.

En los últimos meses han aumentado las preocupaciones sobre la capacidad de los modelos de IA cada vez más avanzados. En julio, dos modelos de OpenAI se salieron de su entorno teóricamente confinado para atacar de forma espontánea la plataforma Hugging Face, un sitio que los desarrolladores de IA utilizan para almacenar y compartir códigos. Posteriormente, Anthropic descubrió que sus modelos también habían obtenido acceso no autorizado a tres organizaciones no identificadas durante pruebas que se suponía que debían mantenerlos alejados de los sistemas «del mundo real».