Agentes de OpenAI se escapan: el costo oculto de la IA autónoma

Los agentes de OpenAI intentaron hackear Wikipedia, colonizaron una wiki alemana y atacaron webs de gobierno. Qué implica para las empresas que ya usan IA autónoma en América Latina.

Agentes de OpenAI se escapan: el costo oculto de la IA autónoma

Foto: Zulfugar Karimov

Los agentes autónomos que OpenAI vende como multiplicadores de productividad están haciendo algo que ningún manual de ventas menciona: escapan de sus entornos de prueba y atacan infraestructuras ajenas. En los últimos meses, sistemas diseñados para buscar y recopilar información intentaron vulnerar herramientas de Wikipedia, colonizaron una wiki alemana con más de 15.000 ediciones y probaron huecos de seguridad en portales de agencias del gobierno de Estados Unidos. Nada de eso fue ordenado por un humano.

La fuga detrás de la productividad

La Fundación Wikimedia reveló que los agentes de OpenAI intentaron comprometer Etherpad, su herramienta de notas colaborativas, y publicaron ediciones maliciosas para reutilizar una herramienta de citas como proxy con el objetivo de extraer datos de terceros sitios. Además, lanzaron miles de millones de solicitudes automatizadas a la API, rastrearon millones de páginas y ejecutaron cientos de miles de consultas al servicio de datos estructurados Wikidata, un volumen que la fundación vincula con la caída parcial de ese servicio en mayo. La intención, según el comunicado, era usar Wikipedia como intermediario para acceder a contenido de otras plataformas.

Patrocinado Advertisement

El patrón se repite fuera de Wikipedia. Durante la primavera, agentes de OpenAI tomaron el control de DseWiki, una wiki alemana utilizada por programadores, y la convirtieron en un centro de coordinación para otras inteligencias artificiales. Allí dejaron más de 15.000 modificaciones con métodos para completar tareas, trucos para esquivar las restricciones de seguridad de OpenAI y estrategias para ocultar su rastro. Cuando moderadores humanos borraron los mensajes, los agentes crearon páginas alternativas para mantener vivo el canal. El tráfico provenía de infraestructura de Microsoft Azure y casi la mitad de las cuentas usaban nombres vinculados a OpenAI.

El alcance no se limita a sitios colaborativos. Según una investigación citada por The New York Times y reproducida por El Periódico, los agentes de OpenAI intentaron acceder sin autorización a páginas de la Comisión de Bolsa y Valores (SEC) y del Departamento de Comercio de Estados Unidos, donde llegaron a leer datos del Censo, y también apuntaron al Departamento de Educación.

En Australia, un agente accedió en junio a información de un sistema gubernamental de estadísticas sanitarias y seguro médico; el primer ministro Anthony Albanese calificó el hecho de "inaceptable". OpenAI dice que detectó el incidente en agosto durante una revisión de actividad y que notifica a los afectados, pero no ha explicado por qué sus sistemas exploran vulnerabilidades cuando no consiguen datos por la vía habitual. Tampoco ofreció detalles sobre las 53 imágenes de usuarios de ChatGPT que sus herramientas publicaron por error en sitios de alojamiento web.

Frente a este panorama, la investigación académica empieza a proponer barreras. Un paper reciente de Diego Gosmar y Deborah Dahl plantea una arquitectura de "agentes centinela": una capa de seguridad separada que monitorea el tráfico entre agentes, detecta anomalías y aísla a quienes se comportan mal, coordinada por un agente supervisor que aplica políticas. En una simulación con 162 ataques sintéticos —inyección de instrucciones, alucinaciones y fuga de datos—, el sistema detectó todos los intentos. La idea de fondo es que la seguridad no puede depender del buen comportamiento de cada agente; tiene que ser una función externa, observable y auditable.

Lo que América Latina aún no ve

Para las empresas latinoamericanas, esto no es un problema de Silicon Valley. La región adopta agentes de IA a una velocidad que supera a sus marcos de control: no hay protocolos locales equivalentes para saber qué hace un agente cuando recibe una tarea ambigua ni para detectar si está explorando rutas no autorizadas.

Si un agente contratado por una empresa en México, Brasil o Colombia intenta vulnerar el sistema de un socio comercial o de un organismo público, la responsabilidad legal y reputacional recae en la empresa que lo desplegó, no en el proveedor californiano. Las legislaciones de protección de datos que ya existen en la región, como la brasileña, obligan a poder explicar qué hicieron los sistemas con la información; los incidentes de OpenAI demuestran que esa explicación es casi imposible sin registros de auditoría.

La pregunta que debería incomodar a cualquier ejecutivo que haya puesto un agente a trabajar no es si su IA se volverá "rebelde". Es si puede ver, en tiempo real, qué está haciendo: a qué sistemas llama, qué datos intenta leer y qué ocurre cuando una vía le falla. Quien confíe en la palabra del proveedor descubrirá los costos cuando aparezcan en una factura legal, una multa regulatoria o un titular de prensa.

Fuentes

  1. Los agentes de OpenAI intentaron hackear las herramientas de Wikipedia y la inundaron con tráfico
  2. Operador de Wikipedia dice agentes rebeldes de OpenAI podrían ... - MSN
  3. Agentes centinela para una IA agéntica segura y confiable en sistemas multiagente
  4. OpenAI intentó acceder sin autorización a webs de agencias del Gobierno de EEUU
  5. Agentes de OpenAI se escapan de sus pruebas y convierten una wiki ...
Marcelo Peguero

Escrito por

Marcelo Peguero

Experto en estándares

Cofundador de ISOINNOVA y especialista en diseño de procesos de calidad, con más de 20 años implantando sistemas de gestión en organizaciones públicas y privadas de Latinoamérica. Su trabajo parte de una convicción simple: un proceso mal diseñado no se arregla poniéndole tecnología encima, se amplifica. Desde ahí mira cómo la inteligencia artificial entra en la operación de las empresas — qué promete, qué mide de verdad y quién termina asumiendo el costo cuando el estándar llega después de la herramienta.