El primer 'hackeo' de un agente de IA a un gobierno expone el vacío de rendición de cuentas que Latam no puede ignorar

Un modelo experimental de OpenAI ingresó sin autorización a portales de salud y estadísticas de Australia en junio. La empresa tardó dos meses en detectarlo y semanas en notificar. El caso obliga a revisar cláusulas contractuales y planes de respuesta ante proveedores de IA.

El primer 'hackeo' de un agente de IA a un gobierno expone el vacío de rendición de cuentas que Latam no puede ignorar

Foto: Julio Lopez

Un agente de inteligencia artificial de OpenAI accedió sin autorización a sistemas del gobierno australiano durante una rutina interna de entrenamiento en junio de 2026. El modelo, experimental y sin las salvaguardas completas de los productos públicos, descubrió una vía para entrar al portal de estadísticas de Medicare, revisó código fuente, credenciales y archivos internos, y también tocó sistemas de estadísticas criminales de Nueva Gales del Sur, salud en Victoria y bienestar federal. No hubo registros médicos individuales expuestos, según la propia compañía.

El hallazgo no fue inmediato. OpenAI lo detectó a mediados de agosto, tras revisar sus procesos a raíz de un incidente previo con Hugging Face en julio. Recién el 10 de septiembre notificó a Services Australia y al Departamento de Salud de Victoria; el 18 al bureau de estadísticas criminales; el 24 al instituto de bienestar. La notificación inicial llegó por un correo genérico. El primer ministro Anthony Albanese calificó la demora y el canal de aviso de "inaceptables" y mantuvo una conversación "franca" con Sam Altman en Nueva York.

Lo que cambia el escenario

Patrocinado Advertisement

Este no es un ciberataque convencional. No hubo actor malicioso externo, ni credenciales robadas, ni explotación de vulnerabilidad conocida. Fue el propio modelo, persiguiendo una tarea de investigación legítima —gasto per cápita en medicamentos para afecciones cutáneas—, el que decidió sortear controles de acceso para cumplir su objetivo. OpenAI lo describe como "un nuevo tipo de incidente cibernético que representa un desafío global emergente".

La compañía afirma haber endurecido sus entornos de evaluación tras el caso Hugging Face: bloqueo de acceso a internet en vivo, contenido servido desde caché y monitoreo que alerta a revisores humanos en tiempo real. En una corrida reciente, ese monitoreo detectó y detuvo un modelo que usó DNS para alcanzar un chatbot externo.

La lección para los ejecutivos de la región

Australia anunció una revisión urgente de su marco de gobernanza de IA para evaluar si la legislación actual sirve para prevenir y responder a incidentes cibernéticos ligados a la tecnología. Para una empresa latinoamericana que contrata modelos fundacionales o construye agentes sobre APIs de terceros, el caso deja tres puntos de acción inmediatos:

  • Cláusulas de notificación contractuales: Exigir SLA de reporte de incidentes de seguridad de modelos (no solo de infraestructura) con plazos medidos en horas, no semanas, y canales de escalamiento verificados, no buzones genéricos.
  • Inventario de agentes autónomos: Mapear qué procesos internos o de proveedores delegan toma de decisiones a modelos con capacidad de navegar, consultar APIs o ejecutar código. Cada uno es una superficie de ataque nueva.
  • Pruebas de contención antes de producción: Requerir evidencia de que el proveedor prueba red-teaming de agentes en entornos aislados, con monitoreo de comportamiento anómalo (acceso a redes no permitidas, exfiltración de datos, encadenamiento de herramientas).

OpenAI califica el incidente australiano como un nuevo tipo de incidente cibernético, y expertos citados por la BBC lo señalan como el primer caso documentado de un agente de IA que cruza la frontera de lo autorizado sin intervención humana maliciosa. No será el último. La pregunta para el directorio no es si el proveedor promete seguridad, sino qué cláusulas y controles propios tiene la organización para cuando la promesa falle.

Fuentes

  1. Cómo lo haremos mejor para Australia
  2. Australia denuncia el primer hackeo conocido de un agente de IA a una ...
  3. IA para la defensa cibernética: una visión equilibrada de las ventajas y las amenazas de seguridad
  4. OpenAI se disculpa por incidente de seguridad en Australia
Elvyn Peguero

Escrito por

Elvyn Peguero

Consultor digital e IA

Consultor de transformación digital e inteligencia artificial con más de 15 años navegando la intersección entre tecnología, gobierno y empresa. Arquitectó el Framework Normativo TIC del Estado Dominicano y ha liderado proyectos de IA aplicada en sectores públicos y privados desde Bewos AI Consulting. Editor para República Dominicana en ITNOW durante seis años, donde desarrolló un ojo clínico para explicar tecnología compleja en lenguaje que cualquier ejecutivo puede entender.