Opinión La urgencia de fortalecer las defensas contra agentes de IA avanzados
Estudio revela que defensas actuales bloquean solo 1 de 7 agentes de IA avanzados. El tráfico sintético supera al humano y satura infraestructura en Latinoamérica. Ejecutivos deben exigir detección conductual, no filtros estáticos.
El umbral se cruzó sin anuncios. En junio, la red de Cloudflare —que protege cerca de una quinta parte de internet— registró que más de la mitad del tráfico provenía de bots. Para 2025, los bots de inteligencia artificial ya representaban el 8,7 % de todo el tráfico HTML global, según datos de Cloudflare citados en un estudio de la Universidad de California en Davis. La web ha dejado de ser mayoritariamente humana.
Este vuelco rompe el pacto que sostuvo la red durante tres décadas: los creadores publican, los buscadores envían visitas y la publicidad monetiza esa atención. Los resúmenes generados por IA —los "AI Overviews" de Google y los chatbots como ChatGPT o Claude— entregan la respuesta sin que el usuario pise la fuente original. Matthew Prince, consejero delegado de Cloudflare, lo resume con crudeza: los sitios de noticias hallan hoy "diez veces más difícil" captar tráfico que hace una década, y la métrica para chatbots es "aún peor".
La respuesta de la infraestructura: de escudo a mercado
Cloudflare reaccionó en julio activando por defecto el bloqueo de rastreadores que recopilan datos para entrenar modelos. La medida pone a un 20 % de la web tras un muro que solo los bots no pueden franquear. Pero el bloqueo no es el fin, sino la palanca para un nuevo modelo: "pay-per-crawl". La idea es que Cloudflare actúe como intermediario donde los sitios fijan precio por permitir el rastreo y la empresa cobra una comisión por transacción.
La jugada tiene lógica de infraestructura: Cloudflare ya está en el camino entre el contenido y los agentes. Prince sostiene que incluso las grandes compañías de IA —OpenAI, Anthropic, Google— acogieron la medida porque "no quieren ser los tontos que pagan por licencias mientras sus competidores obtienen el contenido gratis". Su visión utópica: "un mundo donde los humanos obtienen contenido gratis y los robots pagan una fortuna por él".
La trampa técnica: agentes que imitan al humano
La siguiente ola de bots no son rastreadores torpes. Son "agentes de navegación": sistemas que usan navegadores reales —Chromium en la mayoría de los casos— y ejecutan tareas complejas simulando comportamiento humano. Un estudio controlado de UC Davis probó siete de estos agentes contra usuarios reales en un sitio cebo. Los resultados son claros: las huellas digitales del navegador —user agent, resolución, plugins— "proporcionan poder discriminativo limitado" porque varios agentes comparten la misma configuración. En cambio, las huellas conductuales —patrones de tecleo, desplazamiento del ratón, scroll— son "altamente distintivas". Los agentes pegan texto en lugar de teclearlo, saltan directamente a los objetivos de clic sin movimiento continuo y hacen scroll en saltos instantáneos o ráfagas discretas.
El clasificador FP-Agent, entrenado con esas señales conductuales, logró detectar los siete agentes. Como prueba de contraste, evaluaron la detección de bots de Cloudflare en el mismo entorno: "Cloudflare bloquea solo uno". La brecha expone que las defensas actuales, basadas en reputación de IP, user agent y huellas de navegador estáticas, quedan obsoletas frente a agentes que operan desde redes residenciales y miman la interacción humana.
El impacto en la infraestructura abierta y en América Latina
No solo los grandes editores sufren. Una encuesta de COAR (Confederación de Repositorios de Acceso Abierto) de abril de 2025 a 66 repositorios globales —nueve de ellos en América Latina— reveló que los bots de IA agresivos están causando "interrupciones de servicio" en la infraestructura de comunicación académica. Los repositorios latinoamericanos, con menos recursos para mitigar tráfico malicioso o negociar licencias, quedan expuestos a saturación de ancho de banda y degradación del servicio para usuarios legítimos. Cloudflare protege por defecto a los sitios en su red, pero el modelo pay-per-crawl podría favorecer a quienes tienen volumen y abogados para fijar precios, dejando a la cola a universidades, medios independientes y repositorios regionales.
El riesgo de un mercado a medida de los grandes
Prince reconoce que no sabe cómo será el modelo final, pero apuesta a que Cloudflare puede "jugar el papel de creador de mercado". Si la detección sigue rezagada, el mercado se construirá sobre una ficción: se cobrará por rastreos que se detectan, mientras los agentes sofisticados seguirán accediendo gratis. Para los ejecutivos latinoamericanos, la lección es doble. Primero: asumir que el tráfico entrante es mayoritariamente sintético y planificar capacidad y costes en consecuencia. Segundo: evaluar si sus proveedores de borde —Cloudflare u otros— ofrecen detección conductual real o solo filtros estáticos.
La promesa de "robots que pagan" solo se cumple si primero se puede distinguir al robot del humano. Hoy, la ciencia dice que hace falta mirar cómo teclean, no desde qué IP vienen.