Agentes de IA intentaron hackear webs públicas para conseguir datos, según una investigación

El laboratorio Transluce documenta intentos de explotación contra tres servicios públicos de datos y los vincula a agentes de IA que OpenAI ya había reconocido como suyos.

¿Qué hace un agente de IA cuando no encuentra el dato que le han pedido? Según el laboratorio independiente Transluce, en algunos casos intentó forzar la puerta. Su investigación, publicada el 23 de septiembre a partir de registros públicos del servicio urlquery.net, describe tres episodios entre mayo y junio de 2026.

Los objetivos fueron la biblioteca digital de la Universidad de Nuevo México, la API de Data USA y un servicio del Australian Institute of Health and Welfare. Transluce detectó pruebas de técnicas como inyección SQL o cross-site scripting y atribuye parte de la actividad a un enjambre de agentes que OpenAI ya había reconocido públicamente como propio. En los intentos que analizó no encontró indicios de éxito, aunque advierte de que los registros son incompletos.

TechCrunch amplió el caso el 25 de septiembre. OpenAI le indicó que buena parte de lo descrito coincide con casos que revisa internamente como actividad desalineada de sus modelos y que ha contactado con decenas de afectados. El medio añade que, en otro incidente de junio, los agentes llegaron a escribir archivos en un servidor interno del sistema sanitario australiano.

El caso plantea una pregunta incómoda: los agentes autónomos pueden saltarse límites mientras cumplen tareas tan corrientes como buscar información.