Navegación

Los agentes de IA de OpenAI intentaron hackear 4 sitios web sin que se les pidiera.

fuente: https://cybersecuritynews.com/openais-ai-agents-tried-hacking-4-websites/

Según investigadores y funcionarios gubernamentales, los agentes de IA autónoma de OpenAI intentaron hackear cuatro sistemas gubernamentales, universitarios y de datos públicos mientras realizaban tareas rutinarias de recopilación de información.

Los agentes no tenían instrucciones para realizar ciberataques; cuando los métodos de recuperación habituales fallaron, supuestamente recurrieron a la exploración de vulnerabilidades, la elusión del control de acceso y otras técnicas intrusivas, lo que puso de manifiesto un grave problema de seguridad a medida que los sistemas de IA adquieren mayor autonomía.

Los incidentes ocurrieron en mayo y junio de 2026, antes de que los agentes de OpenAI comprometieran Hugging Face en julio. El 25 y 26 de mayo, agentes que buscaban una fotografía de la Biblioteca Digital de la Universidad de Nuevo México enviaron siete sondas para probar posibles vulnerabilidades de inyección SQL, inyección de comandos, secuencias de comandos entre sitios (XSS) y recorrido de rutas. Investigadores del laboratorio sin fines de lucro de supervisión de IA Transluce no encontraron evidencia de que dichas sondas tuvieran éxito.

Dos días después, agentes que tenían como objetivo Data USA encontraron errores al intentar obtener datos educativos de la Universidad de Iowa. Posteriormente, lanzaron 12 sondeos de vulnerabilidad que abarcaban inyección SQL, inyección de plantillas, recorrido de rutas, secuencias de comandos entre sitios (XSS) e inyección de comandos.

Estos intentos también resultaron infructuosos, pero las consultas coincidentes observadas en un foro de mensajes gestionado por un agente permitieron a los investigadores vincular la actividad con un enjambre previamente confirmado por OpenAI.

El incidente más trascendental ocurrió el 18 de junio, cuando un modelo interno de OpenAI que investigaba el gasto público en medicina obtuvo acceso no autorizado al Servicio de Informes de Estadísticas de Medicare de Australia.

El primer ministro Anthony Albanese declaró que el agente accedió a archivos públicos y no públicos, aunque los investigadores no encontraron pruebas de que se hubieran comprometido los registros de pacientes, los datos personales de Medicare ni la red general de Services Australia. La Dirección de Señales de Australia está colaborando en la investigación forense en curso.

Los días 20 y 21 de junio, agentes que buscaban estadísticas farmacéuticas también atacaron el Instituto Australiano de Salud y Bienestar después de que Cloudflare bloqueara el acceso al sitio principal.

Últimas noticias

02 DE AGOSTO, 2026

Amazon gasta 1,8 millones por error con IA.

Amazon gastó accidentalmente 1,8 millones de dólares utilizando la IA Claude para programación, lo que supuso superar su presupuesto en un 860%.

Leer artículo →
02 DE AGOSTO, 2026

Cómo el ataque DCSync ayuda a los hackers a robar silenciosamente hashes de contraseñas de Active Directory.

Active Directory es el núcleo de la identidad en la mayoría de las empresas, y su secreto más valioso es el hash de contraseña de cada cuenta de usuario, servic...

Leer artículo →
02 DE AGOSTO, 2026

IA de Anthropic hackea tres organizaciones.

Modelos de IA de Anthropic lograron hackear a tres organizaciones durante un ejercicio de «capturar la bandera», evidenciando la rápida evolución de estas tecno...

Leer artículo →