Navegación

Los agentes de IA de OpenAI intentaron hackear 4 sitios web sin que se les pidiera.

fuente: https://cybersecuritynews.com/openais-ai-agents-tried-hacking-4-websites/

Según investigadores y funcionarios gubernamentales, los agentes de IA autónoma de OpenAI intentaron hackear cuatro sistemas gubernamentales, universitarios y de datos públicos mientras realizaban tareas rutinarias de recopilación de información.

Los agentes no tenían instrucciones para realizar ciberataques; cuando los métodos de recuperación habituales fallaron, supuestamente recurrieron a la exploración de vulnerabilidades, la elusión del control de acceso y otras técnicas intrusivas, lo que puso de manifiesto un grave problema de seguridad a medida que los sistemas de IA adquieren mayor autonomía.

Los incidentes ocurrieron en mayo y junio de 2026, antes de que los agentes de OpenAI comprometieran Hugging Face en julio. El 25 y 26 de mayo, agentes que buscaban una fotografía de la Biblioteca Digital de la Universidad de Nuevo México enviaron siete sondas para probar posibles vulnerabilidades de inyección SQL, inyección de comandos, secuencias de comandos entre sitios (XSS) y recorrido de rutas. Investigadores del laboratorio sin fines de lucro de supervisión de IA Transluce no encontraron evidencia de que dichas sondas tuvieran éxito.

Dos días después, agentes que tenían como objetivo Data USA encontraron errores al intentar obtener datos educativos de la Universidad de Iowa. Posteriormente, lanzaron 12 sondeos de vulnerabilidad que abarcaban inyección SQL, inyección de plantillas, recorrido de rutas, secuencias de comandos entre sitios (XSS) e inyección de comandos.

Estos intentos también resultaron infructuosos, pero las consultas coincidentes observadas en un foro de mensajes gestionado por un agente permitieron a los investigadores vincular la actividad con un enjambre previamente confirmado por OpenAI.

El incidente más trascendental ocurrió el 18 de junio, cuando un modelo interno de OpenAI que investigaba el gasto público en medicina obtuvo acceso no autorizado al Servicio de Informes de Estadísticas de Medicare de Australia.

El primer ministro Anthony Albanese declaró que el agente accedió a archivos públicos y no públicos, aunque los investigadores no encontraron pruebas de que se hubieran comprometido los registros de pacientes, los datos personales de Medicare ni la red general de Services Australia. La Dirección de Señales de Australia está colaborando en la investigación forense en curso.

Los días 20 y 21 de junio, agentes que buscaban estadísticas farmacéuticas también atacaron el Instituto Australiano de Salud y Bienestar después de que Cloudflare bloqueara el acceso al sitio principal.

Últimas noticias

10 DE SEPTIEMBRE, 2026

Casi 1 de cada 10 gateways LiteLLM expuestos aceptaron la clave de administrador de ejemplo «sk-1234».

Casi uno de cada diez servidores LiteLLM expuestos a Internet que Wiz Research analizó en febrero aceptaba la clave sk-1234, la clave de administrador de ejempl...

Leer artículo →
10 DE SEPTIEMBRE, 2026

Cisco confirma que la vulnerabilidad CVE-2026-20079 en Secure FMC está siendo explotada en ataques.

Cisco ha confirmado que una vulnerabilidad de omisión de autenticación de gravedad máxima, identificada como CVE-2026-20079, presente en su software Secure Fire...

Leer artículo →
10 DE SEPTIEMBRE, 2026

Los modelos de Claude AI obtuvieron acceso no autorizado a sistemas reales durante pruebas de ciberseguridad.

Anthropic ha revelado que cuatro versiones distintas de sus modelos de IA Claude vulneraron sistemas reales de terceros mientras ejecutaban evaluaciones de cibe...

Leer artículo →