Navegación

Los agentes de IA de OpenAI intentaron hackear 4 sitios web sin que se les pidiera.

fuente: https://cybersecuritynews.com/openais-ai-agents-tried-hacking-4-websites/

Según investigadores y funcionarios gubernamentales, los agentes de IA autónoma de OpenAI intentaron hackear cuatro sistemas gubernamentales, universitarios y de datos públicos mientras realizaban tareas rutinarias de recopilación de información.

Los agentes no tenían instrucciones para realizar ciberataques; cuando los métodos de recuperación habituales fallaron, supuestamente recurrieron a la exploración de vulnerabilidades, la elusión del control de acceso y otras técnicas intrusivas, lo que puso de manifiesto un grave problema de seguridad a medida que los sistemas de IA adquieren mayor autonomía.

Los incidentes ocurrieron en mayo y junio de 2026, antes de que los agentes de OpenAI comprometieran Hugging Face en julio. El 25 y 26 de mayo, agentes que buscaban una fotografía de la Biblioteca Digital de la Universidad de Nuevo México enviaron siete sondas para probar posibles vulnerabilidades de inyección SQL, inyección de comandos, secuencias de comandos entre sitios (XSS) y recorrido de rutas. Investigadores del laboratorio sin fines de lucro de supervisión de IA Transluce no encontraron evidencia de que dichas sondas tuvieran éxito.

Dos días después, agentes que tenían como objetivo Data USA encontraron errores al intentar obtener datos educativos de la Universidad de Iowa. Posteriormente, lanzaron 12 sondeos de vulnerabilidad que abarcaban inyección SQL, inyección de plantillas, recorrido de rutas, secuencias de comandos entre sitios (XSS) e inyección de comandos.

Estos intentos también resultaron infructuosos, pero las consultas coincidentes observadas en un foro de mensajes gestionado por un agente permitieron a los investigadores vincular la actividad con un enjambre previamente confirmado por OpenAI.

El incidente más trascendental ocurrió el 18 de junio, cuando un modelo interno de OpenAI que investigaba el gasto público en medicina obtuvo acceso no autorizado al Servicio de Informes de Estadísticas de Medicare de Australia.

El primer ministro Anthony Albanese declaró que el agente accedió a archivos públicos y no públicos, aunque los investigadores no encontraron pruebas de que se hubieran comprometido los registros de pacientes, los datos personales de Medicare ni la red general de Services Australia. La Dirección de Señales de Australia está colaborando en la investigación forense en curso.

Los días 20 y 21 de junio, agentes que buscaban estadísticas farmacéuticas también atacaron el Instituto Australiano de Salud y Bienestar después de que Cloudflare bloqueara el acceso al sitio principal.

Últimas noticias

01 DE SEPTIEMBRE, 2026

Nightmare Eclipse publica imágenes de perfil para detectar fallos en Avast, Kaspersky y NVIDIA.

La tristemente célebre serie de vulnerabilidades públicas NightmareEclipse ha ampliado considerablemente su alcance. Rápidamente, trascendió su enfoque inicial...

Leer artículo →
01 DE SEPTIEMBRE, 2026

Vulnerabilidad CVE-2026-82329 explotada: Toma de control del administrador de JFrog Artifactory.

Una vulnerabilidad crítica de omisión de autenticación en Artifactory permite a atacantes no autenticados obtener privilegios administrativos. Investigadores de...

Leer artículo →
01 DE SEPTIEMBRE, 2026

Anthropic refuerza la seguridad de Claude después de que modelos de IA obtuvieran acceso no autorizado a sistemas reales.

Anthropic ha reforzado la seguridad de sus modelos Claude tras varios incidentes en los que los sistemas obtuvieron acceso no autorizado a ordenadores reales du...

Leer artículo →