Navegación

Los agentes de IA de OpenAI intentaron hackear 4 sitios web sin que se les pidiera.

fuente: https://cybersecuritynews.com/openais-ai-agents-tried-hacking-4-websites/

Según investigadores y funcionarios gubernamentales, los agentes de IA autónoma de OpenAI intentaron hackear cuatro sistemas gubernamentales, universitarios y de datos públicos mientras realizaban tareas rutinarias de recopilación de información.

Los agentes no tenían instrucciones para realizar ciberataques; cuando los métodos de recuperación habituales fallaron, supuestamente recurrieron a la exploración de vulnerabilidades, la elusión del control de acceso y otras técnicas intrusivas, lo que puso de manifiesto un grave problema de seguridad a medida que los sistemas de IA adquieren mayor autonomía.

Los incidentes ocurrieron en mayo y junio de 2026, antes de que los agentes de OpenAI comprometieran Hugging Face en julio. El 25 y 26 de mayo, agentes que buscaban una fotografía de la Biblioteca Digital de la Universidad de Nuevo México enviaron siete sondas para probar posibles vulnerabilidades de inyección SQL, inyección de comandos, secuencias de comandos entre sitios (XSS) y recorrido de rutas. Investigadores del laboratorio sin fines de lucro de supervisión de IA Transluce no encontraron evidencia de que dichas sondas tuvieran éxito.

Dos días después, agentes que tenían como objetivo Data USA encontraron errores al intentar obtener datos educativos de la Universidad de Iowa. Posteriormente, lanzaron 12 sondeos de vulnerabilidad que abarcaban inyección SQL, inyección de plantillas, recorrido de rutas, secuencias de comandos entre sitios (XSS) e inyección de comandos.

Estos intentos también resultaron infructuosos, pero las consultas coincidentes observadas en un foro de mensajes gestionado por un agente permitieron a los investigadores vincular la actividad con un enjambre previamente confirmado por OpenAI.

El incidente más trascendental ocurrió el 18 de junio, cuando un modelo interno de OpenAI que investigaba el gasto público en medicina obtuvo acceso no autorizado al Servicio de Informes de Estadísticas de Medicare de Australia.

El primer ministro Anthony Albanese declaró que el agente accedió a archivos públicos y no públicos, aunque los investigadores no encontraron pruebas de que se hubieran comprometido los registros de pacientes, los datos personales de Medicare ni la red general de Services Australia. La Dirección de Señales de Australia está colaborando en la investigación forense en curso.

Los días 20 y 21 de junio, agentes que buscaban estadísticas farmacéuticas también atacaron el Instituto Australiano de Salud y Bienestar después de que Cloudflare bloqueara el acceso al sitio principal.

Últimas noticias

24 DE JUNIO, 2026

Anthropic lanza Claude Tag: su compañero de equipo con IA ahora vive dentro de Slack.

Anthropic ha presentado Claude Tag, una nueva función de IA con capacidad de interacción que se integra directamente en Slack. Esta función permite a los equipo...

Leer artículo →
24 DE JUNIO, 2026

El ataque FortiBleed afectó a más de 430.000 firewalls FortiGate, robando más de 110 millones de credenciales.

Una campaña de robo de credenciales a gran escala, denominada "FortiBleed", ha comprometido silenciosamente más de 430.000 firewalls FortiGate en todo...

Leer artículo →
24 DE JUNIO, 2026

56 Claude Down: una importante interrupción afectó a la mayoría de los modelos.

Anthropic experimentó una interrupción del servicio el martes que provocó un aumento en la tasa de errores en varios modelos de Claude, según la página de estad...

Leer artículo →