Navegación

OpenAI detalla más casos de agentes de IA que realizan acciones no autorizadas.

fuente: https://www.bleepingcomputer.com/news/security/openai-details-more-cases-of-ai-agents-taking-unauthorized-actions/

OpenAI ha presentado nuevos ejemplos de lo que denomina "desalineación de modelos de IA" ocurridos en los últimos seis meses; entre ellos figuran la carga no autorizada de archivos, el seguimiento de instrucciones autogeneradas, el ocultamiento de errores y el aprovechamiento de claves de API expuestas.

OpenAI utiliza el término "desalineación del modelo" para describir situaciones en las que los modelos de IA actúan en contra de las restricciones establecidas, lo que incluye realizar acciones no autorizadas, eludir la supervisión o saltarse medidas de seguridad para completar una tarea.

En una publicación de ayer, OpenAI informó que está utilizando un nuevo marco de trabajo para rastrear e investigar estas acciones no autorizadas por parte de agentes de IA.

"Compartimos un nuevo marco para rastrear, investigar y divulgar casos de desalineación de modelos en OpenAI, junto con seis informes sobre comportamientos inesperados o preocupantes de los modelos observados en los últimos seis meses", explica la compañía.

Estos nuevos ejemplos son los primeros que se publican bajo un marco de notificación más estructurado, diseñado para sustituir el enfoque anterior —más flexible— que OpenAI empleaba para divulgar los casos de desalineación de modelos.

Últimas noticias

13 DE AGOSTO, 2026

Nuevos hackers del “City-Forum” atacan instancias de Salesforce y ServiceNow en todo el mundo.

Un nuevo grupo de ciberdelincuentes está llevando a cabo una campaña cibernética a gran escala y de larga duración dirigida a sitios de Salesforce Experience Cl...

Leer artículo
13 DE AGOSTO, 2026

El gusano ChainDrop npm ataca a más de 400 paquetes a través de la cadena de bloques C2.

Un gusano npm autopropagante llamado ChainDrop ha infectado más de 400 paquetes que se descargan cientos de millones de veces cada semana. Roba credenciales de...

Leer artículo
13 DE AGOSTO, 2026

El ataque Plug and Pwn utiliza dispositivos USB falsos para acceder al sistema Windows.

Investigadores de seguridad han revelado nuevos ataques "Plug and Pwn" que aprovechan la función Plug and Play de Windows para instalar software de pr...

Leer artículo