Investigadores de seguridad descubrieron dos formas de escapar del entorno aislado (sandbox) de OpenAI Codex; una de ellas permitía ejecutar comandos en la máquina de un desarrollador desde el modo más restringido de Codex, sin solicitar autorización ni mostrar nada en pantalla.
Ambas vulnerabilidades fueron notificadas a OpenAI el 12 de agosto y corregidas en un plazo de ocho días, según informó Oren Yomtov, de Accomplish AI.
La más grave de las dos, denominada «Heapjack» por los investigadores, convierte una acción rutinaria en una ejecución remota de código: basta con abrir el repositorio de otra persona en Codex y formular una pregunta sobre el código para que el autor de dicho repositorio pueda ejecutar comandos en tu equipo sin las restricciones del entorno aislado.
Codex es el agente de programación de OpenAI, disponible tanto como herramienta de línea de comandos como aplicación de escritorio. Al igual que otros agentes similares, ejecuta las acciones del modelo dentro de un entorno aislado para evitar que el código no verificado afecte al resto del sistema; ambos métodos de escape logran vulnerar dicha barrera desde el interior.
Una bandeja de entrada de correo electrónico comprometida puede convertirse en un arma para la ejecución remota de código en el equipo de la víctima, no mediant...
Leer artículo →Un nuevo ataque de tipo "Fuego amigo" oculta instrucciones en el archivo README de un repositorio. Basta con pedirle al agente que revise parte del có...
Leer artículo →Motor de pruebas de penetración con IA autónoma, seguridad ofensiva continua en web, nube, Active Directory y Kubernetes. El razonamiento agente y la ejecución...
Leer artículo →