Investigadores de seguridad descubrieron dos formas de escapar del entorno aislado (sandbox) de OpenAI Codex; una de ellas permitía ejecutar comandos en la máquina de un desarrollador desde el modo más restringido de Codex, sin solicitar autorización ni mostrar nada en pantalla.
Ambas vulnerabilidades fueron notificadas a OpenAI el 12 de agosto y corregidas en un plazo de ocho días, según informó Oren Yomtov, de Accomplish AI.
La más grave de las dos, denominada «Heapjack» por los investigadores, convierte una acción rutinaria en una ejecución remota de código: basta con abrir el repositorio de otra persona en Codex y formular una pregunta sobre el código para que el autor de dicho repositorio pueda ejecutar comandos en tu equipo sin las restricciones del entorno aislado.
Codex es el agente de programación de OpenAI, disponible tanto como herramienta de línea de comandos como aplicación de escritorio. Al igual que otros agentes similares, ejecuta las acciones del modelo dentro de un entorno aislado para evitar que el código no verificado afecte al resto del sistema; ambos métodos de escape logran vulnerar dicha barrera desde el interior.
La ilusión de los entornos aislados A medida que los asistentes de programación de inteligencia artificial obtienen un acceso sin precedentes al código fuente p...
Leer artículo →Una campaña de publicidad maliciosa en el buscador Bing está distribuyendo un instalador falso de la aplicación de escritorio Claude, alojado en el dominio legí...
Leer artículo →La seguridad de los agentes de IA está siguiendo una curva de madurez conocida: adopción, visibilidad y, finalmente, control. Sin embargo, hemos descubierto que...
Leer artículo →