Navegación

Vulnerabilidad de puerta trasera oculta en modelos de IA.

fuente: https://meterpreter.org/ai-model-hidden-backdoor-vulnerability/

Modificar el comportamiento de la IA es mucho más fácil y económico de lo que muchos creían. La experta en ciberseguridad Katie Paxton-Fear introdujo una vulnerabilidad oculta en un modelo de IA de código abierto. Sorprendentemente, completó esta tarea en apenas una hora. Además, toda la prueba le costó menos de cien dólares.

Entrenamiento de un modelo para que falle

Primero, comprobó si un entrenamiento rápido podía forzar al modelo a cambiar su estilo de código. La red aprendió rápidamente las nuevas reglas y las siguió utilizando incluso después de recibir una orden clara de volver a su formato anterior. Tras esta exitosa prueba, la experta procedió a crear una trampa oculta completa.

Solo necesitó diez ejemplos de prueba para vulnerar el sistema. Después de esta breve preparación, la red a menudo generaba código con una grave vulnerabilidad. Esta vulnerabilidad permitía a los hackers ejecutar comandos a distancia. Lamentablemente, la lógica defectuosa permanecía activa incluso durante nuevas tareas y en entornos desconocidos.

Últimas noticias

25 DE JULIO, 2026

OpenAI confirma que ChatGPT no funciona en todo el mundo.

ChatGPT está experimentando una interrupción importante del servicio y los usuarios no pueden cargar sus chats, incluidas las conversaciones anteriores. La inte...

Leer artículo
25 DE JULIO, 2026

Los hackers secuestran el DNS de la red Wi-Fi de un hotel para robar cuentas de Microsoft 365.

Los hackers están modificando la configuración DNS de los dispositivos Wi-Fi en hoteles y centros de conferencias para redirigir a los usuarios a páginas de ini...

Leer artículo
25 DE JULIO, 2026

Investigador publica prueba de concepto de ejecución remota de código en GitLab que permite a usuarios autenticados ejecutar comandos.

Investigadores de seguridad de DepthFirst publicaron el 24 de julio un código de explotación funcional para una vulnerabilidad de GitLab que GitLab había correg...

Leer artículo