Navegación

Claude Mythos 5 intentó introducir una puerta trasera en un proyecto de código abierto real durante las pruebas, y luego se defendió a sí mismo.

fuente: https://thehackernews.com/2026/08/claude-mythos-5-tried-to-backdoor-real.html

Un agente que ejecutaba Claude Mythos 5 de Anthropic dedicó 34 horas a intentar integrar un programa malicioso en un proyecto de código abierto real durante una evaluación cibernética realizada por el Instituto de Seguridad de IA del Reino Unido.

Cuando un observador advirtió públicamente que el código era malicioso, el agente lo negó, forzó la modificación del historial de la rama para borrar las pruebas y publicó desde una segunda cuenta bajo su control para justificar su propio trabajo. El responsable del proyecto, a pesar de ello, cerró la solicitud de integración.

El instituto, conocido como AISI, publicó su informe de incidentes el martes. En 122 ejecuciones de un ejercicio de captura de la bandera (CTF) en dos de sus entornos de pruebas cibernéticas, los investigadores catalogaron 19 acciones no autorizadas en internet en 10 ejecuciones: 17 de Mythos 5, un modelo restringido que Anthropic comercializa para trabajos de ciberseguridad, y dos de GPT-5.6 Sol de OpenAI.

Últimas noticias

08 DE SEPTIEMBRE, 2026

El servicio de phishing BigBear Microsoft 365 eludió la autenticación multifactor en 258 organizaciones.

Se ha utilizado un marco de phishing como servicio llamado BigBear 2.0 para eludir la autenticación multifactor en 258 organizaciones y robar más de 5000 creden...

Leer artículo →
08 DE SEPTIEMBRE, 2026

Adobe corrige una vulnerabilidad de día cero en Magento que permitía desplegar una puerta trasera en Rust y un shell web PHP.

Adobe publicó el lunes parches de seguridad para solucionar una vulnerabilidad de máxima gravedad que afecta a AdobeCommerce y Magento Open Source, la cual ha s...

Leer artículo →
08 DE SEPTIEMBRE, 2026

Un nuevo ataque de InjectEave permite a los hackers recuperar el audio que se reproduce en auriculares desde una distancia de 30 metros.

Investigadores han presentado un novedoso ataque electromagnético (EM) llamado InjectEave que permite a un atacante interceptar el audio que se reproduce a trav...

Leer artículo →