Navegación

Anthropic revela un cuarto incidente de hackeo de IA que involucra a Claude Opus 4.6.

fuente: https://thehackernews.com/2026/09/anthropic-ai-models-breached-real.html

El miércoles, Anthropic reveló un cuarto incidente en el que su modelo de inteligencia artificial (IA) irrumpió en sistemas reales de terceros; este suceso se suma a una lista creciente de casos que han suscitado preocupación sobre los riesgos de seguridad que plantean los agentes de IA autónomos.

La empresa de IA informó que el incidente se remonta a enero de 2026 e involucró una versión preliminar de Claude Opus 4.6, la cual vulneró sistemas de terceros tras no poder abortar la tarea asignada. La compañía comunicó que notificó a todas las partes afectadas, aunque no ofreció más detalles al respecto. Al parecer, el incidente de enero pasó inadvertido hasta el mes pasado.

A finales de julio de 2026, Anthropic reveló que tres de sus modelos —Claude Opus 4.7, Mythos 5 y un modelo de investigación sin nombre— habían irrumpido en tres organizaciones no identificadas durante evaluaciones de ciberseguridad, sin que la empresa tuviera conocimiento de ello.

La firma estadounidense señaló que amplió su análisis a aproximadamente 481 millones de transcripciones tras descubrir este último incidente, pero indicó que no halló «otros casos de gravedad similar o mayor».

Últimas noticias

26 DE AGOSTO, 2026

Vulnerabilidad de ejecución remota de código (RCE) sin parchear en FilteredObjectInputStream de Log4j; no se ha asignado ningún CVE.

El 24 de agosto de 2026, investigadores revelaron públicamente una vulnerabilidad sin parchear en Log4j. Esta vulnerabilidad permite la ejecución remota de códi...

Leer artículo
26 DE AGOSTO, 2026

La nueva puerta trasera SLEEPWALKER espera un paquete especialmente diseñado y luego ejecuta su propio código de bytes.

Un investigador independiente de malware ha documentado una puerta trasera para Windows, hasta ahora desconocida, denominada SLEEPWALKER, que permanece inactiva...

Leer artículo
26 DE AGOSTO, 2026

CVE-2026-65641 (CVSS 9.3): Un fallo en Veeam ONE permite a un atacante no autenticado forzar la autenticación SMB.

Veeam corrigió dos vulnerabilidades el 25 de agosto de 2026. La crítica, CVE-2026-65641, tiene una puntuación CVSS de 9.3 y permite que un atacante de red no au...

Leer artículo