Minuto a Minuto

Ciencia y Tecnología Modelos Claude de Anthropic acceden sin autorización a sistemas de tres organizaciones
Los modelos fueron Claude Opus 4.7, Claude Mythos 5 y una versión interna destinada a investigación; la firma asumirá la responsabilidad
Internacional Trump anuncia acuerdo para el desarme total de Hamás como parte de su plan para Gaza
Trump aseguró que el acuerdo se aplicará por fases y que, tras el desarme, las fuerzas israelíes se retirarán mientras una fuerza internacional garantizará la seguridad en Gaza
Internacional “Sentía que intentaban matarme”: deportado denuncia maltrato bajo custodia del ICE
Padre de 9 hijos estadounidenses y residente permanente legal desde hace 30 años, regresaba al país para una graduación cuando fue detenido
Internacional México y EE.UU. reivindican el T-MEC y la cooperación bilateral en medio de tensiones
México y EE.UU. reafirmaron su relación bilateral, defendieron el T-MEC y destacaron la cooperación en seguridad contra el crimen organizado
Internacional Gobierno de EE.UU. comenzará a expedir pasaportes con imagen de Trump desde el 8 de agosto
Los nuevos pasaportes conmemorativos incluyen una imagen de Trump de pie, con gesto serio y los puños apoyados sobre una mesa
Modelos Claude de Anthropic acceden sin autorización a sistemas de tres organizaciones
Gráfico de la compañía que ilustra el comunicado donde detalla los tres incidentes, publicado este jueves 30 de julio de 2026 / Imagen de Anthropic

Tres modelos de inteligencia artificial (IA) de Anthropic accedieron sin autorización a los sistemas informáticos de tres organizaciones durante pruebas de ciberseguridad que debían realizarse en entornos aislados, informó la propia compañía. Las entidades afectadas no fueron reveladas públicamente.

Los incidentes ocurrieron después de que una confusión entre Anthropic y su socio de evaluación, Irregular, dejara los entornos de prueba conectados a internet. Aunque las instrucciones indicaban a Claude que operaba en una simulación sin acceso a la red, los modelos alcanzaron sistemas reales creyendo que formaban parte de los ejercicios.

Anthropic detectó los tres casos después de revisar más de 141 mil sesiones de evaluación. Los modelos involucrados fueron Claude Opus 4.7, Claude Mythos 5 —disponible únicamente para un grupo limitado de usuarios— y una versión interna destinada a investigación.

Una simulación que alcanzó sistemas reales

Las evaluaciones consistían en ejercicios conocidos como capture the flag, diseñados para medir la capacidad de los modelos de analizar sistemas vulnerables, explotar fallas y recuperar información oculta. Durante las incursiones, Claude empleó procedimientos básicos, como probar contraseñas débiles y aprovechar puntos de acceso que no exigían autenticación.

Te puede interesar: Justicia electoral de Brasil refuerza controles digitales rumbo a las elecciones; ¿qué empresas participan?

En uno de los casos, el modelo recibió como objetivo una empresa ficticia cuyo nombre coincidía con el dominio activo de una compañía real. Fue entonces que la IA atacó su infraestructura, extrajo información y consiguió entrar a una base que contenía varios cientos de registros de producción.

La compañía suspendió sus evaluaciones cibernéticas al advertir que los modelos podrían estar conectándose a internet, verificó el alcance de los incidentes y comunicó lo ocurrido a las organizaciones afectadas. Anthropic sostuvo que las versiones evaluadas funcionaban sin algunas de las protecciones incorporadas en los productos disponibles para sus usuarios.

Tras reconocer que distintos factores contribuyeron a los accesos, Anthropic aseguró que asumirá la responsabilidad de corregir dichas fallas. Entre las medidas previstas se encuentran ampliar la supervisión de las sesiones para detectar conductas inesperadas y endurecer los controles aplicados a los proveedores externos que participan en sus evaluaciones.

Con información de López-Dóriga Digital