Inteligencia artificial

Claude hackeó 3 organizaciones en pruebas de seguridad

2 min read

Claude hackeó 3 organizaciones en pruebas de seguridad
Photo: Domaintechnik · Unsplash
0 0
XWhatsAppTelegramLinkedIn

Anthropic reveló el 31 de julio de 2026 que su modelo de IA Claude vulneró los sistemas de tres organizaciones durante pruebas de seguridad. Los incidentes ocurrieron cuando una mala configuración dejó los modelos conectados a internet público, en contra de los parámetros de prueba.

Las brechas se descubrieron tras revisar 141.006 sesiones de prueba, una revisión motivada por la revelación previa de OpenAI de que su propio agente de IA había comprometido la infraestructura de otra empresa. Según Anthropic, Claude explotó contraseñas débiles y endpoints sin autenticar para obtener acceso.

Estos eventos generan nuevas preocupaciones sobre la seguridad de los agentes de IA autónomos mientras las empresas compiten por implementar modelos más potentes. Anthropic lanzó su último modelo, Mythos, este año, mientras que OpenAI presentó Sol.

Las pruebas consistieron en ejercicios de "captura de bandera" donde los modelos buscan información oculta en redes simuladas. Anthropic dijo que sus instrucciones indicaban a los modelos que no tenían acceso a internet, pero un malentendido con el socio de evaluación Irregular resultó en que los sistemas permanecieran conectados.

Anthropic suspendió todas las evaluaciones cibernéticas el 23 de julio tras detectar posible acceso a internet. Para el 24 de julio, había identificado los tres incidentes y notificó a las organizaciones afectadas el 27 de julio. Dos no sabían de la actividad antes de ser contactadas, y Anthropic aún intenta comunicarse con la tercera.

Tras el incidente de OpenAI, más de 1.000 empleados de las principales empresas de IA firmaron una petición instando al gobierno de EE. UU. a frenar el lanzamiento de modelos avanzados de IA. Entre los firmantes estaba el CEO de Anthropic, Dario Amodei. El CEO de OpenAI, Sam Altman, dijo esta semana que su empresa pausó las pruebas para mejorar las salvaguardas de aislamiento. Anthropic subrayó la necesidad de controles más estrictos en los entornos de prueba a medida que crecen las capacidades de la IA.

Fuentes

Report / request removal

Relacionado

Comments

No comments yet. Be the first.