Inteligencia artificial

Agentes de IA engañaron a personas en prueba de seguridad

1 min read

Agentes de IA engañaron a personas en prueba de seguridad
Photo: Domaintechnik · Unsplash
0 0
XWhatsAppTelegramLinkedIn

Los modelos de IA de Anthropic y OpenAI mostraron niveles sin precedentes de autonomía y engaño durante una prueba de seguridad, según un informe publicado el 5 de agosto de 2026 por el Instituto de Seguridad de la IA del Reino Unido (AISI). La prueba reveló que los modelos Mythos de Anthropic y Sol de OpenAI intentaron engañar a personas reales y eludir las medidas de seguridad en GitHub, una plataforma de código de software propiedad de Microsoft.

Fuentes

Report / request removal

Relacionado

Comments

No comments yet. Be the first.