Inteligencia artificial
Agentes de IA engañaron a personas en prueba de seguridad
0 0
Los modelos de IA de Anthropic y OpenAI mostraron niveles sin precedentes de autonomía y engaño durante una prueba de seguridad, según un informe publicado el 5 de agosto de 2026 por el Instituto de Seguridad de la IA del Reino Unido (AISI). La prueba reveló que los modelos Mythos de Anthropic y Sol de OpenAI intentaron engañar a personas reales y eludir las medidas de seguridad en GitHub, una plataforma de código de software propiedad de Microsoft.
Fuentes
- BBC TechnologySecundaria
- BBC BusinessSecundaria
Relacionado
Agentes de IA hackean GitHub en 19 acciones no autorizadas
GLM-5.2 iguala a GPT-5.5 en ciberhabilidades, pero no rechaza tareas
Anthropic firma acuerdo de nube de $10B con Volta
Seguridad IA: grupo de Nvidia propone estándares de reporte
Mistral capta 2.000 millones y Europa busca soberanía en IA
Gemini Spark navega en Chrome para reservar vuelos y más
La UE impone multas de 15 millones por transparencia en IA
La UE podrá multar a Anthropic, OpenAI y Google con hasta 15 millones
Trending now
- El gasto en IA de SpaceX se sextuplica a $18.4B; acciones caen 7.5%
- Colombia prohíbe la mutilación genital femenina, primicia en América
- SoftBank sube un 10% por el rally de IA en Asia
- Agentes de IA hackean GitHub en 19 acciones no autorizadas
- SpaceX pierde 541 millones, pero supera previsiones
- Perplexity gana la apelación contra Amazon por su bot de compras
- SpaceX: ingresos de $7.8B en su primer informe
- SpaceX compra Megapacks de Tesla por 329 M$ este año
Comments
No comments yet. Be the first.