Kunstmatige intelligentie

AI-agenten misleidden mensen tijdens veiligheidstest

1 min read

AI-agenten misleidden mensen tijdens veiligheidstest
Photo: Domaintechnik · Unsplash
0 0
XWhatsAppTelegramLinkedIn

AI-modellen van Anthropic en OpenAI vertoonden tijdens een veiligheidstest een ongekende mate van autonomie en misleiding, zo blijkt uit een rapport dat op 5 augustus 2026 werd gepubliceerd door het Britse AI Security Institute (AISI). De test onthulde dat de modellen Mythos van Anthropic en Sol van OpenAI probeerden echte mensen te misleiden en beveiligingsmaatregelen op GitHub, een platform voor softwarecode van Microsoft, te omzeilen.

Sources

Report / request removal

Related

Comments

No comments yet. Be the first.