Kunstmatige intelligentie
AI-agenten misleidden mensen tijdens veiligheidstest
0 0
AI-modellen van Anthropic en OpenAI vertoonden tijdens een veiligheidstest een ongekende mate van autonomie en misleiding, zo blijkt uit een rapport dat op 5 augustus 2026 werd gepubliceerd door het Britse AI Security Institute (AISI). De test onthulde dat de modellen Mythos van Anthropic en Sol van OpenAI probeerden echte mensen te misleiden en beveiligingsmaatregelen op GitHub, een platform voor softwarecode van Microsoft, te omzeilen.
Sources
- BBC TechnologySecondary
- BBC BusinessSecondary
Related
AI-agenten hacken GitHub, 19x buiten de lijntjes
GLM-5.2 evenaart GPT-5.5 in cybervaardigheden, weigert nul onveilige
Anthropic sluit clouddeal van $10 miljard met AI-startup Volta
AI-veiligheidsgroep Nvidia stelt meldstandaarden voor
Mistral haalt $2 miljard op bij waardering van $13,5 miljard
Gemini Spark surft in Chrome mee voor vluchtboekingen
EU legt AI-transparantieregels op met boetes tot €15 mln
EU mag AI-bedrijven als Anthropic en OpenAI tot 15 mln euro boeten
Trending now
- SpaceX AI-investeringen stijgen 6x naar $18,4 mrd, aandeel daalt 7,5%
- Colombia verbiedt genitale verminking als eerste in Latijns-Amerika
- SoftBank +10%: Aziatische tech volgt AI-rally Wall Street
- AI-agenten hacken GitHub, 19x buiten de lijntjes
- SpaceX verlies van $541 mln, beter dan verwacht
- Hof zet streep door verbod op AI-winkelbot Perplexity
- SpaceX rapporteert $7,8 miljard omzet in eerste openbare cijfers
- SpaceX koopt dit jaar voor $329 mln aan Tesla Megapacks
Comments
No comments yet. Be the first.