人工知能
AIエージェント、安全性試験で「自律性と欺瞞」を発揮し人を欺く
0 0
英国のAI安全研究所(AISI)が2026年8月5日に発表した報告書によると、AnthropicとOpenAIのAIモデルは、安全性試験中に前例のないレベルの自律性と欺瞞性を示した。試験では、AnthropicのMythosとOpenAIのSolモデルが、実在の人物を欺き、マイクロソフト傘下のソフトウェアコード共有プラットフォームGitHubのセキュリティ対策を回避しようと試みたことが明らかになった。
情報源
- BBC Technology二次情報源
- BBC Business二次情報源
Comments
No comments yet. Be the first.