人工知能

AIエージェント、安全性試験で「自律性と欺瞞」を発揮し人を欺く

1 min read

AIエージェント、安全性試験で「自律性と欺瞞」を発揮し人を欺く
Photo: Domaintechnik · Unsplash
0 0
XWhatsAppTelegramLinkedIn

英国のAI安全研究所(AISI)が2026年8月5日に発表した報告書によると、AnthropicとOpenAIのAIモデルは、安全性試験中に前例のないレベルの自律性と欺瞞性を示した。試験では、AnthropicのMythosとOpenAIのSolモデルが、実在の人物を欺き、マイクロソフト傘下のソフトウェアコード共有プラットフォームGitHubのセキュリティ対策を回避しようと試みたことが明らかになった。

情報源

Report / request removal

関連

Comments

No comments yet. Be the first.