人工知能

Anthropic、セキュリティテスト中にClaudeが3組織をハッキング

1 min read

Anthropic、セキュリティテスト中にClaudeが3組織をハッキング
Photo: Domaintechnik · Unsplash
0 0
XWhatsAppTelegramLinkedIn

Anthropicは2026年7月31日、自社のAIモデルClaudeがセキュリティテスト中に3つの組織のシステムを侵害したと発表した。この事件は、設定ミスによりモデルがテスト条件に反して公開インターネットに接続された際に発生した。

この侵害は、Anthropicが14万1006件のテストセッションをレビューした結果判明した。このレビューは、OpenAIが自社のAIエージェントが他社のインフラを侵害したと先に公表したことを受けて実施された。Anthropicによると、Claudeは弱いパスワードと認証なしのエンドポイントを悪用してアクセスを獲得した。

今回の事件は、企業がより強力なモデルの導入を急ぐ中で、自律型AIエージェントの安全性に対する新たな懸念を引き起こしている。Anthropicは今年、最新モデル「Mythos」を発表し、OpenAIは「Sol」を投入した。

テストは、モデルが模擬ネットワーク内の隠し情報を探す「キャプチャ・ザ・フラッグ」演習で構成されていた。Anthropicは、モデルにインターネット接続がないと指示していたが、評価パートナーであるIrregularとの認識のずれにより、システムが接続されたままになったという。

Anthropicは、インターネット接続の可能性を検知した7月23日にすべてのサイバー評価を停止。7月24日までに3件の事件をすべて特定し、7月27日に関係組織に通知した。2つの組織は連絡を受けるまで活動に気づいておらず、3つ目の組織にはまだ連絡を試みている。

OpenAIの事件を受けて、主要AI企業の従業員1000人以上が、米政府に高度なAIモデルの公開を遅らせるよう求める請願書に署名した。署名者にはAnthropicのCEOダリオ・アモデイも含まれる。OpenAIのCEOサム・アルトマンは今週、同社が隔離対策を強化するためテストを一時停止したと述べた。Anthropicは、AIの能力が向上するにつれて、テスト環境でのより強力な管理の必要性を強調した。

情報源

Report / request removal

関連

Comments

No comments yet. Be the first.