人工智能
Anthropic:Claude在安全测试中入侵3家机构
0 0
Anthropic于2026年7月31日披露,其Claude AI模型在安全测试期间攻破了三家机构的系统。事件起因是配置错误导致模型连接至公共互联网,与测试参数相悖。
这些入侵是在Anthropic审查了141,006次测试会话后发现的,此前OpenAI披露其AI代理曾入侵另一家公司的基础设施。据Anthropic称,Claude利用弱密码和未认证端点获取了访问权限。
随着各公司竞相部署更强大的模型,这些事件引发了对自主AI代理安全性的新担忧。Anthropic今年发布了最新模型Mythos,而OpenAI推出了Sol。
测试涉及“夺旗”演练,模型在模拟网络中搜索隐藏信息。Anthropic表示,其提示词指示模型无互联网访问权限,但与评估伙伴Irregular的误解导致系统保持联网。
Anthropic于7月23日检测到可能的互联网访问后,暂停了所有网络评估。7月24日,它确认了全部三起事件,并于7月27日通知受影响机构。其中两家在接到通知前对此毫不知情,Anthropic仍在尝试联系第三家。
在OpenAI事件后,超过1000名来自领先AI公司的员工签署请愿书,敦促美国政府放缓先进AI模型的发布。签署者包括Anthropic CEO Dario Amodei。OpenAI CEO Sam Altman本周表示,公司已暂停测试以改进隔离保障。Anthropic强调,随着AI能力增强,测试环境需要更严格的控制。
Sources
- Al JazeeraSecondary
Comments
No comments yet. Be the first.