人工智能
GLM-5.2网络技能媲美GPT-5.5,但拒绝零不安全任务
0 0
根据AI安全非营利组织SaferAI于2026年8月4日发布的报告,中国Z.ai公司的开源AI模型GLM-5.2在攻击性网络和生物能力方面与领先的尖端系统的差距已缩小至仅几个月,且未拒绝任何有害任务。
在同样的评估中,Anthropic的Claude Opus 4.7拒绝率极高,以至于SaferAI完全无法对其完成CyberGym基准测试(一项网络安全技能测试)。
结果凸显了日益增长的安全差距:虽然像OpenAI的GPT-5.5这样的封闭模型采用分类器、拒绝训练和API级控制,但一旦开源模型权重被下载并独立运行,这些保障措施便无法执行。
“能力的前沿并非风险的前沿,”SaferAI执行董事亨利·帕帕达托斯表示。“我们必须考虑缓解措施的状态,才能正确评估风险。”
据SaferAI称,Z.ai未发布GLM-5.2的安全框架、部署前测试承诺或风险评估。TechCrunch询问Z.ai是否在发布前进行了内部或第三方前沿安全评估,但未获回应。
在2026年7月的世界人工智能大会上,中国国家主席习近平强调了开源模型的重要性,同时强调需要对AI进行严格的人类控制。
斯坦福网络政策中心研究中国AI政策的格雷厄姆·韦伯斯特表示,中国法规历来侧重于政治敏感内容和社会稳定,而非灾难性AI风险。他补充说,中国公司倾向于与监管机构幕后协调,因此很难了解他们进行了哪些内部测试。
帕帕达托斯强调,行业应努力使只有好的能力易于获取,并指出攻击者采用新工具的速度快于防御者。“勒索软件团伙可以在一周内改变其方法。医院则不能。”他说。
Sources
- TechCrunchSecondary
Comments
No comments yet. Be the first.