开放重量人工智能模型正在追赶前沿。安全差距仍然存在。
当政策制定者就如何管理日益强大的人工智能系统(例如OpenAI的GPT-5.6 Sol和Anthropic的Mythos)进行辩论时,中国的开放重量模型缩小了与行业领导者的差距。 根据人工智能安全非营利组织SaferAI的一份新报告,中国Z.ai的开放重量人工智能模型GLM-5.2在网络和生物功能方面仅落后OpenAI的GPT-5.5和Anthropic的Claude Opus 4.7几个月。但前沿能力和安全实践之间的差距正在扩大。根据SaferAI的评估(该非营利组织通过Z.ai的公共API进行的评估),GLM-5.2没有拒绝任何攻击性的网络或生物学任务。相比之下,Claude Opus 4.7“拒绝得如此一致,以至于SaferAI根本无法在上面完成CyberGym。”(CyberGym是评估网络安全能力的基准。OpenAI在上个月Hugging Face违规事件之前的评估中使用了它。)这清楚地提醒人们一些批评者多年来一直警告的问题:开放重量人工智能模型可能会将高性能的人工智能交到潜在攻击者手中,而一旦他们下载了重量,就无法监管他们如何使用该技术。随着开重模型迅速接近世界领先人工智能系统的能力,争论正在从它们是否能够竞争转向它们发布后社会如何管理风险。SaferAI执行董事亨利·帕帕达托斯(Henry Papadatos)告诉TechCrunch:“能力的前沿不是风险的前沿,因此我们确实必须考虑缓解措施的状态,以正确评估风险。”虽然Z.ai可以对其托管的API应用安全措施,但一旦有人在自己的硬件上运行权重,这些保护措施就无法执行,他们可以删除或修改任何保护措施,微调模型或更改系统提示。OpenAI和Anthropic等前沿开发人员倾向于依赖分类器、拒绝培训和API级控制等保障措施来限制危险的网络和生物
注:以上内容摘选自原始新闻,点击「访问原文」查看完整内容。
标签
相关 AI 模型
新闻来源
techcrunch · 2026年8月4日 13:05