Anthropic的第一个嵌入式评估器是.埃森哲?
达里奥·阿莫德伊(Dario Amedei)将第三方安全评估人员纳入人工智能实验室的计划正在形成:Anthropic表示,技术咨询巨头埃森哲的员工将开始在公司内部工作,审查其模型和员工。Anthropic在一篇博客文章中表示,埃森哲一月份收购的Faculty公司将开始“评估和红组模型,进行对齐评估,并测试模型保障措施。”两家公司预计在未来五年内向该项目投资至少10亿美元。埃森哲的选择让许多人工智能观察人士和市场感到惊讶,该咨询公司的股价在几小时后飙升8%。Amedei的博客文章中关于嵌入式评估者的讨论集中在METR、Redwood Research和Apollo Research等人工智能安全研究组织上。Anthropic的情况尤其如此,该公司将人工智能的安全和一致性置于其使命的核心。Anthropic表示,未来几周将宣布更多的评估人员,并且正在与METR和其他非营利组织就如何“使用自己的资金试点嵌入式评估的要素”进行对话。虽然埃森哲并不以其在深度学习研究前沿的工作而闻名,但Anthropic指出,该公司为大公司和政府机构部署人工智能的实践经验是一个关键优势。此外,作为一家早于人工智能革命的大型上市公司,它在功能上更加独立于Anthropic和人工智能实验室周围的复杂生态系统。该实验室指出,目前还不存在评估者访问或通信的标准,并且预计其方法会随着时间的推移而不断发展。虽然外部评估已经是新大型语言模型发布流程的主要部分,但最近的事件增加了风险:OpenAI和Anthropic部署的人工智能代理入侵了外部网站,但没有在实验室内部引起警报。一些批评者呼吁进行更多的审查
注:以上内容摘选自原始新闻,点击「访问原文」查看完整内容。
标签
新闻来源
techcrunch · 2026年9月18日 14:44