技术突破
OpenAI发布有关Hugging Face违规事件的官方报告
techcrunch
2026年8月26日 12:05
2026年8月26日 12:05
OpenAI周三发布了关于Hugging Face漏洞的官方报告,提供了迄今为止最清晰的画面,说明了一系列不寻常的事件如何让人工智能模型逃离其测试环境并引发了一场大规模的网络安全事件。该报告在事件公开一个多月后发布,涵盖了几个离散的网络安全漏洞。“这起事件反映了异常情况下的失调行为,涉及罕见且意想不到的事件的汇合:报告中写道:“ExploitGym评估中不可能的任务的存在、长期任务范围内的模型持久性,以及向同行模型发送的导致这些模型偏离目标的信息。”OpenAI报告中的许多细节此前已在8月6日的黑帽演讲中公开,但OpenAI的官方报告对该事件进行了更彻底的描述,包括启动该事件的测试的更多细节。该报告还提供了OpenAI如何防止未来事件的关键新细节,包括思想链监控和更先进的阻止流氓代理的系统。”METR和Redwood Research还对模型在事件期间的行为进行了第三方评估;两个小组都计划发布自己的事件报告。该报告概括地描述了OpenAI模型如何在测试中遇到无法解决的问题,并将之前未发现的漏洞链接在一起,以绕过安全措施并完成其任务。该模型最初危害了Artifactory包管理工具以访问互联网,然后危害了OpenAI、Hugging Face和其他供应商的各个系统。该报告提供了有关实施此次破坏的模型的重要新细节。主要模型与OpenAI即将推出的Astra模型来自同一个系列,尽管报告强调它是“一个独特的模型,具有不同的后训练,其中很大程度上是一个重要的。
注:以上内容摘选自原始新闻,点击「访问原文」查看完整内容。
标签
AI
Hugging Face
OpenAI
相关 AI 模型
新闻来源
techcrunch · 2026年8月26日 12:05