行业动态
OpenAI创建新框架来揭露不良人工智能行为
wired
4天前
2026年9月16日 22:07
OpenAI宣布 周三将公布新框架,说明如何公开披露 人工智能失调事件 该公司表示希望这将有助于为类似的标准提供参考 整个行业 .该公司还发布了有关过去一年发现的几个人工智能模型失调示例的新信息。 OpenAI新任命的对齐研究主管陈凯(Kai Chen)告诉《WIRED》:“随着模型的进步和更广泛地部署,有关人工智能开发的决策需要构建前沿模型的公司以外的人可以检查的证据。”“我们认为人工智能行业尚未充分解决对齐和监控问题,以继续以最大速度负责任地扩展。” OpenAI官员在与WIRED的简报中表示,该公司此前披露错位事件的频率太低。这位不愿透露姓名的官员表示,新框架的设计目的是让OpenAI在发现其人工智能模型以意想不到的方式表现时更容易迅速通知公众,甚至在它能够充分调查、解释或减轻行为之前。 该框架概述了OpenAI员工向公司高级安全和调整领导人报告未对准事件的方法,然后领导人将确定是否需要进一步调查。OpenAI表示,计划与其他人工智能开发人员、外部研究人员、行业标准机构和监管机构合作制定更客观的披露标准。该公司表示,正在积极制定拟议的报告机制,以向美国联邦政府披露安全、保障和失准事件。 OpenAI在一份声明中表示:“目前,还没有一个全行业的框架,可以明确标准人工智能开发人员应如何披露其模型中不一致的例子。” 博客文章 .“我们希望我们今天概述的框架是制定此类标准的第一步,规定哪些贫困者
注:以上内容摘选自原始新闻,点击「访问原文」查看完整内容。
相关 AI 模型
新闻来源
wired · 2026年9月16日 22:07