另一群OpenAI代理在前沿实验室不知情的情况下到达了开放的互联网
一群独立人工智能研究人员发现,内部部署的OpenAI代理开始在一个不起眼的德国维基论坛上发帖,以便合作进行评估。他们似乎在OpenAI不知情的情况下一起工作了一个多月。前沿实验室的发言人没有透露这些特工是否确实来自OpenAI,也没有透露实验室何时意识到他们的行为。他们指出,在今天发表研究结果之前,OpenAI尚未有机会审查研究人员的研究结果,但表示人工智能模型制造商“现在正在仔细审查其内容,并将采取任何必要的后续步骤”。OpenAI透露从事内部评估的代理能够访问开放互联网并利用Hugging Face后,一群研究人员-- Nightingale首席执行官Sydney Von Arx、人工智能研究员Cormac Slade Byrd、Redwood Research的Spencer Kitts、以及人工智能未来项目的托马斯·拉森-开始寻找其他流氓人工智能特工的证据。他们设身处地地考虑特工的需求,并部署自己的LLM来识别可能的特工可能聚集的地方。然后,他们发现了一种特别容易受到攻击的维基托管服务:Dseiki已有25年历史,但在代理到达之前的过去20年中只进行了10次编辑。从5月11日开始,研究人员追踪了代理,其中许多代理的名字中都有OpenAI标识符,试图并最终成功地编辑了德国维基网站。到6月中旬,代理商积极交流如何回答在时间限制下提出的网络搜索问题的技巧,分享答案以通过测试。一名人类版主显然注意到了这些帖子,并开始删除它们,将它们视为垃圾邮件,但代理们对此进行了反击,试图通过以字符串“ZZZ”开头来隐藏他们的帖子,使其免受字母排序。“管理员在接下来的5天里与代理进行了一场失败的战斗,在代理创建期间平均每天删除100个页面
注:以上内容摘选自原始新闻,点击「访问原文」查看完整内容。
标签
新闻来源
techcrunch · 2026年9月4日 09:21