这家初创公司的新机械解释工具可让您调试LLM
总部位于旧金山的初创公司Goodfire刚刚发布了一款名为Silico的新工具,可以让研究人员和工程师窥视人工智能模型内部并在训练期间调整其参数。这可能会让模型制造者对这项技术的构建方式进行比以前想象的更细粒度的控制。Goodfire声称Silico是同类中第一个现成的工具,可以帮助开发人员调试开发过程的所有阶段,从构建数据集到训练模型。该公司希望让构建人工智能模型不那么像炼金术,而更像一门科学。当然,ChatGPT和Gemini等法学硕士可以做一些了不起的事情。但在构建它们时,最佳实践通常基于经验法则而不是理论。,这可能会导致修复它们的缺陷或阻止不必要的行为变得困难。Goodfire首席执行官Eric Ho在Silico发布前的独家聊天中表示:“我们看到模型的理解程度与模型的广泛部署之间的差距正在扩大。”“我认为当今每个主要前沿实验室的主要感觉是,你只需要更大的规模、更多的计算、更多的数据,然后你就得到了AGI(人工通用智能),其他都不重要了。我们说不,有更好的方法。”Goodfire是包括行业领导者Anthropic、OpenAI和Google DeepMind在内的少数公司之一,他们开创了一种名为机械解释性的技术,该技术旨在在执行任务时通过绘制其神经元及其之间的路径来实现。(被选为2026年十大突破性技术之一。) Goodfire不仅希望使用这种方法来审计模型(即研究那些已经训练过的模型),而且希望首先帮助设计它们。 “我们希望消除试错,将训练模型转化为精确工程,”Ho说。“这意味着暴露旋钮和表盘,以便您可以在训练过程中实际使用它们。”Goodfire已经使用了i
注:以上内容摘选自原始新闻,点击「访问原文」查看完整内容。
新闻来源
technologyreview · 2026年4月30日 00:00