小参数AI智能体Faraday科研复现超越GPT-5.5
「伦敦AI实验室Inherent推出智能体Faraday,仅凭270亿参数的Qwen 3.6模型,在自主复现科学论文任务中击败GPT-5.5与Claude Opus 4.8。该公司以5000万美元种子轮资金起步,计划年底扩充团队,并赋予智能体“研究品味”与强化学习能力。」
总部位于伦敦的AI实验室Inherent,近日正式推出了其AI智能体Faraday。这家由前谷歌DeepMind员工创立的初创公司,仅以5000万美元种子轮融资走出隐身模式几周后,就公布了一项令业界瞩目的成果:在事先不知道答案的情况下,Faraday能够自主复现已发表科学论文中的研究结果,并在这一特定任务上击败了OpenAI的GPT-5.5与Anthropic的Claude Opus 4.8。
更值得关注的是,Faraday并未依赖规模庞大的前沿模型,而是使用了一个仅有270亿参数的小型模型Qwen 3.6。与GPT-5.5和Claude Opus 4.8相比,这一参数规模显得相当轻量。Inherent联合创始人兼首席科学家Edward Hughes强调,击败其他AI系统并非重点,真正关键在于构建系统的方式。“对我们来说,最有意思的并不是击败那些前沿智能体的结果,而是我们构建这个系统的方式,”Hughes如此表示。
Inherent并不满足于让Faraday仅仅做到论文复现。公司更宏大的目标,是打造能够发现全新科学知识的AI智能体。为此,Inherent希望Faraday不仅具备准确复现实验结果的能力,还要展现出所谓的“研究品味”——即判断哪些实验值得进行,以及如何合理设计这些实验。Hughes认为,论文复现本身就是人类科学家的标准训练方式,许多博士生正是从这一过程起步的。
为了让AI掌握这种难以量化的“研究品味”,Inherent重点依赖强化学习训练。与传统直接灌输规则的方式不同,强化学习根据最终结果对AI行为进行奖励,使系统逐步学会更有效的行动策略。相比仅仅通过学习科学研究流程来训练智能体,这种基于奖励的方式被认为更有利于泛化到长期目标,从而让AI真正参与多个科学领域的研究工作。
这种理念也影响了Inherent的产品决策。例如,公司没有自行开发编程工具,而是让Faraday直接使用OpenAI的GPT-5.5 Codex,这与人类科学家利用现成软件工具的习惯类似。同时,Inherent也刻意避免打造那些只会迎合用户的AI智能体。Hughes希望,Faraday更像他最喜欢的那类队友——会主动告诉用户:“我对这个问题产生了兴趣,于是自己去做了这些实验。你觉得这些结果怎么样?”
目前,Inherent团队约有12名员工,全部在伦敦国王十字区的一间办公室线下办公。Hughes对伦敦高度密集的AI人才资源非常看好,但他也公开呼吁英国取消“竞业休假”制度。这一制度要求员工离职后数个月内不得加入竞争对手或创办竞争企业,Hughes本人曾受过其影响。尽管如此,他还是与另外两名前DeepMind员工以及第四位联合创始人共同创办了Inherent。
公司计划在今年年底前将员工人数扩大至约20至25人。考虑到Inherent正在布局世界模型,同时DeepMind部分员工的未来去向出现不确定性,这家加速成长的伦敦初创公司,或许将成为众多AI人才的新去处。
来源:Heooo AI工具导航