DeepMind校友伦敦初创公司称智能体复现论文胜过大模型

科技/AI
伦敦AI初创Inherent由谷歌DeepMind校友创立,刚完成5000万美元种子轮融资。其AI智能体Faraday借助仅270亿参数的模型,在复现已发表科学论文的任务中优于Anthropic Claude Opus 4.8和OpenAI GPT-5.5。该团队用强化学习培养智能体的“研究品味”,并计划扩大团队,同时呼吁英国改革制约人才流动的“园艺假”制度。
DeepMind校友伦敦初创公司称智能体复现论文胜过大模型

英国伦敦AI初创公司Inherent结束隐身状态后,交出了第一份成绩单:其研发的AI智能体Faraday在复现已发表科学论文的基准测试中,得分超过了Anthropic与OpenAI的旗舰模型。这家由谷歌DeepMind校友联合创办的实验室,同时确认已完成5000万美元种子轮融资。

在DeepMind前员工创立的众多公司中,Inherent此前关注度不高。部分融资规模更大的对手尚未拿出具体产品,这支伦敦团队却开始展示成果。Faraday仅用约270亿参数的Qwen 3.6模型,就压过了Anthropic的Claude Opus 4.8与OpenAI的GPT-5.5——两者都是体量大得多的前沿模型。

所谓复现论文,指在不预知结论的前提下,独立重复实验流程并得到相同结果。联合创始人兼首席科学家爱德华·休斯告诉TechCrunch,这是许多博士生的入门训练,不少博士课题正从复现工作开始。Inherent用这项任务衡量智能体的科研能力,也意在向这一常规靠拢。

休斯表示,他最看重的不是击败其他模型,而是到达结果的方法。“有趣的地方不是我们赢了那些前沿代理,而是我们怎么搭出这套东西。”他告诉TechCrunch。对Inherent来说,Faraday的验收标准不止准确率,还有“研究品味”——判断哪些实验值得做、如何设计实验。

强化学习是培养“研究品味”的关键训练手段。团队没有把训练重心放在研究科研流程的显式规则上,而是通过奖励良好结果来引导模型。他们相信,这种策略更容易迁移到长期目标:让智能体未来在多个科学领域独立产生新知识。

工具策略上,Inherent没有选择全部自研。Faraday在代码环节调用OpenAI的GPT-5.5 Codex,这就像人类科学家使用现成软件,而不是遇到开发任务就从头造一套工具。

公司目前约有12名员工,全员在伦敦国王十字区的一间办公室线下办公。谷歌DeepMind的长期驻扎让这片旧街区变成全球顶尖AI人才聚集地。休斯说,公司相信伦敦才是做这件事的地方。

休斯同时加入了对英国“园艺假”制度的批评。这一常见做法要求员工离职后继续等待数月,才能加入或创办竞争对手企业。他在接受TechCrunch采访时提到,自己亲身经历过这个问题,但强调这是个人观点,不代表公司。

美国科研人员通常不受此类限制,因而美国初创公司能在离职人才争夺中更快动手。Demis Hassabis在谷歌履新AI新职后,部分DeepMind员工开始重新评估去留。Inherent计划年底将员工数扩到20至25人,这为考虑转场的DeepMind研究者提供了一个新选择。