DeepMind校友创立的Inherent称其AI代理复现研究超越Anthropic和OpenAI

Inherent,一家由 Google DeepMind 校友在伦敦创立的 AI 实验室,刚刚展示了其 AI 代理 Faraday 在科研复制任务上的表现,声称超过了 Anthropic 和 OpenAI 规模大得多的模型。这家公司刚以 5000 万美元种子轮融资走出隐身模式。

Faraday 的核心任务是在不知道答案的情况下,独立复现已发表的科学论文中的发现。这看似像场表演,但联合创始人兼首席科学家 Edward Hughes 表示,论文复现对于人类科学家而言也是标准训练。真正让团队感兴趣的并非赢过别人,而是实现过程中采用的方法。

关键在于模型规模:Faraday 运行在一个相对较小的模型 Qwen 3.6 上,仅有 27 亿参数,对比的是 Anthropic 的 Claude Opus 4.8 和 OpenAI 的 GPT-5.5,两者都是前沿级的大规模系统。除了准确率,Inherent 还追求“研究品味”——即判断哪些实验值得做、如何设计实验的直觉。这通过强化学习实现,用奖励机制而非显式规则来训练。团队刻意不主要基于科学方法论进行训练,坚信奖励驱动能更好地泛化到未来跨学科的 AI 科学家目标。

这种原则也影响了 Inherent 的构建选择:他们不开发自己的编码工具,而让 Faraday 使用 OpenAI 的 GPT-5.5 Codex,类比人类科学家使用现有软件。同时,团队避免构建只迎合用户的代理,而是期望像理想中的队友那样,主动提出实验并分享结果。

公司规模很小,十二名员工在伦敦 King’s Cross 线下办公。Hughes 看好伦敦的 AI 人才密度,但也呼吁废除英国的“花园假期”规定——离职者被限制数月内不得加入或创办竞争公司。他个人曾受影响,最终与三位其他 DeepMind 校友(以及第四位联合创始人)共同创立了 Inherent。公司计划年底将员工数增至约 20 至 25 人,并同时布局世界模型。随着 Demis Hassabis 的新角色可能引发 DeepMind 内部变动,Inherent 或成为一些员工考虑的下一站。

Inherent, founded by DeepMind alumni, says its AI 'teammate' just outperformed Anthropic and OpenAI at replicating research | TechCrunch

查看原文