英国AI实验室Inherent于近日发布了一款名为Faraday的AI智能体,宣称其在复现科学研究论文方面的能力已超越Anthropic和OpenAI的同类模型。Inherent由DeepMind校友创立,专注于将AI应用于科学研究场景,Faraday的推出被视为AI从辅助工具走向独立科研执行者的重要信号。
据Inherent介绍,Faraday的核心能力在于读取科研论文后,能够自主设计并执行实验流程,以验证或复现论文中的研究结果。在内部基准测试中,Faraday在多项复现任务上的成功率高于Anthropic的Claude和OpenAI的GPT系列模型。该公司表示,这一能力对于加速科学创新具有重要意义,因为当前大量科研工作受限于实验复现的耗时与成本。
Inherent并未披露Faraday的具体技术架构和训练数据细节,但强调其模型在设计上优先考虑了科研工作流的复杂性,包括对实验步骤的推理、参数调整以及结果分析。该公司认为,通用大模型在科研场景下往往缺乏对实验细节的精确理解,而Faraday通过专门的训练和推理机制,能够更贴近科研人员的实际操作逻辑。
从行业背景看,AI在科学研究领域的应用正成为大模型公司争夺的下一块高地。OpenAI、Anthropic和Google DeepMind此前均推出了面向科研的AI工具,但大多集中在文献检索、代码生成或假设提出等辅助环节。Inherent选择以“复现研究”这一具体且高难度的任务切入,试图建立差异化的竞争壁垒。
Faraday的推出也反映出AI智能体正从通用对话向垂直领域深度执行演进。对于企业服务市场而言,科研机构、制药公司和材料科学企业可能成为这类AI智能体的首批客户,它们对实验流程自动化、结果可验证性有明确需求,而Faraday所展示的能力有望降低研发门槛并缩短创新周期。
目前,Inherent尚未公布Faraday的商业化计划或对外合作案例,但该公司表示,后续将逐步开放测试渠道,并探索与学术机构和产业实验室的联合部署。随着AI在科研执行层面的能力持续提升,如何平衡自动化与人类科学家的判断力,将成为这一赛道后续发展的关键议题。
该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。