谷歌云在Gemini at Work大会上正式发布Gemini Agent,该产品可将Google Workspace中分散的应用、数据和工作流程整合为统一的工作智能体。值得注意的是,Gemini Agent在模型调度上支持谷歌自研Gemini与Anthropic旗下Claude之间的切换,未来还将扩展至更多模型。
根据谷歌云CEO Thomas Kurian的介绍,Gemini Agent的核心能力在于跨应用执行与上下文保持。用户可通过自然语言指令完成复杂任务,例如要求其协调会议时,Gemini Agent可结合Gmail邮件、Google Chat群聊记录和Calendar日历信息,在授权范围内识别相关人员、检查时间并发送协调邮件,用户无需手动切换多个应用。在Gmail中,Gemini可主动识别任务并提供一键委托入口;在Docs中可修改文档;在Chat中可响应任务请求,跨应用工作时保留相同的上下文、记忆和技能。
除个人助手形态外,谷歌还推出Coworker Agent模式。企业用户可描述所需岗位职责,Gemini将创建拥有固定职责和独立身份的AI同事。该Agent可获得独立的Workspace账号,包括邮箱、日历和Drive存储空间,并可出现在公司通讯录中。同事可通过Google Chat @该Agent分配任务,或在Docs评论区要求其修改文件。结合谷歌云和BigQuery等数据基础设施,Gemini Agent还可连接企业数据库、调用分析工具,并根据公司业务指标生成报表,将工作范围从办公软件延伸至企业后台数据与业务系统。
谷歌此次在模型选择策略上做出明显调整。Thomas Kurian表示,最强模型可能每隔几个月就会更换,不同任务不一定需要相同模型,灵活选择供应商可兼顾效果与成本。目前Gemini Agent可在Gemini和Claude之间调度。谷歌官方评测数据显示,在Terminal-Bench 4.0测试中,Gemini 4 Argon得分57.4%,Claude Opus 5.5为66.4%;在FrontierSWE v2测试中,Argon为55.0%,Claude为62.3%。据《商业内幕》10月9日报道,一位谷歌员工认为早期测试的Argon在部分编程任务上落后于上一代Claude Opus 5。谷歌云此前已允许企业开发者使用Claude,此次将多模型选择进一步引入通用工作Agent产品线。
谷歌在Agent领域的布局并非始于今日。2024年12月,谷歌推出Google Agentspace,整合Gemini推理能力、谷歌搜索和企业数据,支持员工跨系统搜索信息及创建Agent。2025年4月,谷歌发布Workspace Flows,允许用户通过自然语言创建自动化工作流。2025年10月,谷歌将Agentspace整合进Gemini Enterprise,试图打造统一的企业AI工作入口。然而,尽管技术储备充足,谷歌在Agent产品认知度上始终未能建立起与Manus、Muse等产品同等鲜明的市场形象。2025年5月Google I/O大会推出的个人Agent Gemini Spark也未能获得显著市场反响。
从行业视角看,谷歌在企业协作生态方面具备显著优势。Gmail、Calendar、Docs、Sheets、Drive及Google Chat等产品经过20余年经营,已深度嵌入大量企业用户的日常工作流程,其他公司的办公Agent在替用户执行任务时往往也需要接入谷歌产品体系。Gemini Agent的能力可直接与现成企业协作体系结合,这是其区别于独立Agent产品的关键差异。但微软同样拥有Microsoft 365和Azure的完整生态,且更早将Copilot嵌入办公软件,至今未能彻底整合分散在各产品中的AI能力,这表明生态资源的有效利用仍是行业性难题。
谷歌此次将Agent竞争力置于自家模型独占性之前的策略,反映出企业Agent市场正从单一模型能力竞争转向任务调度与生态整合能力的比拼。随着Agent产品在企业场景中的渗透加深,多模型调度能否成为行业标准,以及谷歌能否借此在Agent赛道建立差异化优势,仍需观察后续产品落地效果与客户采用情况。
该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。