谷歌正式加入办公智能体领域的混战,并且强调了多模型调用的能力,甚至直接把竞争对手 Anthropic 的 Claude 也安排上了。今天凌晨,Google Cloud 发布了一篇由 CEO Thomas Kurian 署名的长文《Welcome to Gemini at Work 2026: Introducing the Gemini agent》,集中介绍了 Gemini 在企业 Agent 领域的一系列更新。其中最重磅的无疑是全新发布的 Gemini Agent。
按照谷歌的设想,这是一个能够覆盖各类工作任务、长期运行的通用办公 Agent。它能帮你查资料、写邮件、做 PPT、分析数据、编写和运行代码,还能跨应用调用工具,自行规划任务,必要时召集多个子 Agent 协同工作。
有两个特别值得注意的点。一是它拥有自己的企业身份,成为一名有邮箱、有日历、有独立账号的 AI 同事。二是它能根据任务自动选择底层模型,甚至调用 Anthropic 的 Claude。这意味着谷歌甚至不再局限于使用自家模型。
这次发布的功能显然是针对最近火热的办公 Agent 市场。Meta 的扎克伯格听到消息后,内心可能充满疑惑:谷歌不专心优化自家笨重的 Gemini 模型,转头就冲着我来了?谷歌为 Gemini Agent 设定的工作原则是:“You give it objectives, not instructions”,即给它目标,而非逐步指令。这意味着用户只需交代最终想要的结果,剩下的安排交给它自己完成。
其核心能力包括统一入口、云端持久运行、跨平台调用、多 Agent 协作、事件触发和定时任务等。例如,让它完成一份市场分析报告,它可以自行搜索整理资料、分析数据、在 Google Sheets 中建立财务模型,再调用 Google Slides 生成演示文稿。整个过程中,它能根据需要选择工具、调用不同应用,最后将成果交付给用户。
虽然类似的跨应用操作并不新鲜,但谷歌此次强调的是将各种工作能力集中到一个 Agent 身上。在此基础上,谷歌提出了“Coworker Agent”概念,即“同事智能体”。谷歌允许企业为 Gemini 创建一个长期存在、具有明确工作职责的身份,让它像团队中的其他成员一样参与日常协作。AI 同事配置了独立的 Google Workspace 账号、企业邮箱、日历和 Google Drive 存储空间,还能出现在公司通讯录中。团队成员可以像对待普通同事一样,邀请它加入 Google Chat 群聊或在文档中 @ 它。AI 同事使用独立身份,操作会留下记录,方便企业管理和追踪。
更关键的是,除独立身份外,Gemini Agent 还拥有更完整的记忆机制。官方介绍它拥有四种记忆:会话记忆(保存当前任务上下文)、语义记忆(从文档和交流中积累结构化知识)、程序性记忆(记录工作完成方法,甚至能编写 Skills 供后续使用)和情景记忆(记录过去的工作经历)。这四种记忆结合,使 Gemini Agent 能逐渐熟悉用户习惯、公司业务和团队协作方式,就像新员工一样在入职后逐渐熟悉环境,无需每次从头解释。
谷歌甚至用了一个比喻:“Gemini 会像新员工一样,在正式开展工作前,逐渐熟悉你、你的工具和团队。” 唯一的问题是,这个“员工”似乎不会主动离职。此外,该 Agent 支持自主选择底层模型。现阶段,它可以在 Google 自家的 Gemini 系列以及 Anthropic 的 Claude 系列之间动态选择,未来计划支持更多闭源和开源模型。谷歌将这套能力称为多模型编排,并配套提供 Smart Routing 自动路由能力。底层模型可以变化,但 Agent 积累的上下文、Skills 和企业数据可以保留,确保企业无需因模型切换而重置工作流程。
谷歌此次入场的时间点颇为微妙。就在 9 月 29 日,OpenAI 刚发布了能够 7×24 小时工作的 Dots;此前,Meta 也推出了个人 AI Agent Muse。如今谷歌带着 Gemini Agent 加入战局,三家巨头在 Agent 领域正式碰头。回顾另外两家的发展路线:Meta 的 Muse 偏向个人生活场景,关注购物、预订、发邮件等琐碎事务;OpenAI 的 Dots 则与 Gemini Agent 共同点多,拥有独立云端电脑、7×24 小时运行、记住长期目标、连接 4000+ 应用,但目前更侧重于围绕用户个人持续工作。谷歌的重点则在于让 Agent 深入企业已有的组织和办公体系,利用 Gmail、Docs、Sheets 等应用的业务上下文,创建具有独立身份的 Coworker agent 参与协作,并将模型选择、企业数据连接、安全审计和成本控制纳入体系。
如此看来,三家的侧重点已十分清晰。
