2026年10月8日,Google 在 Gemini at Work 活动上公布,新的 Gemini Agent 会依据具体工作内容,在自家 Gemini 与 Anthropic 的 Claude 之间进行调度,未来还计划接入其他闭源和开源模型。这意味着 Claude 从过去摆在云平台上供开发者自行挑选的「货架商品」,变成了 Gemini Agent 内部后台调度的一项能力。
Claude 出现在 Google 体系里并不新鲜。早在 2024 年 3 月,Claude 3 系列就已上架 Vertex AI,企业客户可以在 Google Cloud 里调用。两家的算力关系更深:2025 年 10 月,Anthropic 宣布将使用多达 100 万颗 Google TPU,合作规模达数百亿美元,2026 年上线的算力超过 1 吉瓦。
把对手的模型放进自家旗舰产品,Google 为何认为不吃亏?发布原文给出的答案是:领先模型每隔几个月就会更替,保持选择开放,意味着模型换代时,用户的上下文、技能和数据仍留在原处。Google 在同一份发布中表示,Gemini 会保留四种记忆,分别对应当前工作、知识库、做事方法和全部历史记录;它还会给 Agent 分配一个独立的 Workspace 账号,拥有自己的邮箱、日历和 Drive。底层调用哪个模型,员工未必在意;但这些积累要搬走,代价很高。
顺着这一逻辑,AI Agent 的竞争可拆为四层:模型层决定推理上限;框架层(Harness)管理长程上下文、工具调用与任务状态,决定执行能否稳定;上下文层沉淀企业数据、流程规范与个性化记忆,构成迁移壁垒;生态层决定 Agent 能实际访问哪些软件与业务数据,决定任务能否真正交付。前两层是过去两年的参数角逐场,Google 这次押注的是后两层。
Harness 开始接管模型选择。能回答问题不等于能把事做完,让 AI 做一份季度经营分析,需要读文件、核对口径、调用工具、画图、写报告并按反馈修改,Harness 负责管理这一连串动作。当 Google 把持续执行、编排和选模型装进同一产品后,模型就从被直接挑选的对象变成被调度的资源。模型厂商因此多了一样要争的东西——谁来接活。推理最强但工具调用不稳或价格偏高的模型,未必分得到所有工作;综合排名稍弱的模型,可能在某类流程里完成率更高。
不过 Harness 只管怎么做,做什么、在哪里做、能碰哪些业务对象,取决于后两层。进不了真实业务系统,再好的规划也只能停在建议上。
上下文层是 Google 真正想留住的东西。一个用了两年的 Agent,攒下的远不止聊天记录:它知道汇报格式、常用数据口径、哪些客户要先回、哪类审批要抄送谁,也连好了常用工具。换模型几乎没有成本,Google 可以在后台替你换;换一家 Agent 产品则麻烦得多,工具要重连、历史要迁移、授权要重建,每个工作流都得重新验证。Agent 时代的护城河,很可能就是这笔迁移成本。因此 Google 开放 Claude 与守住客户并不矛盾:放开模型层,客户不必为更好的模型出走;记忆、技能和工作环境则留在 Gemini 里。
生态层的价值,看覆盖了多少工作。过去衡量互联网生态看用户规模、使用时长、交易额和流量入口;到了 Agent 时代要加一个维度——交给 AI 的一件事,有多少步骤能在这个生态里办完。知识工作对应 Gmail、Drive、Docs、Sheets、Slides、Calendar,或 Outlook、SharePoint、Word、Excel、PowerPoint 和 Teams,这里 Google 和 Microsoft 占尽先机。私人助理要看预订、支付和履约的外部授权;电商商户则更依赖商品库、交易记录、广告系统、物流、支付和客服工具。同样叫 Agent,背后要的生态完全是两套。
Google 和 Microsoft 的优势在于工作本来就在他们的系统里。Gmail 存沟通历史,Drive 存文件,Docs、Sheets、Slides 负责产出,Calendar 管时间,Google Cloud 连着企业数据和算力;Microsoft 有 365、Teams、Windows、GitHub 和 Azure。两家都不必从零搭入口,要解决的是让 Agent 在现有体系里拿到合适授权并可靠执行。但自家地盘也有边界,一家企业可能用 Microsoft 365,CRM 放在 Salesforce,财务放在 SAP,数据放在别家云上。Google 显然看清了这一点,这次发布的 Gemini 可以接 Microsoft Office、Teams、Slack、Salesforce、ServiceNow、Jira 和 Snowflake,也能在 Microsoft 365 和 Slack 里直接调用。它一边守着 Workspace,一边把手伸进对手的地盘。OpenAI 和 Anthropic 没有同等规模的办公套件,靠的是 ChatGPT 的应用连接、Claude 的连接器和 MCP 集成,有机会成为跨生态的中间界面,代价是长期应付第三方授权、接口变化和执行可靠性。
国内的形态不同。海外企业软件分工清楚,国内则是超级 App 和集中的生活服务入口,微信、淘宝、支付宝、抖音、美团、钉钉、飞书、企业微信,每一个都同时承载入口、交易、沟通和协作。比价、下单、查物流、退换货,阿里最完整,千问 App 在 2026 年 5 月全面连上淘宝商品目录;腾讯的牌是关系,截至 2026 年 6 月,微信及 WeChat 合并月活 14.39 亿;字节离内容和流量最近,豆包、抖音、剪映、飞书、火山引擎几乎都覆盖了。海外没有完全对应的,是手机厂商这条线:华为在 HarmonyOS 6 里发布鸿蒙智能体框架 HMAF,字节和中兴努比亚合作的豆包手机助手预览版则直接读屏幕、模拟点击,但上线后多位用户反馈用它操作微信时被限制登录,豆包随后发布说明,限制刷分刷激励类自动操作,进一步限制银行和互联网支付类应用的代操作。
门开不开,归根到底是账怎么算。2026 年第二季度,腾讯营销服务收入 436 亿元,同比增长 22%,占总收入 2048 亿元的两成以上;同一季度,阿里中国电商的客户管理收入同比下降 7%。这类收入的前提是有人在看,Agent 替人直接下单、跳过浏览,平台少的是曝光和广告。所以最合算的做法是把 Agent 放在自家 App 里,外部 Agent 来敲门时,超级 App 会设门槛、谈条件。这比技术难度更能解释跨平台 Agent 在国内推进得慢。
模型厂商也有难处。被 Gemini 调度,Anthropic 拿到了分发渠道,却离最终客户又远了一层;调度方按完成率和价格分活,模型之间会更快陷入比价。这也是 OpenAI 和 Anthropic 都在建自己连接器生态的原因,没人想只做别人产品里的供应商。Google 这边的账要简单得多:Claude 有相当一部分算力跑在 Google TPU 上,客户的记忆、技能和数据又留在 Gemini 里,底层用谁的模型,Google 都有收入。
谁能决定哪个 Agent 进门,迟早会被监管盯上。欧盟《数字市场法》第 6 条第 7 款已要求守门人免费向第三方提供与操作系统功能的有效互操作;国内 2021 年工信部专项整治时,也要求平台分步骤解除即时通信软件对网址链接的屏蔽。Agent 能不能跨 App 办事,很可能成为下一轮互联互通的议题。
回到 Google 这次发布,它让 Gemini Agent 调用 Claude,并没有放弃自家模型,而是在同时争模型能力和产品控制权,只是比拼的单位变大了。过去比推理能力,后来比成功率、成本和稳定性,现在还要比记忆和技能留在谁家,Agent 又能进到多少真实场景里。模型决定了它能想多远,Harness 决定了它能走多稳;但一项工作最终能不能办成,核心取决于它握着哪些真实系统的钥匙,以及这些系统背后的业务大门,究竟愿不愿意为它常态化敞开。