当整个行业还在争论哪个模型更聪明、上下文更长、推理更便宜的时候,谷歌在 7 月 7 日放出了一个看似平淡的 API 更新:Gemini API 的 Managed Agents 新增了后台执行、远程 MCP 集成、自定义函数调用和跨交互凭证刷新四项能力。这不像一次炫技式的模型发布,却可能比很多"更聪明的模型"更接近 AI Agent 竞争的真正内核——把 Agent 的运行时,直接塞进开发者的 API 里。

一、一次"不像谷歌"的更新

过去一年,谷歌在 Agent 领域的动作大多围绕模型与产品:Gemini 全线 Agent 化、Gemini Spark 登陆 Mac、Omni 打通四模态输入输出。这些打法与其他巨头高度同质——都在"模型层"贴身肉搏。但这次 Managed Agents 的更新,方向明显不同:谷歌没有再证明自己的模型比谁强,而是把 Agent 当成一个可托管、可异步、可远程连接的基础设施来交付。

在行业语境里,这是一个微妙但关键的转向。Anthropic 与 OpenAI 的战争,新闻里充斥着更强的模型、更长的上下文、更低的推理成本;而谷歌选择了一条更"平台化"的路——它想把开发者对 Agent 的依赖,从"调一个更聪明的模型"变成"跑在一个更省心的运行时上"。这种打法,在云计算史上有一个经典参照:AWS 当年不靠自研最酷的应用赢,而是靠把算力、存储、队列、鉴权全部变成可调用的基础设施,最终锁死了整个开发者生态。

二、四项能力,各自打在生产痛点上

从技术文档看,这次升级是四个能力的集合,但每一个都精准指向一个真实的生产落地痛点。

后台执行(Background Execution)。在 Agent 工程实践里,最让开发者头疼的问题之一是:一个任务到底要跑多久?过去很多 Agent 调用是同步的,客户端必须一直挂着等结果,长任务一旦中断就前功尽弃。谷歌的解法很直接——在 Interactions API 调用中传入 background: true,服务器立即返回一个任务 ID,客户端可以随时用这个 ID 轮询状态、流式查看进度,或断线后重新连接。本质上,谷歌把 Agent 从"同步 RPC"变成了"异步任务队列",这让长程多步任务第一次有了工程上可信的承载方式。

远程 MCP 服务器集成(Remote MCP Integration)。MCP 协议解决的是 Agent 与外部工具的连接问题。把远程 MCP 接进 Managed Agents,意味着 Agent 不再只能调用本地写死的函数,而是可以动态连接外部工具服务器——这把 Agent 的可扩展性从"开发时决定"推进到"运行时决定",也是多工具、多环境协作的前提。

自定义函数调用(Custom Functions)。允许开发者把自有业务逻辑缝进 Agent 的运行时,而不是把所有判断都仰赖模型黑箱。对金融、医疗、企业 IT 这类强合规、强定制的场景,这意味着 Agent 可以在"模型自由发挥"与"业务硬约束"之间找到可控制的接口。

跨交互凭证刷新(Credential Refresh)。Agent 一旦要跨多个应用、跨多次交互连续工作,登录态与鉴权就会成为隐形断点。凭证刷新的意义在于,让 Agent 能在不中断任务的前提下维持不同系统的身份,这是"连续工作数小时"这类场景真正跑通的底层条件。

三、平台战争:谷歌在打另一场仗

把四项能力放在一起看,谷歌的意图逐渐清晰:它要的不是"我的模型比你强",而是"你的 Agent 最好跑在我这里"。后台执行解决了"跑得久",远程 MCP 解决了"连得广",自定义函数解决了"控得住",凭证刷新解决了"不断线"。四块拼起来,恰好是一个生产级 Agent 运行时的最小闭环。

这与 OpenAI 用 ChatGPT Work 把聊天、编码、文档生成揉进一个超级应用,以及 Anthropic 用 Claude Cowork 把协作工作空间做成桌面入口,形成了有趣的对照:前者在做"应用层入口",谷歌在做"基础设施层底座"。两条路没有对错,但赌注不同——应用入口的护城河容易被新交互颠覆,而基础设施的护城河一旦形成,迁移成本极高。

当然,把 Agent 运行时塞进 API,也意味着谷歌在用一种更隐蔽的方式争取"平台锁定"。当开发者的任务调度、工具连接、凭证管理都长在 Gemini API 上,切换到别的供应商就不再是换个模型名那么简单。这是平台战争的必然代价,也是开发者需要权衡的地方。

四、客观看:机会与隐忧并存

这次升级的价值是真实的:它把 Agent 从"能演示"推向"能托管",解决的是行业普遍卡在 POC(概念验证)阶段、难以进入生产的工程断层。对长任务、多工具、跨系统协作类场景,后台执行与远程 MCP 几乎是刚需。

但也要清醒看到几处待验证的地方。其一,异步托管、远程连接、凭证长期持有,会带来新的攻击面与权限治理难题,Agent 一旦拥有持久身份和跨系统操作权,安全边界必须同步重建。其二,平台锁定效应是一把双刃剑,开发者在享受便利的同时,也在让渡未来的迁移自由度。其三,目前公开信息主要来自谷歌技术文档与行业解读,四项能力的实际稳定性、成本模型与大规模并发表现,仍待生产环境检验。

无论如何,谷歌这次"不像谷歌"的更新,给行业提了个醒:当模型能力逐渐趋同,Agent 的竞争很可能从"谁的模型更聪明"转移到"谁的运行时更省心"。平台战争,才刚刚开场。