Gemini API 托管智能体上线 3.6 Flash 与沙箱 hooks
谷歌托管智能体运行时默认切至 Gemini 3.6 Flash,并新增工具调用前后 hooks、token 上限、定时触发与免费额度。
谷歌 7 月 28 日更新 Gemini API 中的 Managed Agents(托管智能体),让这套托管运行时从预览形态向生产基础设施该有的控制面靠拢。
更新内容
antigravity-preview-05-2026 智能体现默认使用 Gemini 3.6 Flash,同时可显式选择 Gemini 3.5 Flash 与 3.5 Flash-Lite 以压低成本。最重要的新增能力是环境 hooks:开发者通过 .agents/hooks.json 注册基于正则匹配的处理器,在沙箱内任何工具调用之前或之后触发,执行 shell 命令或 HTTP 调用。谷歌的定位是用 hooks 实现对工具调用的拦截、检查与审计——也就是说,策略执行从「包在运行时外面」挪进了托管运行时内部。
配套还有:max_total_tokens 参数为单次运行设置消耗上限;状态保留机制让未完成的交互可续跑而非重启;支持 cron 语法的定时触发,且沙箱在多次执行间持久存在;以及用于列出、查看、删除沙箱会话的 Environments API。托管智能体现已可在免费额度项目中通过 API key 使用。
为何重要
这里的设计范式明显是借来的。工具调用前后 hooks、持久沙箱、定时自主运行,正是让本地编码智能体框架变得可控的那几个原语;谷歌现在把它们做成带计费、带免费入口的托管服务。这会重设竞争命题:智能体平台的差异点正从模型质量转向「运营者能否约束、观测并给成本上限」——而上周前沿实验室的沙箱逃逸事故,恰好把这道缺口摆到了台面上。
token 上限与可续跑状态也直指让智能体部署长期卡在试点阶段的那笔账:失控循环烧光预算却毫无产出,以及长任务一失败就前功尽弃。定时触发加持久环境走得更远,让智能体在无人值守的多次运行之间保留上下文——这很有用,但也正是这种配置下,hooks 不再是锦上添花,而是定时任务与一次无人复核的工具调用之间唯一的那道闸。