智能工具库

Gemini API托管代理升级:3.6 Flash、环境钩子与免费层

Gemini API托管代理升级:3.6 Flash、环境钩子与免费层

Gemini API的Managed Agents现默认使用Gemini 3.6 Flash模型,新增环境钩子、预算控制和定时触发功能,并开放免费层访问,帮助开发者更灵活地构建和管控AI代理工作流。

2026-07-29 0来源:Google AI Blog

托管代理功能再进化

Google DeepMind 团队近期为 Gemini API 的 Managed Agents(托管代理)带来了一系列重要更新,涵盖了模型升级、安全管控、成本优化和可访问性等多个维度。这些新能力建立在之前发布的后台任务远程 MCP 服务器集成基础之上,让开发者能够通过单个 API 调用,在隔离的云沙箱中完成推理、代码执行、包安装、文件管理和网页检索等复杂操作。

对于使用 AI 编程助手的开发者,可以通过一条命令快速接入 Interactions API 技能:

npx skills add google-gemini/gemini-skills --skill gemini-interactions-api

默认模型升级为 Gemini 3.6 Flash

最直观的变化是,antigravity-preview-05-2026 代理现在默认运行 Gemini 3.6 Flash 模型。这意味着现有用户无需修改任何代码,下一次交互就会自动使用新模型。

如果你希望对模型有更精细的控制,可以在创建交互或托管代理时通过 agent_config.model 参数显式指定。例如,想要降低成本的团队可以选择 Gemini 3.5 Flash-Lite:

import { GoogleGenAI } from "@google/genai";

const client = new GoogleGenAI({});
const interaction = await client.interactions.create({
  agent: "antigravity-preview-05-2026",
  input: "Audit all dependencies in package.json, upgrade outdated packages, and verify the build by running npm test.",
  environment: "remote",
  agent_config: {
    type: "antigravity",
    model: "gemini-3.5-flash-lite",
  },
});
console.log(interaction.output_text);

目前支持的模型包括:

  • Gemini 3.6 Flash(默认):在推理、编码和工具调用方面表现均衡
  • Gemini 3.5 Flash:适用于通用代理工作流的上一代模型
  • Gemini 3.5 Flash-Lite:延迟和成本最低的选择

环境钩子:沙箱内的安全管控

本次更新最值得关注的技术亮点是环境钩子(Environment Hooks)。它允许你在代理于沙箱内执行每次工具调用之前或之后,运行自定义脚本。这对于构建生产级验证管道特别有价值。

使用方式很简单:在环境中添加一个 .agents/hooks.json 文件,运行时就会在 pre_tool_executionpost_tool_execution 事件触发时执行你的处理器。matcher 字段支持正则表达式,可以用 | 匹配多个工具,或用 * 捕获所有调用。

以下配置展示了两个实际场景:

{
  "security-gate": {
    "pre_tool_execution": [
      {
        "matcher": "code_execution|write_file",
        "hooks": [
          {
            "type": "command",
            "command": "python3 /.agents/hooks-scripts/gate.py",
            "timeout": 10
          }
        ]
      }
    ]
  },
  "auto-format": {
    "post_tool_execution": [
      {
        "matcher": "*",
        "hooks": [
          {
            "type": "command",
            "command": "python3 /.agents/hooks-scripts/auto_lint.py",
            "timeout": 15
          }
        ]
      }
    ]
  }
}

在这个配置中:

  • 安全门禁:在执行任何 code_executionwrite_file 调用前运行 gate.py。如果脚本返回 {"decision": "deny", "reason": "..."},工具调用会被跳过,拒绝原因会传入模型上下文
  • 自动格式化:每次工具执行完毕后运行 auto_lint.py,强制执行代码风格规范

钩子还支持 http 类型处理器,可以直接将事件 POST 到外部端点,方便与现有监控或审计系统集成。

更多实用更新

除了上述核心功能,本次更新还加入了预算控制定时触发免费层访问。预算控制让团队可以更好地管理 API 成本,定时触发则支持按计划运行代理任务,而免费层开放降低了入门门槛,让更多开发者能够体验托管代理的能力。

对于正在构建 AI Agent 应用的开发者来说,这些更新意味着更强的可控性和灵活性——既能通过环境钩子确保安全合规,又能根据场景灵活选择模型平衡成本与性能。

本文基于 Google AI Blog 的公开内容,由 AI 辅助整理改写后发布。

原标题:Gemini API Managed Agents: 3.6 Flash, hooks, and more

阅读原文