Gemini API托管代理:3.6 Flash、钩子及更多功能
内容提要
Gemini API托管代理新增环境钩子、模型选择及免费层访问。环境钩子可在工具调用前后运行自定义脚本,支持命令或HTTP处理,用于安全检查和代码格式化。默认模型升级为Gemini 3.6 Flash,可显式选择其他模型。新增预算控制(max_total_tokens)和定时触发功能,支持自动化任务。免费层项目现可试用,OffDeal等团队已用钩子构建验证流程。
延伸解读
环境钩子的实际用途
环境钩子允许在代理的工具调用前后运行自定义脚本,支持命令或HTTP处理。这为安全检查和代码格式化提供了便利。例如,OffDeal团队利用钩子在远程沙箱内执行图像验证,确保生成的演示文稿符合质量标准。这种机制使得在隔离环境中实现自定义逻辑成为可能,增强了代理的灵活性和可控性。
模型选择与成本控制
默认模型升级为Gemini 3.6 Flash,但开发者可以显式选择其他模型以平衡成本和性能。Gemini 3.5 Flash-Lite提供更低延迟和成本,适合对预算敏感的任务。此外,新增的max_total_tokens预算控制可防止多轮自主循环消耗过多令牌,当达到限制时执行暂停并保留环境状态,允许后续继续。
免费层与自动化任务
免费层项目现在可以试用托管代理,降低了实验门槛。定时触发功能允许通过cron调度自动化任务,每次运行复用同一沙箱,文件得以持久化。这些特性使托管代理成为成本可控的自动化工作器,适合定期执行的任务,如依赖审计或报告生成。
Q&A
Gemini API托管代理新增了哪些功能?
Gemini API托管代理新增了环境钩子、模型选择、免费层访问、预算控制和定时触发功能。
如何在Gemini API托管代理中设置环境钩子?
在环境中添加一个.agents/hooks.json文件,定义pre_tool_execution或post_tool_execution事件的处理程序。每个处理程序可以指定匹配的工具(使用正则表达式)和要执行的命令或HTTP请求。
Gemini API托管代理的默认模型是什么?如何更换模型?
默认模型是Gemini 3.6 Flash。可以通过在创建交互或托管代理时传递agent_config.model参数来显式选择其他模型,例如gemini-3.5-flash-lite。
如何控制Gemini API托管代理的token消耗?
可以在agent_config中设置max_total_tokens参数来限制总token消耗(包括输入、输出和思考)。当达到限制时,执行会暂停,状态为incomplete,可以通过传递previous_interaction_id和新的预算继续。
Gemini API托管代理支持定时触发吗?
是的,支持定时触发。可以创建一个触发器,绑定代理、环境、提示和cron计划,实现自动化任务。每次运行会复用同一个沙箱,文件在多次执行间保留。
免费层用户可以使用Gemini API托管代理吗?
可以。托管代理现在对免费层项目开放,开发者可以使用没有启用计费的项目的API密钥来试验代理工作流。
OffDeal团队如何使用环境钩子?
OffDeal使用post_tool_execution钩子在远程沙箱内运行自动图像验证流程,确保公司标志符合尺寸、透明度等要求,从而生成银行家可用的演示文稿。