Chrome开源插件:Jev加WebMCP打通网页自动化工具选择

Chrome开源插件:Jev加WebMCP打通网页自动化工具选择

💡 原文中文,约5600字,阅读约需14分钟。
📝

内容提要

Google开发者Sarah Drasner推出Chrome扩展,将Jev模型与WebMCP标准结合,实现网页工具自动选择。Jev是TypeSafe的“系统一”模型,只做选择、打分和判断,不生成文本,响应仅70-500毫秒且无法幻觉。扩展实时预测工具调用并显示置信度,每次按键查询成本极低。该方案拆分意图理解与结构化输出,提升可靠性,但存在数组参数填充等局限。

🔎

延伸解读

Jev 与 WebMCP 的互补逻辑

Jev 是只做选择、打分和判断的“系统一”模型,不生成文本,响应仅 70-500 毫秒且无法幻觉;WebMCP 则让网站以结构化工具形式暴露自身功能。两者结合,Jev 从 WebMCP 注册的工具中实时选择并填充参数,解决了“工具箱里工具太多,代理不知道选哪把”的问题。这种拆分意图理解与结构化输出的架构,提升了可靠性和速度,但 Jev 只能在给定选项内选择,因此工具 schema 的质量直接决定最终效果。

实时预测与成本控制

扩展在用户每次按键时触发一次 Jev 查询,实时显示预测的工具、置信度和延迟。开发者担心这会烧穿电池和 API 额度,但作者实测整个周末高强度使用仅花费 32 美分。这得益于 Jev 的定价:每百万输入 token 收费 0.042 美元,输出 token 免费,且单次查询 token 量很小。这种设计刻意暴露模型思考过程,让用户看到置信度如何随输入逐步收敛,同时也为评估 WebMCP 工具设计提供了反馈信号。

安全边界与置信度阈值

WebMCP 安全模型通过多层防护降低风险:工具加载时 Jev 会评估描述中是否包含针对代理的指令,被标记的工具无法自动运行;工具默认视为会改变状态,除非声明 readOnlyHint;只有高置信度的只读调用才能自动执行,且可随时关闭;带有后果性注解的工具无论置信度多高都需二次确认。有开发者建议在无人值守管道中将置信度阈值设为 0.85,低于则中止并走确定性回退。但 Jev 的概率校准质量依赖训练数据和评测集,实际可靠性仍需独立验证。

当前局限与生产化差距

Jev-WebMCP 扩展目前只填充数组的第一个元素,像 items: ["oat milk", "bread", "eggs"] 这样的多元素数组只会被填成 items: ["oat milk"],这是转换规则尚未覆盖所致。此外,Jev 只能在给定选项内选择,如果 WebMCP 工具 schema 写得不好,选出的工具可能就是错的。这些细节揭示了演示项目与生产系统之间的差距。扩展仍在 Chrome 应用商店审核中,其开源代码和演示站点可供开发者进一步探索。

Q&A

Jev模型是什么?它和传统大语言模型有什么不同?

Jev是TypeSafe AI开发的“System One”模型,它只做选择、打分和判断,不生成文本。与ChatGPT等“System Two”大语言模型不同,Jev响应时间仅70-500毫秒,且无法幻觉,因为它只从给定选项中选择,不会创造新内容。

WebMCP是什么?它和MCP有什么区别?

WebMCP是Chrome团队推动的网页标准,让网站将自身功能以结构化工具形式暴露给AI代理,如checkout、add_to_cart等。MCP是连接AI代理和外部系统的后端标准,任何平台都能用;WebMCP是浏览器前端标准,只在特定网站上生效。Chrome官方将两者比作“客服呼叫中心”和“实体店专家”的区别。

Jev-WebMCP扩展如何实现网页工具自动选择?

扩展读取当前页面注册的所有WebMCP工具,将每个工具的schema转换成Jev能回答的类型化问题(如工具列表变成Choice问题),然后在用户打字过程中实时预测该调用哪个工具,并显示预测的工具、置信度和延迟。

使用Jev-WebMCP扩展需要什么安装条件?

需要Chrome 149+,并启用WebMCP(通过chrome://flags/#enable-webmcp-testing开启)。在chrome://extensions开启开发者模式,加载已解压的扩展程序,然后打开侧边面板,在设置中粘贴来自console.typesafe.ai/keys的API Key并保存。访问带有WebMCP工具的网站时,点击“Enable on (site)”授予权限。

Jev-WebMCP扩展如何处理安全性和确认机制?

扩展采取多层防护:工具加载时评估描述中是否包含恶意指令,被标记的工具无法自动运行;工具默认视为会改变状态,除非声明readOnlyHint;只有高置信度的只读调用可自动执行,且可关闭;带有后果性或破坏性注解的工具始终需要二次确认。

Jev-WebMCP扩展目前有哪些局限性?

主要局限包括:Jev只能在给定选项中选择,如果WebMCP工具schema写得不好,可能选错工具;数组参数目前只填充第一个元素,如items: ["oat milk", "bread", "eggs"]只会填成items: ["oat milk"];置信度分数的可靠性依赖训练数据和评测集,需要更多独立验证。

🏷️

标签

➡️

继续阅读