Claude in Chrome 现已全面上线

Claude in Chrome 现已全面上线

💡 原文英文,约1200词,阅读约需5分钟。
📝

内容提要

Anthropic宣布Claude in Chrome正式上线,支持所有付费计划,可自主执行浏览器操作。为防提示注入攻击,系统采用分类器验证每个动作,并训练模型识别攻击。测试显示,最新模型在防护下攻击成功率极低,仅Fable 5有0.3%低风险成功案例。用户可从Chrome商店安装,企业版可管理设置。

🔎

延伸解读

安全机制如何运作

Claude in Chrome 通过三层防护应对提示注入:训练模型识别攻击、用探针扫描网页内容、以及用分类器在动作执行前验证其是否符合用户请求。这些机制让 Claude 能自主执行操作,同时降低被恶意指令劫持的风险。用户仍可在设置中关闭自动批准,改为手动确认每个动作。

攻击成功率数据解读

Anthropic 的测试显示,在启用探针和分类器后,Sonnet 5 和 Opus 5 的攻击成功率为 0%,Fable 5 为 0.3%,且均为低风险场景。但未加防护时,Opus 4.5 和 Opus 5 的成功率分别达 17.6% 和 3.8%,说明防护措施显著提升了安全性。不过,提示注入攻击仍在演变,防护需持续更新。

适用场景与限制

Claude in Chrome 可访问内部仪表盘、旧系统等未直接集成 Claude 的工具,利用现有登录信息执行读取、点击、填表等操作。但需注意:它仅支持 Chrome 浏览器,不兼容其他 Chromium 浏览器或移动端;处理本地文件或跨应用操作仍需桌面应用。企业版可限制域名,便于管理。

Q&A

Claude in Chrome 现在对哪些用户开放?

Claude in Chrome 现已全面上线,对所有付费 Claude 计划的用户开放。

Claude in Chrome 能做什么?

Claude in Chrome 可以查看当前页面,并执行读取和输入文本、点击链接、页面导航、填写表单等操作,使用用户现有的登录信息。

什么是提示注入攻击?

提示注入攻击是恶意行为者在网页、电子邮件或表单字段中隐藏指令,这些指令用户可能看不到,但会试图欺骗 AI 代理执行用户未要求的操作。

Anthropic 如何防御提示注入攻击?

Anthropic 通过三种方式防御:训练模型识别更多攻击、使用探针扫描工具结果中的潜在注入、以及使用分类器在动作执行前进行验证,确保动作与用户请求一致。

Claude in Chrome 的自动批准功能如何工作?

Claude in Chrome 现在可以自动批准它认为安全的动作,使用与 Claude Code 自动模式相同的机制。分类器会审查即将执行的动作,如导航或输入文本,并与原始请求比对,不匹配则阻止。用户可以在设置中关闭此功能。

在最新的测试中,Claude 模型对提示注入攻击的成功率是多少?

在最新评估中,使用探针和自动批准分类器后,Claude Sonnet 5、Opus 5 和 Mythos 5 的攻击成功率为 0%,Fable 5 为 0.3%,且所有成功案例均为低风险场景。

如何开始使用 Claude in Chrome?

用户可以从 Chrome 网上应用店安装 Claude in Chrome。企业版管理员可以在组织设置中管理,并限制为批准的域名。

Claude in Chrome 有哪些限制?

Claude in Chrome 目前不支持其他 Chromium 浏览器或移动端,并且处理本地文件或与其他应用交互仍需使用 Claude 桌面应用。

🏷️

标签

➡️

继续阅读