内容提要
Anthropic推出Claude Enterprise的推理钩子功能,允许安全团队在提示词和工具调用响应到达Claude前实时检查并执行策略。该功能通过WebSocket连接至DLP服务器,支持允许或拒绝决策,覆盖聊天、Claude Code等所有企业界面,无需单独集成。支持影子模式、角色排除和分阶段部署,现处于测试阶段。
延伸解读
统一防护层:覆盖所有企业界面
此前,Claude Code的客户端钩子仅能覆盖单一产品,而推理钩子通过一个组织级配置,将检查扩展到聊天、Claude Code、Cowork等所有企业界面,包括MCP连接器、技能和插件触发的工具调用。这意味着安全团队无需为每个产品单独集成,即可实现统一的数据防泄漏策略,降低了管理复杂性和遗漏风险。
实时检查机制:模型生成前的关键拦截
推理钩子通过签名的WebSocket连接,在模型生成前将提示词和上下文发送至企业的DLP服务器,服务器返回允许或拒绝的裁决后,Claude才继续执行。同样,工具调用的响应也会在返回模型前被检查。这种实时拦截机制确保未经批准的内容不会进入模型,从而在源头防止敏感数据泄露。
灵活部署与兼容性:降低采用门槛
推理钩子采用开放的webhook协议和已发布的schema,支持与Netskope、Palo Alto Networks、Proofpoint、Zscaler等现有DLP工具对接,或使用自建服务器。此外,影子模式、角色排除和百分比发布等功能,允许组织分阶段部署,并根据风险容忍度调整失败策略和超时设置,从而平滑过渡到全面强制执行。
Q&A
Claude Enterprise的推理钩子(Inference hooks)是什么?
推理钩子是Anthropic为Claude Enterprise推出的一项功能,允许安全团队在提示词和工具调用响应到达Claude之前实时检查并执行策略。它通过WebSocket连接至DLP服务器,支持允许或拒绝决策,覆盖聊天、Claude Code等所有企业界面。
推理钩子如何工作?
当组织启用推理钩子后,每个推理请求都会通过签名的WebSocket连接路由到安全服务器。在模型开始生成之前,Claude将提示词及其上下文发送到服务器,服务器返回允许或拒绝的裁决,Claude只有在收到裁决后才继续。同样,工具调用(包括通过MCP、技能和插件连接的)的响应也会在返回给模型之前被检查。
推理钩子与之前的内联执行有何不同?
之前,原生内联执行仅限于Claude Code的客户端钩子。推理钩子通过单一执行层覆盖所有Claude Enterprise界面,无需单独集成工作或为每个产品配置代理,从而弥合了差距。
推理钩子有哪些典型使用场景?
典型使用场景包括:扩展现有的DLP程序到Claude,覆盖聊天、Claude Code、Cowork等所有企业界面,以及通过影子模式、基于角色的排除和百分比部署简化上线过程。
推理钩子支持哪些安全供应商?
推理钩子基于开放的webhook协议,支持Netskope、Palo Alto Networks、Proofpoint、Zscaler等安全供应商,也支持企业自建的AI安全服务器。
推理钩子目前是否可用?
推理钩子目前以测试版形式提供给Claude Enterprise客户。
推理钩子如何帮助安全团队?
推理钩子为安全团队提供了一个检查点,在数据到达Claude之前实时检查流向Claude的内容,从而在保持控制的同时安全地加速AI应用。