Anthropic报告里的AI假人与非法蒸馏

Anthropic报告里的AI假人与非法蒸馏

💡 原文中文,约7200字,阅读约需18分钟。
📝

内容提要

Anthropic报告称,有中国公司利用Claude操控约4700个AI账号,在约会软件上针对美国用户实施诈骗,两周内发送236万条消息;另有中国本科生用Claude搭建自动化漏洞挖掘工具,攻击约50个组织;7家中国实验室被指非法蒸馏Claude,其中月之暗面转发了30多万次请求。报告数据为单方面提供,无法经第三方验证。

🔎

延伸解读

单方面报告的证据局限

Anthropic报告中的数字均来自其自身服务器日志,未经第三方验证,被点名方也未回应。这种单方面证据虽难以核实,但转发请求等流量记录相对具体。读者需注意,报告由模型厂商发布,可能存在选择性披露,不宜视为全貌。

AI诈骗的流水线化特征

报告描述的诈骗案中,AI人设、真人零工和后台系统分工协作,形成流水线。系统能实时监测用户怀疑并调整话术,甚至对重病用户继续欺骗。这种模式比传统诈骗更高效,且各环节隔离,增加了识别和追责难度。

非法蒸馏与数据隐私风险

报告称7家中国实验室通过代理网络非法蒸馏Claude,其中月之暗面被指转发用户请求。若属实,用户与Kimi的对话可能被第三方获取,包括敏感监控数据。这凸显了模型服务中数据流向不透明的问题,用户难以知晓自己的数据被如何处理。

报告的双重价值与局限

尽管报告单方面且可能不完整,但它公开了模型被滥用的具体案例,如自动化漏洞挖掘、电子战应用等,促使行业关注AI安全。然而,报告未涵盖其他模型平台的类似行为,读者应避免以偏概全,同时认识到公开此类信息对厂商而言并非易事。

Q&A

Anthropic报告里提到的AI假人诈骗案具体是怎么回事?

一家中国App工作室利用Claude在约会软件上操控约4700个AI假人,针对美国用户实施诈骗。在2026年4月的两周内,这些假人与至少25000名真人聊天,发送了236万条消息。运营方还招聘真人零工处理视频通话等AI难以完成的任务,并使用小模型生成候选回复供零工选择。

非法蒸馏Claude是怎么回事?有哪些中国实验室被点名?

非法蒸馏指未经授权,用大量假账号和盗刷信用卡,以工业规模偷偷将Claude的请求和回答用于训练自己的小模型。报告点名了7家中国实验室,其中月之暗面(Kimi)被指在十几天内将30多万个用户请求悄悄转发给Claude,再把回答显示给用户;DeepSeek也被指通过类似手法转发请求。

Anthropic报告的可信度如何?为什么说它无法验证?

报告是Anthropic单方面发布的,所有数据均来自其自己服务器上的日志,没有第三方验证。被点名的公司均未公开回应,外界也无法核对日志。报告可能不完整或存在双标,但其中关于非法蒸馏的流量证据相对较硬,因为请求确实打到了Anthropic服务器上。

报告里提到的中国本科生漏洞挖掘案是什么?

案件代号GTG-10007,两名湖南高校计算机与通信工程学院的在读本科生,利用Claude搭建了一套自动化漏洞挖掘工具,昼夜不停运行,攻击了约50个组织,涉及教育、零售、能源、医疗、金融、制造及多国政府机构。他们从一家教育科技公司窃取了几百兆学生数据,还攻破了东南亚某国政府机构,获取公民姓名、电话和住址。

报告还提到了哪些其他类型的滥用案例?

报告还提到:电子战软件(GTG-17002),用Claude开发了16个模块的中文电子战系统,默认场景针对台湾的12个目标;监控维稳(GTG-14021),网警用Claude Code分析舆情和监控数据库,甚至生成针对普通公民的处置建议;生物风险,有人试图用Claude增强基孔肯雅热病毒的传播力和免疫逃逸能力,以及模糊化毒素研究进度报告。

作者对Anthropic报告的整体看法是什么?

作者认为报告虽单方面但值得鼓励,因为很少有公司愿意公开自己产品被滥用的证据。他总结五点:报告无佐证;Claude被广泛滥用;这些只是缩影;所有请求都留下日志,被Anthropic这样的私人公司监控;发布报告比不发布强,尽管会得罪客户和对手。

🏷️

标签

➡️

继续阅读