7家中国AI公司!近2亿次Claude交互,Anthropic又开始发疯式“点名”
编辑:kid 一份刚刚发布的安全报告,把中国AI圈几乎半张明星名单都点了一遍。 Claude背后的Anthropic声称,阿里巴巴、月之暗面、DeepSeek、智谱、小米、商汤和MiniMax等中国AI公司,曾通过代理账号、转发用户请求等方式,大规模获取Claude的回答和“推理痕迹”,再用于训练自己的模型。 其中,仅报告明确给出数量的几次行动,加起来就接近1.9亿次模型交互。TechCrunch将其概括为“接近2亿次”。 更敏感的还不是谁学了谁,而是Anthropic的另一项指控:一些用户以为自己正在使用Kimi或DeepSeek,提交的内容却可能被转发给Claude处理;部分对话中甚至包含姓名、企业资料、内部代码和有效访问凭证。 如果这一说法属实,这就不再只是AI公司之间的“技术借鉴”纠纷,还会变成普通用户的数据去了哪里的现实问题。 01 所谓“蒸馏”,其实不是坏词 先别被“非法蒸馏”这四个字吓到。 模型蒸馏本身是一种常见技术。简单理解,就是让一个能力更强的“老师模型”回答大量问题,再用这些问答训练体积更小、成本更低的“学生模型”。 它有点像让尖子生做几万套题,再把解题过程整理成教材。学生模型不必从小学一年级重新学起,也能迅速掌握一部分能力。 问题在于,老师是否同意,以及学生是怎么拿到这些教材的。 Anthropic将“未经授权、工业规模、隐蔽地提取模型能力”定义为非法蒸馏。它声称,相关行动会使用虚假身份、一次性邮箱、代理服务器,甚至被盗的信用卡和API密钥,批量注册Claude账号。 更特别的是,这些操作者不只想拿到Claude最终给出的答案,还想套出模型内部更完整的推理过程。 Anthropic举了一个颇有黑色幽默感的例子:有人要求Claude把此前的“工作记忆”翻译成只使用片假名的日语,试图借“翻译任务”绕过保护措施。 有的行动甚至先发出一万多种不同提示词,测试哪一种最容易骗出推理内容。找到有效方法后,再扩大请求规模。 这已经不是找Claude帮忙做作业,更像是在研究怎样把老师的备课笔记一起搬走。 02 阿里相关行动被指涉及1.51亿次交互 Anthropic把最大规模的一次行动归因于阿里巴巴相关操作者。 报告称,2026年5月至7月间,该行动涉及超过1.51亿次Claude交互,高峰期每天接近300万次,请求来自3500多个欺诈账号。 Anthropic认为,获取的内容被用于提升通义千问模型在智能体、软件工程、内核开发和长流程任务上的推理能力。Claude据称还被用于设计强化学习环境和研究模型架构。 需要强调的是,这些全部是Anthropic的调查结论,目前没有公开的第三方技术审计,也没有看到阿里方面的正式回应。 第二大行动被Anthropic归因于月之暗面。 报告称,2026年5月至7月间,相关交互超过2300万次。某个十天周期内,接近30万个用户请求通过5380个账号被发送至Claude,其中多数调用的是Opus模型。 最抓眼球的一项指控是:部分用户以为自己正在使用Kimi,但请求实际上被转发给Claude,Claude生成的回答再显示给用户。 Anthropic还声称,月之暗面保存了部分对话,并尝试从中提取Claude的完整推理内容,用于模型训练。 03 DeepSeek用户的请求,也被点名了 DeepSeek同样出现在报告中。 Anthropic声称,它在2026年7月的14天内,观察到超过1210万次被归因于DeepSeek的交互。 按照报告描述,DeepSeek会识别使用Claude Code、Claude Agent SDK或OpenCode等第三方编程工具的请求,再选择其中部分内容转发给Claude Opus。 Anthropic列举的案例包括企业内部文档、项目组织结构、数据库凭证以及公共安全系统开发资料。报告没有公开相关用户和公司的身份,敏感字段也经过遮挡处理。 智谱被归因的规模超过340万次,小米则超过40万次。Anthropic特别说明,它没有发现小米直接用Claude的回答服务MiMo用户;其指控是,小米保存部分用户对话后,将这些内容重新提交给Claude,用于生成和筛选训练数据。 商汤和MiniMax也被点名,但报告没有提供同等级别的量化数字。 04 真正让普通用户后背发凉的,是数据流向 模型之间互相学习,听起来像技术公司的内部战争。用户数据被悄悄转交给另一个平台,就完全是另一回事了。 Anthropic声称,它在相关请求中发现了姓名、邮箱地址、公司内部数据、源代码和访问凭证,涉及至少十几种语言、数百名用户。 部分对话来自第三方模型路由服务。用户为了方便,在一个平台里调用不同公司的模型,却未必清楚平台会不会保存请求、请求最终送到了哪台服务器,以及这些对话是否会再次用于训练。 这给所有AI用
发表评论