舒畅世界观察:中国AI公司通过欺诈账号,弯道超车被抓

作者:舒畅
发表时间:
+-

舒畅世界观察:中国AI公司通过欺诈账号,弯道超车被抓

最近,Anthropic披露的一份AI安全报告引起广泛关注。

Anthropic是美国最重要的人工智能公司之一,其Claude与OpenAI的ChatGPT、Google的Gemini并列为世界领先的大型AI系统。Anthropic最新的一份研究披露,它的系统发现DeepSeek、Moonshot(月之暗面)和MiniMax等多家中国AI公司,通过大规模创建欺诈账号(至少2.4万个),与Anthropic公司的Claude进行了超过1600万次交互。

这些假账号和代理网络大规模调用可以免费使用的Claude,获取其输出结果,用于这些公司AI系统的自我训练,增强其人工智能系统的功能。这里涉及AI领域一个很重要的术语——“模型蒸馏”(model distillation)。

所谓模型蒸馏,可以理解为让一个规模较小、能力较弱的“学生模型”,向一个规模更大、能力更强的“教师模型”学习。其过程大致分为两步:第一步,能力较弱的“学生模型”准备大量问题,并把这些问题提交给能力强大的教师模型,由教师模型生成答案;第二步,学生模型的开发者把这些问题和答案整理成训练数据,再用来集中训练自己的学生模型。

经过大量学习,学生模型便可以模仿教师模型的回答方式,掌握其中部分知识、推理方法和语言表达能力。这样,一个原来能力较弱的小模型,就可能在Given大量资金和时间、在短时间内显著提高性能,在面对类似的新问题时,也能给出更准确、更成熟的回答。

由于任何一个AI系统都需要进行大量训练,而其训练成本极高,对于不具有Claude这种强大算力和先进算法的弱小模型,比如中国的某一家AI公司“”,原则上可以向Claude“乙”提出问题,再收集Claude“乙”产生的高质量答案,利用这些丰富的“问题—答案”资料来训练“”自己的模型,迅速提高“甲”的能力。

”还可以直接把Claude“乙”的答案稍作修改,然后发送给“”的用户,算作“”系统自己的答案,本质上当然是一种欺骗。但是,Claude“乙”明文规定,并不允许任何外国AI公司例如“”这样弯道超车,只有小型个人用户可以蒸馏。因此,“”通过欺诈方式,不间断地进行几千万次甚至几亿次咨询,并接收Claude“”的宝贵答复数据。AI公司“甲”即便使用的是小模型,也可以通过这种不正当搭便车的方法,迅速学到大模型的相当一部分能力。

模型蒸馏本身并不是非法技术。AI公司也经常使用自己的大型模型训练较小模型。问题在于,如果未经对方允许,利用大量虚假账号、代理服务器等手段绕过限制,大规模抽取竞争对手模型的能力,性质就完全不同了。

Anthropic把这种行为称为“illicit distillation”——未经授权的蒸馏。

上述情况最早是Anthropic今年2月发现的,而公开披露则是在9月10日Anthropic公布的最新报告中。他们发现,利用这种方式的不止一家AI公司,而是7家中国AI公司都通过这种弯道超车的方式欺骗了Claude,规模之大令人咋舌。

Anthropic称,它发现并因此采取措施,阻断了来自7家中国AI实验室的相关活动,其中包括阿里巴巴、Moonshot、DeepSeek和小米等。其中规模最大的是与阿里巴巴有关的活动。

根据Anthropic披露,从今年5月至7月,它观察到阿里巴巴的Qwen模型相关活动与Claude进行了超过1.51亿次交互,与Moonshot有关的活动约有2300万次交互,与DeepSeek有关的活动约有1210万次。高峰时期每天接近300万次,涉及3500多个被Anthropic认定为欺诈性的账号。Anthropic认为,这些活动的目的之一,是获取Claude的能力,用于改进这些公司他们自己的系统的能力。更值得一提的是,Moonshot和DeepSeek的一些系统甚至把部分真实用户提出问题转送给Claude所产生的答案作为答案直接给用户;同时也将这些结果用于自己的服务和模型训练。这已经不是一般意义上平等的“参考竞争对手产品”了。

那么,Anthropic是怎样发现这些活动的?

它不是简单地根据“中国IP地址”作出判断,而是综合分析IP地址、请求元数据、账号之间高度同步的行为、代理服务器网络、提问方式,以及其他AI公司的交叉情报。正常用户不会每天组织成千上万个账号,连续向Claude提出几十万甚至几百万个高度结构化的问题,专门测试逻辑推理、编程、工具调用和Agent能力。Anthropic发现这些公司采用一种被称为“hydra cluster”——“九头蛇式账号网络”的结构:一个假账号被封,马上就产生另一个新的假账号接替;一个代理网络曾经同时管理超过2万个欺诈账号。

这种情况揭示了进入2026年以来,AI时代一种新的技术竞争方式。过去讲技术窃取,无非就是偷图纸、偷专利、偷代码、偷商业机密,无所不用奇及。到了今天的人工智能时代,竞争者也许根本不再需要进入对方服务器,也不一定需要获得对方的源代码和模型权重。只要能够持续几千万乃至上亿次地向最先进的模型提问,把它产生的高质量答案系统地收集起来,就可能把这个“老师”的真本事偷到自己的“学生”身上。

当然,也不能因此就绝对地说“中国AI都是靠美国技术训练出来的”,更不能说“中国AI没有真正的技术能力”。今天,中国已经成为美国之外最强大的AI竞争力量之一。DeepSeek、Qwen、Kimi等模型在编程、推理、Agent以及成本控制等方面,已经表现出相当强的竞争力。中国拥有大量优秀的工程师和庞大的应用市场。但是,以上情况却还是表明了狂妄自大地宣称“中国AI已经全面超过美国”,同样站不住脚。