几乎全员中招
Anthropic最近发了一个信息量很大的报告,通过实例和证据列举了近期大量人工智能滥用问题。
这个报告本身具有很大争议性,比如滥用的定义权到底归谁?又比如报告一出,大量用户担心自己的内容隐私会被大模型公司看得清清楚楚。
今天我们围绕这个话题,聊聊这次报告中提及的大模型蒸馏的细节、蒸馏是否合理、最危险的事以及投资者的自我保护。
一、几乎全员中招
在Anthropic的报告中,针对非法/未经授权的蒸馏点名了七家中国公司,甚至把他们的方法和细节都公开出来了:
阿里:蒸馏规模最大,Anthropic称,5月至7月超过1.51亿次交互,峰值接近每天300万次,主要提取Opus 4.6、4.7的完整推理过程,用于训练Qwen 3.5、3.6和3.7;
月之暗面:用户请求悄悄转给Claude,再把回复当成Kimi吐回去。10天转了近30万条,整段归因超2300万。还绕过thinking signature,把思考过程抠出来训自己的模型;
DeepSeek:和月之暗面类似,专门把走Claude Code/ OpenCode的用户请求转去Opus,14天内超1210万条;
智谱:把已经取得的Claude reasoning trace重新喂给Claude,让 Claude自己清洗、标准化这些被蒸馏的数据,然后训练GLM。10天273个假号在Opus 4.8光清洗就77万条,17天总共归因340万条,还拿Claude 当裁判给训练数据打分。GLM 5.3发布前,用公开漏洞集出CTF题,去套另一家美国顶模的黑客能力。发现Fable防护太硬啃不动,转头打防护更弱的Opus 4.6;
小米MiMo:把自家用户跟MiMo的聊天、写代码记录回放给Claude做训练数据,并不拿去给用户看。20天40多万条,走了1500多个代理号.时间点刚好卡在MiMo-V2-Pro免费试用结束时,疑似靠免费吸引全球开发者来刷量,好批量收割去蒸馏;
商汤SenseTime:自己不直接蒸,从第三方数据商买别人从中转站扒下来的 Claude 对话记录,还让Claude帮自己写蒸馏流水线;
MiniMax:开了个壳公司做代理,相当于中转站,只卖Anthropic和OpenAI的访问,连自家模型都不挂。而做这个中转站的目的就是为了把用户跟美国模型的对话存下来训练模型。
如果指控全部属实,则说明中国AI行业已经高度依赖蒸馏,甚至把绕过闭源模型限制、获取其隐藏推理、收集真实用户prompt、再用于 SFT/RL这一连串操作做成了一条工业化的数据生产线。
我们现在再回看一下曾经的豪言壮语与宏大叙事,比如“OpenAI没有发明任何东西”、“英伟达正在自掘坟墓”,恐怕和当初会是截然不同的感觉↓
二、蒸馏是否合理?
说Anthropic这家公司喜欢装神弄鬼也好、对中国有敌意和偏见也好,这些都不假,但Anthropic大概率不会无中生有地提出这些指控,而且白纸黑字拿出了极为具体的证据。
尽管一家公司的发言并不代表就是真相,但目前被指控蒸馏的几家大模型公司尚未有一家提出反驳和澄清。
关于蒸馏,有一种声音说蒸馏是合情合理的,是共享人类发展成果,闭源模型自己的训练不也是基于公开数据进行的吗?凭什么不让别人蒸馏呢?
这个说法显然是在混淆概念。
按照这个逻辑,专利制度都可以取消了,反正所有机械发明最终都建立在公开免费的牛顿力学之上;
按照这个逻辑,任何人都可以去扫描全馆内容然后卖盗版了。
我们如果站在Anthropic或OpenAI的角度想,自己投入了巨大的资金和心血,训练出前沿大模型,然后被其他人通过蒸馏实现了八九成的能力,再以极低的价格去卷市场,你是不是也会很不爽,有这种感觉才是人之常情。
这证明了一个道理,那就是这个世界上根本就不存在多快好省,只有脚踏实地,一切表面上的弯道超车和多快好省都是不可信的。
令人欣慰的是,并不是所有中国公司都涉嫌侵犯知识产权,这个报告中未提及字节的豆包,符合张一鸣之前长期主义不蒸馏的战略表态。
事实上,在中国所有的大模型中,字节走的也是最稳的,尽管其他大模型不断刷新存在感,但走视频路线的Seedance现在已经成为变现能力最强的国产模型,不蒸馏、在商言商、不搞民族主义和宏大叙事、不急功近利、坚持长期主义,最终一定会收获更多。
三、真正危险是什么?
比起蒸馏这一有争议但之前大家都心知肚明的操作,这次更危险的是数据泄露...就算顶着知识产权争议为国为民蒸馏美帝大模型是爱国正能量行为,但操作的过程太过草台班子,导致的数据泄露已经对国家带来了难以估量的损失。
Anthropic在陈述大模型蒸馏过程时,指出月之暗面、DeepSeek、小米转给Claude的内容里出现过企业内部代码、实时API凭据、公司战略资料、个人姓名和联系方式,甚至公安系统、军工和政府相关数据。报告中甚至具体到给出了使用者所在单位、在Claude上想做的事情和流程。下面是Anthropic给出的一部分信息,可信度怎么样,读者可自行判断↓
这个人表示仅靠这批数据,就足以入侵7家国家机构,以及19家中国大型企业,点名包括小米、华为、蔚来、MiniMax等。他晒出的截图里还能看到深信服、蔚来、B站、小米、中科大、之江实验室等机构的Git/GitLab地址,考虑到中国有无数 中转站,甚至根据Anthropic的报告,中国大模型公司自己就做中转站,这其中究竟泄露了多少信息,令人细思恐极。
当然,Anthropic显然也是借刀杀人,他们深深知道国家安全在中国是最高优先级,比大模型要重要得多,之前中国三令五申国产AI数据不得出境,现在却搞出这样的问题,这会严重削弱政府、机构、企业对于这些国产模型的信任,月之暗面和DeepSeek的上市前景恐怕将蒙上一层阴影。
Anthropic不惜损失用户对自己的信任度,也要对一部分用户开盒来搞这么一出借刀杀人,这个操作虽然阴险狠毒,但又是谁在给Anthropic递刀子呢?
四、投资者的自我保护
在当下这些高高在上遥遥领先的创新者中,聪明的人太多、善良的人又太少,既聪明又善良的个人或公司实在是太奢侈。
这件事也让我们明白中国投资者的难处,因为投资就是交朋友,现在能交到的朋友要么是充满油腻感毫无想象空间的传统行业老登、要么是宏大叙事夸夸其谈估值上天的科技。
要选低估值的资产,往往成长性很低(例如银行、能源)、资产质量很差;要选有前景的赛道,估值全都上天而且还都喜欢宏大叙事投机取巧。
两者相比,后者的危害要更大,因为低估值公司就算不成长,就算资产质量有水分,分红总是真的;而后者的高估值以及涉及今天主题中的这类争议问题随时可能让普通投资者倾家荡产...比如最近内地和香港市场上的自研GPU(摩尔线程、沐曦股份)、大模型(智谱、MiniMax)、机器人(宇树科技)等相关公司股价的表现惨不忍睹,不是因为赛道有问题,而是宏大叙事背景下估值被炒高,然后每一次宏大叙事都要用无数普通人的血泪作为代价,没有一次是例外。
作为一个投资者,是要实实在在的真金白银,还是要宏大叙事的情绪价值,答案不言而喻。
本期内容主要来自本周的星球订阅内容的一部分,该内容已于今天发布,主要内容参考下方截图↓
想加入星球的朋友,可以通过下方的海报了解和加入↓











评论
发表评论