几乎全员中招
Anthropic最近发了一个信息量很大的报告,通过实例和证据列举了近期大量人工智能滥用问题。 这个报告本身具有很大争议性,比如滥用的定义权到底归谁?又比如报告一出,大量用户担心自己的内容隐私会被大模型公司看得清清楚楚。 今天我们围绕这个话题,聊聊这次报告中提及的 大模型蒸馏的细节、蒸馏是否合理、最危险的事以及投资者的自我保护。 一、几乎全员中招 在Anthropic的报告中,针对非法/未经授权的蒸馏点名了七家中国公司,甚至把他们的方法和细节都公开出来了: 阿里:蒸馏规模最大 ,Anthropic称,5月至7月超过1.51亿次交互,峰值接近每天300万次,主要提取Opus 4.6、4.7的完整推理过程,用于训练Qwen 3.5、3.6和3.7; 月之暗面:用户请求悄悄转给Claude,再把回复当成Kimi吐回去。 10天转了近30万条,整段归因超2300万。还绕过thinking signature,把思考过程抠出来训自己的模型; DeepSeek: 和月之暗面类似,专门把走Claude Code/ OpenCode的用户请求转去Opus,14天内超1210万条; 智谱: 把已经取得的Claude reasoning trace重新喂给Claude,让 Claude自己清洗、标准化这些被蒸馏的数据,然后训练GLM。10天273个假号在Opus 4.8光清洗就77万条,17天总共归因340万条,还拿Claude 当裁判给训练数据打分。GLM 5.3发布前,用公开漏洞集出CTF题,去套另一家美国顶模的黑客能力。发现Fable防护太硬啃不动,转头打防护更弱的Opus 4.6; 小米MiMo: 把自家用户跟MiMo的聊天、写代码记录回放给Claude做训练数据,并不拿去给用户看。20天40多万条,走了1500多个代理号.时间点刚好卡在MiMo-V2-Pro免费试用结束时,疑似靠免费吸引全球开发者来刷量,好批量收割去蒸馏; 商汤SenseTime: 自己不直接蒸, 从第三方数据商买别人从中转站扒下来的 Claude 对话记录,还让Claude帮自己写蒸馏流水线; MiniMax: 开了个壳公司做代理,相当于中转站, 只卖Anthropic和OpenAI的访问,连自家模型都不挂。 而做这个中转站的目的就是为...