6月25日,据媒体报道,美国AI公司Anthropic向美国参议院银行委员会致信,指控阿里巴巴通过约2.5万个账号,在4月22日至6月5日期间,与Claude模型完成了近2880万次交互。
Anthropic将该行为定性为“工业级蒸馏攻击”,认为对方仅用几百万美元的API调用成本,就试图复刻Claude耗费数十亿美元研发的核心能力,目标直指旗舰模型Mythos Preview的软件工程与智能体推理能力。
Anthropic称这是其迄今遭遇的最大规模模型蒸馏攻击。
截至目前,阿里巴巴未作出任何公开回应。
消息曝光后,舆论并没有一边倒地站队Anthropic,科技博主Evrim Kanbur的观点被大量转发,他表示逆向工程、基准测试、研究竞争对手,长期以来都是科技行业的常规竞争方式,而在通义千问于软件工程基准实现领先后,同类行为却被直接定性为恶意攻击。
IO.Net联合创始人Tory Green的评价更为直接,直指Anthropic依靠开放互联网内容训练自身模型,却在他人学习其模型能力时,直接扣上“蒸馏攻击”的帽子。
事实上,“蒸馏”不是黑话,是正经技术。
此外,外界对Anthropic的质疑,很大程度上来自它自身的版权争议黑历史。
2025年9月,Anthropic以15亿美元和解了美国史上规模最大的AI版权诉讼,法院查实其从盗版网站下载超700万本图书用于Claude模型训练。
2026年1月,多家音乐出版商起诉其非法抓取2万首版权歌曲,索赔金额达30亿美元。此前Reddit也曾起诉Anthropic,指控其未经许可爬取平台十余万条帖子和评论。
马斯克曾在社交平台转发相关新闻并嘲讽,质疑Anthropic指责他人偷窃的能力,本身就源自海量人类原创成果。
2026年5月,Claude Opus 4.8 上线后,多名开发者测试发现,模型在回答自身身份问题时会自称 “通义千问”“DeepSeek”,行业普遍推测其训练数据混入了中国开源模型的输出内容。一来一回的技术溯源,也让这场指控的争议性和讽刺性大幅提升。
抛开Anthropic的过往争议,模型蒸馏本身在行业内并无绝对对错。
这项技术由Geoffrey Hinton在2015年提出,是业界通用的正规模型训练方式。Anthropic也曾在官方博客中承认,前沿AI实验室都会定期蒸馏自有模型来迭代优化版本。
行业争议的核心,在于使用竞品API输出训练自家模型的行为界定。不少AI企业都存在这类操作,却始终没有明确的法律条文判定其合规性。AI2研究员Nathan Lambert认为,此次事件的问题核心是虚假账号滥用规则,并非蒸馏技术本身违规。
这起争议最值得玩味的,是 Anthropic 的处理方式 —— 它跳过商业沟通与司法程序,直接将问题递交给了美国国会。今年2月,它刚用类似方式点名过DeepSeek、月之暗面、MiniMax三家中国公司。
Anthropic公司近期提交了IPO文件,冲刺高额估值,但其与美国国防部的合作在2月底宣告破裂。几乎同一时间,DeepSeek V4、Qwen3.7-Max等中国开源模型快速崛起,编程能力持续逼近海外模型,且API定价远低于Claude,持续压缩其技术与价格优势。
来源:布谷财经