话说,Kimi K3带来的巨大震动还没结束,国产大模型又迎来了两条重磅消息。
第一条来自阿里。今天,阿里通义千问团队预告,Qwen3.8很快将发布并开源,新模型参数2.4T,正在以“天”为单位持续进化,可能是除了Fable 5外最强大的模型。与此同时,Qwen3.8-Max Preview已经率先上线Token Plan、Qoder和Qoder Work。官方介绍称,新模型总参数达到2.4T,并且正在以“天”为单位持续进化,内部目标直指全球最强模型。
第二条来自DeepSeek。多家媒体和开发者消息显示,DeepSeek V4正式版已经进入灰度测试,测试视频已经流出。按照目前业内流传的信息,最快有望于明天正式发布,不过截至目前,DeepSeek官方尚未公布具体发布时间。
如果消息属实,那么就在Kimi K3发布后不到一周,中国三家头部大模型公司——月之暗面、阿里、DeepSeek,将连续推出自己的最新旗舰模型。这种更新节奏,即便放到全球AI行业来看,也非常罕见。
更重要的是,它们已经不是在争“国产第一”了,而是在冲击全球第一梯队。
Kimi K3率先打响了这一枪。作为目前全球最大的开源权重模型,它拥有2.8T总参数,在Web开发、Agent、长程Coding等多个第三方评测中跻身全球第一梯队,甚至部分榜单已经逼近Anthropic最新的Claude Fable 5,因此一经发布便引发海外开发者圈广泛讨论。
紧随其后的Qwen3.8,虽然总参数略低于Kimi K3(2.4T vs 2.8T),但阿里此次释放出的信号同样强烈:官方直接表示,新模型正在快速迭代,也有开发者试用后认为,其Coding能力已经开始逼近Claude Fable 5。不过,目前完整的技术报告和第三方基准测试尚未公布,这一判断仍有待验证。
至于DeepSeek,更值得关注的是它会不会再次刷新“性能/成本比”。过去一年,DeepSeek最擅长的不是单纯堆参数,而是用更低的训练和推理成本,把模型能力推到全球领先水平。之前,有测试者称,DeepSeek V4正式版的性能达到了 Claude Opus 4.8 的水平。甚至有激进的人士认为,在某些测试中,DeepSeek V4正式甚至压过了 Fable 5 和 GPT-5.6。当然,现在没有正式的版本和评测出来,但如果V4正式版能够进一步提升推理和Agent能力,它很可能再次成为全球开发者关注的焦点。
而就在一个多月,另一家国产头部模型公司智谱也刚刚发布了GLM-5.2。这款模型同样获得了不少海外开发者认可,在Agent和Coding能力上进入了全球第一梯队,被不少分析人士认为缩小了与国际顶尖闭源模型的差距。路透社甚至评价,中国AI公司的发布节奏正在明显加快,已经开始持续向OpenAI、Anthropic等美国头部公司施压。
回头来看,今年这个夏天,国产大模型最大的变化,其实不是谁暂时排第一。
而是中国头部模型公司开始几乎同时向全球最强模型发起冲击。