bml.asia · 纯文字 · 写写停停

国内 Flash 月与 DeepSeek 红利

  8 月 26 到 27 号这两天,国内大模型圈像约好了一样,扎堆往外抛“Flash 版本”。阿里一口气泡出 Qwen3.8-Flash 和预告已久的 Qwen3.8-Flash-Next,智谱把此前匿名跑分的“ox-alpha”正式官宣为 GLM-5.3-Flash。三家全是开源或开放权重,全把激活参数压得很小、价格打得很低,全在强调 Agent 编程和原生多模态。很多人第一反应是:这是不是看 DeepSeek V4-Flash 吃了红利,赶紧跟一波?

  但把三家架构摊开看,它们根本不是同一个复制品——总参从 100B 到 320B、激活参数从 6B 到 18B 都差了三倍,连阿里都塞进了 51B 的 n-gram 实验结构。如果真是看到红利就抄,抄出来的该是一模一样的模型;现实是每家都在各自路线上往“Flash 化”调,把激活参数往小压、把成本往低打。DeepSeek 的红利不是“Flash”这个名字,而是推理成本结构:用小激活参数加极低价,验证了“Flash 模型能吃下 Agent 调用量”这个此前没人敢拍板的方向。V4-Flash 系列 7/31、8/21 就发了,先跑了近两个月把“开发者迁移、调用量上涨”的信号放出来,别人才眼里有红利。所以准确说,DeepSeek 证明了“路”的存在,这一波密集发布是各家开着自己的车把路踩得更宽。表层看是 Flash 版本扎堆的声势跟随,里层是 DeepSeek 把一条成本曲线走通了,阿里和智谱不是复制它的车,而是看到这条路确实能跑,于是用自己的架构上路。阿里还顺手把红利转成“千问办公”的应用红利,智谱则正面贴脸 DeepSeek 的 Coding 强项,但三家全开源抢生态的打法,恰恰和 DeepSeek 对上。归根到底,只要推理成本还在降、Agent 调用量还在涨,Flash 化的红利窗口就不会关上,而这一波扎堆对用模型的人只有一个好处——便宜又好用的选择,越来越多了。