铭鸿体育资讯网

Qwen3.8-27B刚发,MoE的35B-A3B 也要发布了

Qwen3.8-27B 刚开源没多久,以 Dense 在小参数量级别上又吸了一波眼球。

很多人还在问 MoE 的 Qwen3.8-35B-A3B,似乎也已经在路上了。

起因是有人在 ModelScope 的 ms-swift 代码更新(08-14)里发现,Qwen3.8 的支持列表中已经悄悄加入了:Qwen3.8-35B-A3B 以及对应的 Qwen3.8-35B-A3B-FP8 版本。

而且它不是文档里的一个占位名称,而是已经直接进入 qwen.py 的 ModelGroup,与 Qwen3.8-2.4T-A95B 一起使用新的 qwen3_8 Template。

从命名来看,这款模型大概率延续 35B 总参数、约 3B 激活参数的 MoE 路线。

相比刚发布的 27B Dense 打平甚至微超 Claude O铺 4.6,35B-A3B 真正瞄准的可能不是“再刷一次大模型榜单”,而是本地部署党:总参数量不算小,但每次推理只激活约 3B,在显存占用、推理速度和模型能力之间,会有一个非常有吸引力的平衡点。

上一代 35B-A3B 就是很多 8GB~16GB 显存玩家很喜欢的规格。

如果 Qwen3.8 把这一档也补齐,那么这一代的产品线就越来越清楚了:

27B Dense:追求单卡高质量
35B-A3B MoE:追求低成本、高吞吐
2.4T-A95B:冲旗舰上限

目前 Qwen 官方还没有正式发布 Qwen3.8-35B-A3B,因此模型能力、上下文长度、量化后的实际显存占用以及最终发布时间都还不能下定论。

但代码已经先到了,按照这种节奏,35B-A3B 模型的权重可能真的不远了。

本周再来一次?