阿里开源 Qwen3.8-Flash-Next:Qwen4 架构预览,125B 总参仅激活 6B
阿里 8 月 26 日晚在魔搭与 Hugging Face 开源基于下一代 Qwen4 架构的多模态 MoE 模型 Qwen3.8-Flash-Next 及 FP8 版:125B 总参数仅激活 6B 即超越 Claude Opus 4.6,训练成本较 Qwen3.7-Plus 降近 90%,原生 262K 上下文(可扩至 1M),输入每百万 Token 1 元、输出 3 元,为完整 Qwen4 家族预热。