ChengRang
EN

Qwen3.8-Flash-Next 新增

AI 编程开发 开源
本页为 通义千问 的版本 / 子产品详情。查看 通义千问 总览 →

阿里通义千问 2026/8/26 深夜开源、基于下一代 Qwen4 架构的先导预览模型:多模态 MoE,主模型总参 125B、每 token 仅激活 6B,另含 51B N-gram 词表层,原生 256K 上下文可扩展至 1M;训练成本较 Qwen3.7-Plus 降近九成,权重已在 Hugging Face 与魔搭开源

阿里 Qwen 开源 MoE 多模态
访问 Qwen3.8-Flash-Next 官网

免责声明:测评内容仅代表编辑个人观点和使用体验,不构成任何商业推荐或投资建议。产品信息和价格可能随时变动,请以官方最新信息为准。

产品简介

Qwen3.8-Flash-Next 是阿里通义千问于北京时间 2026 年 8 月 26 日深夜开源的多模态 MoE 模型,作为下一代 Qwen4 架构的先导预览版,提前释出架构改动供全球开发者检验。该模型主模型总参数 125B,每 token 仅激活 6B,并配备约 51B 参数的 N-gram 词表层。原生支持 256K 上下文,可扩展至 1M,同时内置视觉编码器。其训练成本较 Qwen3.7-Plus 降近九成,权重已在 Hugging Face 与魔搭社区开源,SGLang 提供 Day-0 支持。

核心功能

适合谁用

以下类型的用户会特别受益于 Qwen3.8-Flash-Next:

优点亮点

价格与方案

姊妹模型 Qwen3.8-Flash(非 Next 版)已上线 QwenCloud / 千问平台提供 API 服务,每百万 token 输入 1 元、输出 3 元(约 $0.16/$0.47)。Qwen3.8-Flash-Next 为开源权重模型,具体使用成本以官网为准。

总结与建议

Qwen3.8-Flash-Next 是阿里通义千问为 Qwen4 架构铺路的开源先导模型,以 125B 总参、6B 激活的高效 MoE 设计,结合混合注意力、N-gram 词表等创新,实现低成本训练与本地化部署。其在编码与推理基准上表现亮眼,同时通过开源策略推动社区生态适配,为后续完整版 Qwen4 奠定基础。

版本演进

分类
AI 编程开发
价格
开源
标签
阿里 · Qwen · 开源
官网