概览
Qwen4 架构预览:125B 主模型加 51B N-gram embedding,每 token 激活 6B,并可扩展到 1M 上下文。
仅展示已有公开资料的规格。
Qwen4 架构预览:125B 主模型加 51B N-gram embedding,每 token 激活 6B,并可扩展到 1M 上下文。
它引入 QSA、Gated Residual 与 N-gram memory,在显著降低计算量的同时推进长上下文 Agent。
Qwen3.8-Flash-Next 权重开放,并以 Qwen3.8-Flash 提供托管服务。
查看原文点击卡片查看相关模型。