模型索引
阿里云·Qwen

Qwen3.8-Flash-Next

Qwen4 架构预览:125B 主模型加 51B N-gram embedding,每 token 激活 6B,并可扩展到 1M 上下文。

当前版本推理编码Agent多模态开放权重
模型编号076
发布日期
2026-08-26
组织
Alibaba Cloud
家族
Qwen
01

规格概览

仅展示已有公开资料的规格。

总参数
176B
激活参数
6B
架构
Hybrid
上下文
262K
输入模态
文本 · 图像
开放权重
许可证
Apache-2.0
状态
当前版本
02

概览

概览

Qwen4 架构预览:125B 主模型加 51B N-gram embedding,每 token 激活 6B,并可扩展到 1M 上下文。

为什么重要

它引入 QSA、Gated Residual 与 N-gram memory,在显著降低计算量的同时推进长上下文 Agent。

03

相对前代的变化

对比 Qwen3.8-Max

前代Qwen3.8-Max2.4T · 1M ctx
当前Qwen3.8-Flash-Next176B · 262K ctx
新增能力 可调推理强度
04

架构与能力

注意力机制

Gated DeltaNetQwen Sparse Attention

主要能力

可调推理强度编码Agent长上下文
05

发布历史

开放权重

Qwen3.8-Flash-Next 权重开放,并以 Qwen3.8-Flash 提供托管服务。

查看原文
06

相关模型

点击卡片查看相关模型。

07

来源