概览
面向高速推理、编码与 Agent 工作流的稀疏 MoE 模型,196B 总参数、每 token 激活 11B,并支持 256K 上下文。
仅展示已有公开资料的规格。
面向高速推理、编码与 Agent 工作流的稀疏 MoE 模型,196B 总参数、每 token 激活 11B,并支持 256K 上下文。
Step 3.5 Flash 把高效激活、滑窗注意力和多 token 预测组合成面向真实 Agent 任务的开放模型路线。
Step 3.5 Flash 发布并开放权重。
查看原文点击卡片查看相关模型。
复制下方模板,补上字段、建议值和一手来源后发给资料维护者。