基于 V3.1-Terminus 的实验版本,引入 DeepSeek Sparse Attention 以提高长上下文效率。
仅展示已有公开资料的规格。
DeepSeek-V3.2-Exp 开放权重。
点击卡片查看相关模型。