模型索引
阶跃星辰·StepAudio

Step-Audio 2

端到端音频理解与语音对话模型组,覆盖音频语义、韵律信息、工具调用和多模态检索。

当前版本语言推理多模态开放权重系列发布
模型编号343
首次公开日期
2025-07-23
组织
StepFun
家族
StepAudio
01

规格概览

仅展示已有公开资料的规格。

本条代表多个型号。组内模态与能力是覆盖范围,具体支持情况和许可以各型号为准。

输入模态
文本 · 音频
输出模态
文本 · 音频
开放权重
许可证
Apache-2.0
状态
当前版本
Step-Audio 2 mini · Apache-2.0 · 输入: 文本/音频 · 输出: 文本/音频Step-Audio 2 mini Base · Apache-2.0 · 输入: 文本/音频 · 输出: 文本/音频Step-Audio 2 mini Think · Apache-2.0 · 输入: 文本/音频 · 输出: 文本/音频
02

概览

概览

端到端音频理解与语音对话模型组,覆盖音频语义、韵律信息、工具调用和多模态检索。

为什么重要

Step-Audio 2 将阶跃星辰的语音模型从产品能力推进到可复现的开放权重与推理代码。

03

架构与能力

模型能力

原生音频推理工具调用
04

发布历史

公布

Step-Audio 2 技术报告与音频模型路线公开。

查看原文
开放权重

Step-Audio 2 mini 与 mini Base 开放权重。

查看原文
重大更新

Step-Audio 2 mini Think 发布。

查看原文
05

相关模型

点击卡片查看相关模型。

暂未收录关联模型

06

来源

建议修正这条记录

复制下方模板,补上字段、建议值和一手来源后发给资料维护者。