模型索引
阿里云·Qwen

Qwen2.5-Omni-7B

使用 Thinker-Talker 架构理解文本、图像、音频和视频,并流式生成文本与语音。

历史版本语言多模态开放权重
模型编号302
首次公开日期
2025-03-27
组织
Alibaba Cloud
家族
Qwen
01

规格概览

仅展示已有公开资料的规格。

输入模态
文本 · 图像 · 音频 · 视频
输出模态
文本 · 音频
开放权重
许可证
Apache-2.0
状态
历史版本
02

概览

概览

使用 Thinker-Talker 架构理解文本、图像、音频和视频,并流式生成文本与语音。

03

架构与能力

模型能力

原生多模态实时音频
04

发布历史

开放权重

Qwen2.5-Omni-7B 开放权重。

查看原文
05

相关模型

点击卡片查看相关模型。

06

来源

建议修正这条记录

复制下方模板,补上字段、建议值和一手来源后发给资料维护者。