模型索引
阿里云·Qwen

Qwen3.8-LiveTranslate Flash Realtime

Qwen3.8 系列的实时音视频同传型号,采用 Hybrid-MoE Thinker–Talker 架构,强化多说话人分离、双语同步和上下文消歧。

当前版本语言多模态未开放权重

QwenCloud 已提供 `qwen3.8-livetranslate-flash-realtime`,通过 WebSocket Realtime API 调用;支持音频/图像输入、文本/音频输出、60 个源语言和 29 个语音输出语言。

模型编号099
首次公开日期
2026-09-17
组织
Alibaba Cloud
家族
Qwen
01

规格概览

仅展示已有公开资料的规格。

架构
Hybrid
输入模态
音频 · 图像
输出模态
文本 · 音频
开放权重
状态
当前版本
02

概览

概览

Qwen3.8 系列的实时音视频同传型号,采用 Hybrid-MoE Thinker–Talker 架构,强化多说话人分离、双语同步和上下文消歧。

为什么重要

它把 Qwen3.8 从通用全模态与 Agent 工作流扩展到低延迟语音翻译,形成独立的实时音频服务分支。

03

架构与能力

注意力机制

Hybrid-MoEThinker–TalkerInterleave

模型能力

实时音频原生音频说话人分离多语言长上下文
04

发布历史

API 上线

QwenCloud 发布 qwen3.8-livetranslate-flash-realtime:支持音频/图像输入、文本/音频输出、60 个源语言和 29 个语音输出语言,并通过 WebSocket Realtime API 提供。

查看原文
05

相关模型

点击卡片查看相关模型。

06

来源

建议修正这条记录

复制下方模板,补上字段、建议值和一手来源后发给资料维护者。