模型索引
阿里云·Qwen

Qwen3.8-Omni-Flash-Realtime

Qwen3.8-Omni-Flash 的实时交互型号,支持摄像头与麦克风场景、文本/音频输出和多通道音频。

当前版本语言Agent多模态未开放权重

QwenCloud 于 2026-09-21 发布 `qwen3.8-omni-flash-realtime`,通过 WebSocket、WebRTC 与 AOQ 提供实时音视频交互;官方文档还列出文本/音频输出、工具调用和最高 196,608 输入 token。

模型编号103
首次公开日期
2026-09-21
组织
Alibaba Cloud
家族
Qwen
01

规格概览

仅展示已有公开资料的规格。

上下文
196,608 tokens
输入模态
文本 · 图像 · 音频 · 视频
输出模态
文本 · 音频
开放权重
状态
当前版本
02

概览

概览

Qwen3.8-Omni-Flash 的实时交互型号,支持摄像头与麦克风场景、文本/音频输出和多通道音频。

为什么重要

它把 Qwen3.8 的全模态能力从文件理解扩展到实时音视频对话和 MCP 工具工作流。

03

架构与能力

模型能力

原生多模态原生音频实时音频实时视频工具调用音色克隆

配套工具

网页搜索MCP 工具
04

发布历史

API 上线

QwenCloud 发布 qwen3.8-omni-flash-realtime,提供实时音视频交互、文本/音频输出、多通道音频、视频聚合和远程 MCP 工具,并支持 WebSocket、WebRTC 与 AOQ。

查看原文
05

相关模型

点击卡片查看相关模型。

06

来源

建议修正这条记录

复制下方模板,补上字段、建议值和一手来源后发给资料维护者。