模型索引
Meta·Muse

Muse Voice Transcribe

Muse 家族的实时音频感知模型,支持流式语音识别、说话人分离、端点检测和多语言混合输入。

当前版本语言未开放权重
模型编号108
发布日期
2026-09-01
组织
Meta
家族
Muse
01

规格概览

仅展示已有公开资料的规格。

输入模态
音频
输出模态
文本
开放权重
状态
当前版本
02

概览

概览

Muse 家族的实时音频感知模型,支持流式语音识别、说话人分离、端点检测和多语言混合输入。

为什么重要

它把 Muse 的能力从多模态推理扩展到实时语音输入,支持超过一小时音频和 20 多位说话人。

03

架构与能力

主要能力

audio transcriptiondiarizationendpointing多语言长上下文
04

发布历史

API 上线

Muse Voice Transcribe 发布并在 Meta Model API、Meta AI for Mac 与 Muse Code 提供。

查看原文
05

相关模型

点击卡片查看相关模型。

暂未收录关联模型

06

来源