概览
SpaceXAI 面向批处理与实时流式语音识别的转写模型,强化多语言、说话人分离、时间戳和嘈杂真实场景准确性。
SpaceXAI 面向批处理与实时流式语音识别的转写模型,强化多语言、说话人分离、时间戳和嘈杂真实场景准确性。
Grok Voice Transcribe 2.0 已在 Speech-to-Text API 提供并成为默认型号;1.0 仍可用但将于未来数周弃用。
仅展示已有公开资料的规格。
SpaceXAI 面向批处理与实时流式语音识别的转写模型,强化多语言、说话人分离、时间戳和嘈杂真实场景准确性。
它把 Grok Voice 的音频基础模型能力扩展为独立转写 API,并在不改变现有接口的情况下替换首代转写型号。
SpaceXAI 在 9 月 17 日将 Grok Voice Transcribe 2.0 上线 Speech-to-Text API,并宣布它将成为默认转写型号;Grok Voice Transcribe 1.0 进入弃用过渡。发布文章日期为 9 月 18 日。
查看原文点击卡片查看相关模型。
复制下方模板,补上字段、建议值和一手来源后发给资料维护者。