模型索引
Google DeepMind·Gemini

Gemini 3.8 Flash TTS

Gemini 3.8 系列的旗舰创意文字转语音模型,强调录音室级声音保真度、细致表演、区域口音和长篇多轮稳定性。

当前版本语言多模态未开放权重

Google 于 2026-09-22 宣布 Gemini 3.8 Flash TTS 在 Gemini API 正式 GA;模型 ID 为 `gemini-3.8-flash-tts`,面向高保真创意 TTS,并支持 Voices、Voice Design 与 Voice Replication。

模型编号086
首次公开日期
2026-09-22
组织
Google DeepMind
家族
Gemini
01

规格概览

仅展示已有公开资料的规格。

上下文
8,192 tokens↗
最大输出
16,384 tokens↗
输入模态
文本↗
输出模态
音频↗
开放权重
否
状态
当前版本↗
02

概览

概览

Gemini 3.8 系列的旗舰创意文字转语音模型,强调录音室级声音保真度、细致表演、区域口音和长篇多轮稳定性。

为什么重要

它把 Gemini 3.8 的音频产品线从实时对话扩展到可控的高质量语音生成。

03

架构与能力

模型能力

音频生成音色克隆多语言
04

发布历史

正式发布

Gemini 3.8 Flash TTS 在 Gemini API 正式 GA,面向高保真创意文字转语音,并同步提供 Voices、Voice Design 与 Voice Replication。

查看原文
05

相关模型

点击卡片查看相关模型。

06

来源

建议修正这条记录

复制下方模板,补上字段、建议值和一手来源后发给资料维护者。