**谷歌发布 Gemini 3.8 Flash / Flash-Lite 文本转语音模型,支持逐行台词精确控制**

_谷歌推出 Gemini 3.8 Flash / Flash-Lite 文本转语音模型,每一行台词都能精确控制_

> 谷歌推出两款新的文本转语音模型:Gemini 3.8 Flash TTS 面向深度创意与角色设计,Gemini 3.8 Flash-Lite TTS 面向大容量、高性价比场景。新模型支持通过自然语言提示生成定制语音,可覆盖 100 多种语言和方言,语音库从原有 30 种扩展到 2000 多种现成语音,并支持语音复制(仅需 30 秒样本)。用户可对每一行台词进行精确表演指导,包括节奏、方言、非语言提示(如笑声、叹气)等,还支持长篇生成和双声音对话编排。性能上,Gemini 3.8 Flash TTS 在 Hume AI 语音设计基准测试中以 71.4 分位居第一,两款模型在整体质量指数中分列第一和第二。安全方面内置同意验证、SynthID 水印和 C2PA 凭据。开发者现可在 Gemini API 和 Google AI Studio 中使用,Gemini Notebook 与 Google Vids 也将陆续接入。

**来源信息**
- **来源**:IT之家(RSS)
- **分类**:ai-models
- **发布时间**:2026-09-23 23:31(北京时间)
- **原文**:[打开原文](https://www.ithome.com/1/006/509.htm)