Google 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS
Google 发布两款 Gemini Audio 系列语音模型:Gemini 3.8 Flash TTS 面向创意配音与角色设计,Flash-Lite TTS 面向高并发低成本生产,均通过 Gemini API 和 AI Studio 提供,仅 API 调用、不开源权重。新模型支持用自然语言逐句指导语气、节奏、方言,可从文本提示生成新音色,覆盖 100 多种语言和方言,并提供 2000+ 现成音色库。语音复刻需 30 秒样本和声音所有者口头同意录音,所有输出带 SynthID 水印。
推荐理由做配音、有声书或语音 Agent 的团队可直接换用,2000+ 音色库和逐句语气控制省去自建 TTS 的调参成本。