AI Radar
清除条件
2
MarkTechPost11 小时前模型新模型发布海外

Google 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS

Google 发布两款 Gemini Audio 系列语音模型:Gemini 3.8 Flash TTS 面向创意配音与角色设计,Flash-Lite TTS 面向高并发低成本生产,均通过 Gemini API 和 AI Studio 提供,仅 API 调用、不开源权重。新模型支持用自然语言逐句指导语气、节奏、方言,可从文本提示生成新音色,覆盖 100 多种语言和方言,并提供 2000+ 现成音色库。语音复刻需 30 秒样本和声音所有者口头同意录音,所有输出带 SynthID 水印。

推荐理由做配音、有声书或语音 Agent 的团队可直接换用,2000+ 音色库和逐句语气控制省去自建 TTS 的调参成本。

The Decoder14 小时前资讯新模型发布海外

Google 发布 Gemini 3.8 Flash TTS,可用文字描述定制音色

Google 推出 Gemini 3.8 Flash TTS 和 Flash-Lite TTS 两款语音生成模型。Flash TTS 支持用文字提示定义音色的角色、口音和声线特征,内置 2000 多种预设音色(含墨西哥西班牙语、魁北克法语、苏格兰英语等地区变体),支持 100 多种语言;用 30 秒音频样本即可克隆音色,但需被克隆者录制同意声明。两款模型均支持逐句舞台指示、双人对话模式,可生成数小时音频且说话人漂移极小。Flash-Lite 面向配音、音频内容和语音 Agent 的低成本规模化场景。所有生成音频带 …

推荐理由做语音 Agent 或配音的可以看:2000+ 预设音色、30 秒克隆、100+ 语言,还有实测暴露的杂音问题