MarkTechPost12 小时前模型新模型发布海外Google 发布两款 Gemini Audio 系列语音模型:Gemini 3.8 Flash TTS 面向创意配音与角色设计,Flash-Lite TTS 面向高并发低成本生产,均通过 Gemini API 和 AI Studio 提供,仅 API 调用、不开源权重。新模型支持用自然语言逐句指导语气、节奏、方言,可从文本提示生成新音色,覆盖 100 多种语言和方言,并提供 2000+ 现成音色库。语音复刻需 30 秒样本和声音所有者口头同意录音,所有输出带 SynthID 水印。
推荐理由做配音、有声书或语音 Agent 的团队可直接换用,2000+ 音色库和逐句语气控制省去自建 TTS 的调参成本。
Ars Technica AI13 小时前模型产品发布/更新海外在年度 Made on YouTube 活动上,YouTube 宣布将推出 Custom Feeds 自定义信息流:用户输入描述即可生成新标签页,可细化描述并给推荐视频打分来调优,支持保存多个信息流,将先在美国上线网页、移动端和电视端。评论功能将支持发 GIF,可在普通视频和 Shorts 中使用;私信功能加入群聊,首批仅限美国、英国、新加坡、巴西和部分欧洲国家。活动还预告了面向观众和创作者的更多 AI 功能,但未给出具体细节。
推荐理由做内容分发或 YouTube 运营的可以提前规划自定义信息流带来的流量入口变化
Google DeepMind17 小时前模型行业动态海外Google DeepMind 公布 Private AI Compute 架构更新,将在云端引入持久化记忆层,让 AI 助手跨设备保留上下文。数据存放在专用加密存储中,解密密钥仅保存在用户设备上,Google 也无法访问。请求时设备通过端到端加密通道连接云端安全隔区,在隔离内存中临时解密、处理并立即重新加密。此前该平台及业界同类方案均为无状态,任务结束即清除上下文,无法支撑连续的个人 AI 体验。
推荐理由云端 AI 记忆与端侧隐私如何兼得,这是目前最具体的架构方案,做 AI 助手和隐私合规的人可直接参考