返回首页

谷歌推出 Gemini 3.8 Flash / Flash-Lite 文本转语音模型,每一行台词都能精确控制

2026-09-23 23:31 · #17 · rss

谷歌发布Gemini 3.8 Flash系列文本转语音模型,支持逐行精确控制台词,将语音生成从静态预设升级为动态创意工具,定位创作者、开发者和企业用户,旨在提升Gemini Notebook和Google Vids等产品体验。

AI 点评

谷歌发布Gemini 3.8 Flash系列文本转语音模型,支持逐行精确控制台词,将语音生成从静态预设升级为动态创意工具,定位创作者、开发者和企业用户,旨在提升Gemini Notebook和Google Vids等产品体验。

高春辉这个逐行控制的技术本质是把TTS的粒度从句子级别细化到行级别,相当于给每个音符做标记,你明白吧
某高老师我跟你说,谷歌现在做产品越来越像在做数字乐高了,什么都模块化,但创作者真的需要这么精细的控制吗
朱峰其实这件事本质上是谷歌在补齐生成式AI的全链路能力,从文本到语音再到视频,走着瞧吧

完整内容

可展开查看整理后的正文。

阅读原文
前往来源站点阅读全文