每天听简报,了解最新科技、AI、软件资讯
谷歌把语音生成模型从固定音色升级成了可以逐句导演的声音工作室,新出的Gemini三点八Flash TTS支持从零设计一个全新角色的声音,也可以只用一段三十秒录音复刻一个人的声线,但要核实对方本人授权。语音库从三十种预设扩展到两千多种,覆盖一百多种语言,还能在同一段脚本里安排两个说话人自然对话。在Hume AI的语音设计评测里,它拿到综合第一,得分七十一点四。评论区有人说,生成结果常常和描述对不上,配音演员暂时还不用担心失业;还有人吐槽这次上线有点仓促,试用时直接报错,页面上连定价都没写清楚。
进度保存在本设备 · 登录同步