谷歌Gemini 3.8 TTS:30秒样本就能复刻声音
律动BlockBeats|2026年09月24日 00:56
谷歌发布 Gemini 3.8 Flash TTS 和 Flash-Lite TTS,两款文本转语音模型已在 Gemini API 和 Google AI Studio 开放。Flash 主打音质、角色表演和长文本稳定性,Lite 偏向高吞吐、低延迟和低成本。两款模型都能直接用文字设计新声线,也能用约 30 秒参考音频复刻本人或已获授权的声音。用户可以逐句控制情绪、节奏和口音,还能插入笑声、叹气、咳嗽等声音。双人对话也可以直接用一份剧本生成。Flash 支持 130 种语言,Lite 支持 101 种。价格也比上一代低。到 2026 年 12 月 31 日,Flash 音频输出每百万 tokens 为 9 美元,Lite 为 6 美元;上一代 Gemini 3.1 Flash TTS Preview 为 20 美元。2027 年 1 月 1 日起,两款标准价会升至 18 美元和 12 美元。[原文链接](动察 Beating AI 快)
分享至:
脉络
热门快讯
APP下载
X
Telegram
复制链接