
Google於2026年9月正式發布兩款全新文本轉語音(TTS)模型:Gemini 3.8 Flash TTS與Gemini 3.8 Flash-Lite TTS。兩款模型將語音生成從靜態預設升級為動態創作工具,開發者可透過自然語言描述從零設計聲音,逐行控制台詞演繹,並在單次生成中完成雙人對話場景編排。
兩款模型的分工與定位
Google此次將TTS產品線拆分為兩個層級,取代此前單一的Gemini 3.1 Flash TTS Preview模型。Gemini 3.8 Flash TTS定位為「工作室級」語音模型,面向深度創意方向與角色設計,適用於遊戲、沉浸式有聲書
[閱讀全文: Gemini 3.8 Flash TTS:從「揀聲音」到「設計聲音」的語音生成革命]
Flash TTS, Gemini 3.8, 美國, 設計聲音, 音頻輸出費率
留言
張貼留言