Google Gemini 2.5 Pro 文字轉語音

以 Google Gemini 2.5 Pro TTS 將文字合成自然人聲,可選 30 種聲音與朗讀語言。

Google Gemini 2.5 Pro 文字轉語音使用 Google 最高品質的語音合成模型,把輸入的文字朗讀成清晰自然、富有語調的人聲音檔。上方下拉選單可選擇 30 種預建聲音,各有明亮、堅定、溫暖、知性等不同風格;另一個下拉選單可指定朗讀語言,預設為自動偵測,支援中文、英文、日文、韓文、法文、德文、西班牙文等多國語言。除了直接輸入要朗讀的文字,也可以用自然語言描述語氣,例如在文字前加上「用興奮的語氣說:」或「輕聲耳語:」,模型會依描述調整情緒、語速與口吻。長篇內容建議分段送出,數分鐘以上的連續朗讀品質可能下降。適合製作有聲書、教學旁白、Podcast 開場、產品介紹與無障礙閱讀語音。輸入上限 8,192 tokens,輸出格式為 MP3。 輸入加輸出 token 上限:約 24,576 tokens。 單次請求輸入 token 上限(含對話歷史):8,192 tokens。 輸出 token 上限:約 16,384 tokens(如有推理/思考過程,一併計入此上限)。 輸出內容格式:聲音 音訊輸出格式:MP3。 不支援連續對話。 AI可能會出錯,請核實重要資訊。