AI 課本 › 💎 Gemini

用 Gemini 3.8 text-to-speech 打造你自己的聲音

2026/09/23 · 1 分鐘 · 官方字幕實證
宣傳短片:示範用 Text to Speech 生成、調整、儲存並指揮多個聲音
💡 你可以怎麼用:下次要幫簡報、短影音或教學影片配旁白時,可以先挑一個接近的現成聲音,再用口語要求調整(低一點、慢一點),滿意就存起來重複用。有對話的內容就分配不同聲音,各自交代語氣。
看全部 12 條重點

🧑‍🏫 這是 Google DeepMind 的宣傳短片,用「主角要替新的語音模型做一支宣傳片」當故事,一路示範怎麼用文字生出聲音、調整語氣、存下喜歡的聲音,再讓好幾個聲音一起演一場戲。值得看的地方是它把整個流程走一遍,你能很快知道這類工具現在做得到哪些事。

📘 術語
Text to Speech(文字轉語音):把簡單的 prompt 轉成一致、富表現力的語音輸出
voiceover(旁白):主角做宣傳影片時第一個要做的東西,字幕未另外解釋
prompt(提示詞):字幕只說簡單的 prompt 可轉成語音輸出,未另外解釋
saved voices(已儲存的聲音):你喜歡的聲音存起來後,可以挑選並放進場景使用
multi-speaker scene(多說話者場景):有多個聲音的場景,可以在其中指揮這些聲音
verbal identity check(口頭身分驗證):重現自己聲音時用來安全保護的快速口頭驗證
✏️ 小考一題

依字幕,重現(recreate)自己的聲音時,是用什麼方式來安全保護?

A. 快速的口頭身分驗證(verbal identity check)B. 輸入一組密碼C. 臉部辨識掃描D. 上傳身分證件照片
看答案
答案:A。字幕 [00:30] 說「recreate your own voice, safely protected by a quick verbal identity check」,其他三種方式字幕都沒有提到。
📺 看原片📚 在課本 App 讀
💛 覺得有幫助?支持一下台灣Pay 銀行轉帳 QRPayPal QR
課本免費、沒有廣告,支持與否都能照常讀 🐰

重點整理自 YouTube 影片字幕,每條附時間碼可跳回原片;🧑‍🏫/↳ 是 Claude 補充的白話,不是影片原話。