Gemini 教學:2026 年如何使用 Google AI 生態系


🏦 台灣Pay 銀行轉帳 💙 PayPal
用模型、surfaces、glue、agents 四層地圖講解 Gemini 生態系怎麼用
- 00:00 Gemini 不是單一 app,而是一個模型家族,內建在 Search、Chrome、Workspace、Android、YouTube、Maps、Photos、Notebook LM 等產品裡。
- 09:27 Search、Chrome、Docs、Sheets、Meet、Android、YouTube、Maps、Photos 加起來是同一個模型家族,而且大多數不需額外付費。
- 18:21 總結:模型替你思考,surfaces 讓它出現在你工作的地方,glue 讓它記得你,agents 讓它在你不在時行動;多數人停在 Level 1。
💡 你可以怎麼用:先用免費版,在你本來就在用的 Docs、Chrome、搜尋裡試著叫 Gemini 幫忙。想進一步,就建一個 gem 並連上一份你常更新的 Google 文件;Personal Intelligence 和 Spark 目前以美國為主,等台灣開放再說。
看全部 58 條重點
🧑🏫 這支影片把 Google 的 Gemini 拆成四層來講:模型、它出現的產品、跨產品的記憶、會自己動手做事的代理。值得看的原因是,你平常用的 Search、Chrome、Docs 裡大多已經有 Gemini,而且多數免費,看完會知道哪些現在就能用、哪些先不用追。中間有幾段是業配,下面會標出來。
- 00:00 Gemini 不是單一 app,而是一個模型家族,內建在 Search、Chrome、Workspace、Android、YouTube、Maps、Photos、Notebook LM 等產品裡。↳ 別把 Gemini 想成一個聊天 app。它是一組 AI 模型,被裝進你本來就在用的 Google 產品裡,所以你可能早就在用了。
- 00:32 四層地圖:Level 1 模型(負責思考的引擎)、Level 2 surfaces(模型接入的產品)、Level 3 glue(跟著你跨產品的記憶)、Level 4 agents(從回答變成行動)。↳ 整支影片的骨架是四層:會思考的模型、模型出現的產品(surfaces)、記得你的記憶(glue)、替你動手做事的代理(agents)。後面照這個順序講。
- 01:04 Gemini app 的 model picker 有三個選項。Flash 是預設,適合日常:email、快速改寫、腦力激盪清單,幾秒內給答案。↳ model picker 是 Gemini app 裡選模型的選單。Flash 是預設的快速款,寫信、改句子、列點子這類小事用它就好,不必多想。
- 01:36 Thinking 用在需要真正解決問題時,例如比較一次性定價與月訂閱哪個賺更多,它會先推理取捨再回答,而不是用猜的。↳ Thinking 會先花時間推理再回答。遇到要權衡利弊的問題,像定價該一次收還是月收,選它比較不會得到隨口猜的答案。
- 01:36 Pro 是 Google 給最重任務的標籤:進階數學與程式。範例:貼上課程大綱,請它找出結構最弱的三點並說明原因。↳ Pro 是最強的一款,留給最吃力的工作,像數學、寫程式,或請它挑出一份大綱的結構弱點並講出理由。
- 02:06 Google 還有一個更便宜更快的 tier 和一個獨立的 research mode,但不在 app 的 picker 裡,而是在 AI studio。↳ app 裡看到的三個選項不是全部。還有一個更省更快的等級(tier,就是分級)和一個專門做研究的模式,放在另一個地方。
- 02:06 AI studio 是 Gemini 的免費 lab 版本,多出兩個工具。↳ AI studio 是 Google 給人試玩模型的免費實驗場,功能比一般 app 多,上面說的那兩個工具就在這裡。
- 02:36 flashlight(字幕原文)是 Google 最便宜、最快的 tier,適合重複執行的批次工作:圖說、標籤、快速標註,例如幫十張產品照各寫一行圖說。↳ 字幕寫 flashlight,很可能是 Flash-Lite 的聽寫誤差。它是最便宜最快的一款,適合量大又單調的工作,像一次幫十張照片寫圖說。
- 02:36 deep research:輸入主題後會瀏覽數十個來源,幾分鐘後交出附引用的完整報告(不是摘要),每個論點都連回出處。↳ deep research 是讓 AI 自己上網查幾十個來源,花幾分鐘寫成完整報告。每個說法都附出處,你可以點回去檢查真假。
- 03:09 這兩個工具放在 AI studio,是因為不適合 app 的簡單 picker:flashlight 處理枯燥的事,deep research 處理需要查證的事。↳ 一般人在 app 裡只需要簡單選擇,所以這兩個比較特定用途的工具被放到 AI studio:一個做無聊的量產,一個做要查證的研究。
- 03:09 (業配段落)示範用一款 AI catalog generator 把機械鍵盤的雜亂 PDF 做成多頁型錄,可換模板、放產品照、用 AI copy tool 修文案,匯出印刷用 PDF 與網頁版。↳ 這段是業配,跟 Gemini 無關。內容是示範某款工具把雜亂的產品 PDF 做成可印刷、可上網的型錄,知道是廣告就好。
- 04:47 AI mode 回傳的不是一大段文字,而是可互動的表格(電池續航、ANC 評分、價格、舒適度並排,可點欄位展開),這就是 generative UI。↳ generative UI 是 AI 當場幫你生出可操作的畫面。比方比較耳機,它會排成表格讓你點開看(ANC 是主動降噪),不是丟一大段字。
- 05:18 Chrome 的 Gemini side panel 於一月推出,可在任何分頁旁開啟,摘要、比較內容,並直接從你所在頁面找答案(示範為 40 頁 PDF 規格表)。↳ side panel 是 Chrome 旁邊可以叫出來的 Gemini 側欄。看很長的網頁或 PDF 時,直接問它,不用自己從頭讀到尾。
- 05:49 side panel 只是被動版本;同月 Chrome 還推出 auto-browse,Gemini 可自行跨分頁導覽與點擊。↳ 側欄只會回答你問的。auto-browse 更進一步,Gemini 會自己切分頁、自己點按鈕,等於替你操作瀏覽器。
- 05:49 Docs、Sheets、Meet 現在統稱 Workspace Intelligence,四月在 Cloud Next 發表。↳ Workspace Intelligence 只是一個總稱,指 Docs、Sheets、Meet 這些辦公工具裡的 Gemini 功能,在 Google 四月的 Cloud Next 活動上發表。
- 05:49 在 Docs 點 Help Me Create 並輸入需求(例如寫給幫忙澆花鄰居的感謝函),得到的是完整初稿,不是填空模板。↳ Help Me Create 是 Docs 裡的按鈕。你講清楚要寫什麼,它就給一篇可以直接改的完整草稿,不是留空格讓你自己填。
- 06:22 DocsLive 是語音模式:你把想法說出來,Gemini 邊聽邊把內容整理成有結構的文件。↳ DocsLive 是用講的寫文件。你把想法隨口講出來,它一邊聽一邊排成有標題、有段落的文件,適合不想打字的時候。
- 06:22 在 Sheets 選取資料範圍並要求追蹤每月訂閱花費與總額,得到的不只是圖表,而是試算表內可運作的 mini-app。↳ 在 Sheets 圈起資料、說出需求,它會做出一個能實際操作的小工具,像訂閱花費追蹤器。不只是畫一張圖。
- 06:22 在 Meet 通話開始時點 Take Notes for Me,通話一結束就得到含待辦事項的摘要;此功能僅限 Pro 與 ultra。↳ 開會時按 Take Notes for Me,結束後自動拿到會議摘要和待辦清單。不過這是付費功能,要 Pro 或 Ultra 方案才有。
- 06:54 Meet 也有跑在 3.5 Flash 上的 Live Translate,可即時語音翻譯超過 70 種語言。↳ Live Translate 是 Meet 裡的即時口譯。對方講外語,你當下就聽得到翻譯,支援七十多種語言。
- 06:54 Vids 是 Workspace 裡的影片 app:打開已寫好提案的 Google Doc 點 Help Me Create,它會讀文件並建立完整分鏡(場景、素材影片、配樂)。↳ Vids 是 Google 的做影片工具。它可以讀你寫好的提案文件,自動排出一場一場的畫面、素材和配樂,不用從空白開始。
- 07:27 Vids 可把場景變成念指定腳本的 talking avatar,avatar 來自你的自拍與一段短錄音;每段影片都帶可見浮水印,避免被誤認為真實影像。↳ 它還能用你的自拍和一小段錄音,做出一個會念稿的虛擬分身(talking avatar)。影片上會有明顯浮水印,讓人知道這是 AI 做的。
- 07:27 以上都不必離開 Docs、Sheets 或 Meet,這就是 surface 的重點:模型來找你。↳ surface 的重點是你不用另外開 Gemini。你在哪個產品工作,AI 就在那裡,不必複製貼上、跳來跳去。
- 07:57 Notebook LM(字幕此處寫作 Notebook LL):把一個專案的合約、brief、客戶 email 全丟進去,再問只有你的文件能回答的問題,例如已同意的付款條件。↳ Notebook LM 是只讀你給的資料來回答的工具。把一個案子的合約、信件全放進去,就能問「當初談好的付款條件是什麼」。
- 07:57 它不會用猜的,每個答案都指回確切的文件與行數;專案載入一次就記住所有細節,適合同時處理五個客戶的接案者。↳ 它的答案會標出來自哪份文件的哪一行,所以不會亂編。同時接好幾個客戶的人,不用再靠記憶翻舊信。
- 08:27 在 Android 上,Gemini 實質上已取代 Google Assistant,長按 Home 鍵開啟的是 Gemini。↳ Android 手機上以前的 Google 助理,現在基本上換成 Gemini 了。長按 Home 鍵叫出來的就是它。
- 08:27 Gemini for Home 現在跑在約 8 億台連網裝置上;六月 Google 推出 Gemini Go,是為平價手機打造的輕量版。↳ 家裡的智慧音箱、螢幕等連網裝置也換上 Gemini。另外有給平價手機用的輕量版 Gemini Go,規格不高的手機也跑得動。
- 08:27 Ask YouTube:在影片上點 Ask 提問,會直接從影片內容找答案,不只看說明欄;目前僅限 premium、18 歲以上、美國,仍在擴大。↳ Ask YouTube 是直接對影片發問,它會從影片實際講的內容找答案。目前只有美國、成年的付費會員能用,台灣還要等。
- 08:57 Ask Maps:在 Maps 輸入完整句子而非地名(例如附近安靜、咖啡好、適合工作的地方),是對話式搜尋而非精確名稱查找。↳ 在地圖上可以用一整句話描述你要的地方,像「附近安靜、咖啡好喝、能工作的店」,不必先知道店名。
- 08:57 Photos 也有同樣的對話式搜尋,例如「給我看那次去山裡健行的旅行照片」。↳ 相簿也一樣,用描述的就能找照片,像「上次去山上健行那趟」,不用自己滑半天或記日期。
- 09:27 Search、Chrome、Docs、Sheets、Meet、Android、YouTube、Maps、Photos 加起來是同一個模型家族,而且大多數不需額外付費。↳ 這些產品背後是同一組模型,而且大部分功能不用多付錢。也就是說,你不必訂閱就能用到很多。
- 09:27 (業配段落)講者說影片的研究、查核與模型測試都在自家平台 AI Master 內完成,可把同一個 prompt 同時跑三個模型並排比較。↳ 這段是業配。講者說這支影片的資料整理都在他自家平台 AI Master 上做,可以把同一個問題同時丟給三個模型比較。
- 10:30 (業配段落)AI Master 稱每 token 比直接使用便宜,圖像、語音、影片生成在同一視窗;角色建一次即保持一致,並可發布與變現。↳ 仍是業配。prompt 是你下給 AI 的指令,token 是 AI 計費用的文字單位。這些都是該平台自己的說法,影片沒有佐證。
- 11:00 (業配段落)AI Master 內有 academy 與超過 12,000 名付費使用者的社群;年度方案目前有折扣,附七天退款保證,設定不到三分鐘。↳ 還是業配,講該平台的課程、社群人數和折扣。這些是賣方的宣傳,跟學 Gemini 沒關係,可以跳過。
- 12:01 Level 3:Google 稱為 personal intelligence,一月中以美國 beta 起步,預設關閉,需自行 opt in。↳ 第三層是 personal intelligence,讓 Gemini 認識你個人的資料。目前在美國測試,預設關閉,要你自己同意(opt in)才會開。
- 12:01 可分別開啟 Gmail、Photos、YouTube、Search、Calendar、Drive 的開關,每個開關讓 Gemini 讀取該產品,以實際脈絡回答而不是猜。↳ 你可以一個一個決定讓它讀哪些:信箱、相簿、行事曆、雲端硬碟等。開了哪個,它就能根據你那裡的真實內容回答。
- 12:01 差別示範:沒開時要它回覆供應商最後一封信,Gemini 不知道是哪個討論串;連上 Gmail 後同一個 prompt 會抓到實際討論串並配合對話語氣。↳ 沒連信箱時,叫它「回供應商上一封信」它根本不知道是哪封。連了之後它會找到那串信,還照你們平常的口氣寫。
- 12:31 glue 的第二部分是 gem:有自己指令與知識庫的 Gemini 設定版本,五分鐘可設好。點 new gem,在 custom instructions 寫角色(例:品牌語氣編輯)。↳ gem 是你自己設定好的專用 Gemini。先寫好它的角色和規矩,像「品牌語氣編輯」,之後每次用都不必重講,幾分鐘就能建好。
- 13:04 知識來源改用連結一份 live Google doc 而非上傳檔案:之後隨時更新該文件,gem 的知識會自動更新,不必重新上傳或重寫 prompt。↳ 給 gem 參考資料時,用連結一份 Google 文件,不要上傳檔案。這樣你改了文件,gem 知道的內容就跟著更新。
- 13:04 Google 也有 super gems,在同樣設定上加入可點擊的按鈕與表單,更接近輕量 app 而非聊天。↳ super gems 是進階版的 gem,多了按鈕和表單可以點。用起來像一個小工具,不是只能打字聊天。
- 13:37 Level 4:Chrome 的行動版示範,要它在 Google Flights 找符合日期的最便宜航班並填好搜尋;過程中的暫停是 checkpoint。↳ 第四層是 AI 動手做事。示範是叫 Chrome 去 Google Flights 找最便宜的機票並填好搜尋,中途它會停下來等你確認,這叫 checkpoint。
- 14:07 Spark 把 3.5 Flash 搭配字幕所稱的 anti-gravity hardware,跑在專用雲端機器上,所以你闔上筆電後仍持續工作。↳ Spark 是在 Google 雲端機器上跑的代理,所以你電腦關了它還在做事。字幕說的 anti-gravity hardware 影片沒解釋,不確定指什麼。
- 14:07 Spark 原生可存取 Gmail、Docs、Sheets、Slides。↳ Spark 能直接讀寫你的 Gmail、文件、試算表和簡報,不用你先把資料搬給它。
- 14:38 交辦方式是寄 email 給它:主旨寫任務、內文寫要求(例:抓本週報告數字並起草團隊更新),它會讀報告、抓數字、寫好草稿。↳ 交代工作的方式是寄信給它:主旨寫任務、內文寫要求。像請它抓這週報告的數字、寫一封給團隊的更新,它會把草稿寫好。
- 14:38 Spark 透過 MCP(共用連線標準)連接第三方工具。↳ MCP 是一套讓 AI 連接外部工具的共通規格。有了它,Spark 也能接 Google 以外的服務。
- 14:38 Spark 開放範圍很窄:先給 trusted testers,再給美國的 AI ultra 訂閱者,僅限英文;不在範圍內先不用追。↳ Spark 現在只給少數測試者和美國最貴方案(AI Ultra)的訂戶,而且只支援英文。在台灣目前用不到,不必急。
- 15:11 Google 表示國際推出會在下次 earnings call 前跟上,值得一兩個月後再確認。↳ Google 說下一次財報說明會(earnings call,公司每季對投資人的報告)之前會開放到其他國家,過一兩個月再查就好。
- 15:11 四層連續示範:先在 AI mode 研究 hyperlocal 農產共享 app 市場,generative UI 產生現有業者比較表,再進 deep research max mode 取得附註腳報告。↳ 最後把四層串起來示範:先用搜尋的 AI mode 研究一個在地農產共享 app 的市場並拿到競爭者比較表,再用 deep research 出一份附註腳的報告。
- 15:42 把關鍵數字放進 Docs,用 Help Me Create 轉成提案草稿,再到 Sheets 用同樣數字建財務模型;用 nano banana pro 做資訊圖表與 logo 概念。↳ 接著把數字放進 Docs 生成提案草稿,再到 Sheets 做財務試算。圖表和 logo 草圖用 nano banana pro(Google 的圖片生成模型)做。
- 15:42 接著進 Vids 用 Omni 做短提案影片分鏡,由個人 avatar 念腳本;同時 Spark 在背景監看收件匣中已聯絡對象的回覆。↳ 然後用 Vids 做提案短片,由自己的虛擬分身念稿(Omni 是影片裡提到的功能名,沒多解釋)。同時 Spark 在背景幫忙盯回信。
- 16:12 整段流程是一條鏈、一個模型家族、零 app 切換。↳ 想表達的是:從研究到提案到影片,全程都在 Google 自家產品裡完成,不用在不同 AI 工具之間搬資料。
- 16:43 Google 把存取權分成四個 tier。Free 涵蓋基本 app、Search,以及 Chrome 與 Workspace 內工具的輕度使用;剛開始學建議先用免費的。↳ Google 的方案分四級。免費版就有基本 app、搜尋,以及 Chrome 和辦公工具裡的少量使用。剛開始學,用免費的就夠了。
- 16:43 上一級解鎖更多用量與 app 內更大的 picker,但不含進階 agent 功能;再上一級是為實際工作而設:更高限額、新模型優先使用、多數 Level 2 的受限功能。↳ 往上一級是用量變多、可選的模型變多,但還沒有進階代理功能。再上一級才是給拿來工作的人:額度更高、先用到新模型。
- 17:18 最高 tier 給持續跑 agents 的人:最高用量上限,以及 Spark 等功能在全面開放前的搶先使用。↳ 最貴的一級是給整天讓代理跑任務的人:用量上限最高,Spark 這類新功能也會先開給他們。一般人不需要。
- 17:18 Level 1 不需要你做決定:Google 決定背後跑什麼模型,而且會自己變快。Level 2 也幾乎不用動作,你常用的產品裡已經有 Gemini,不必手動開啟。↳ 前兩層你不用做任何事。用哪個模型 Google 會幫你安排,常用的產品裡也已經有 Gemini,不用特地去開。
- 17:48 Level 3 是今天唯一值得做的決定:打開 Personal Intelligence,先開 Gmail 或 Drive,再建一個 gem 並接上你本來就在更新的文件。↳ 真正要你動手的只有第三層:打開 Personal Intelligence,先連信箱或雲端硬碟,再建一個 gem 接上你平常就在更新的文件。
- 17:48 Level 4 先別碰,除非你已是美國的 AI Ultra 用戶;Spark 很強但還早期且僅英文,下次 earnings call 後再看。↳ 第四層現在先不要花時間,除非你是美國的 AI Ultra 訂戶。Spark 還很早期又只有英文,等之後開放再看。
- 18:21 總結:模型替你思考,surfaces 讓它出現在你工作的地方,glue 讓它記得你,agents 讓它在你不在時行動;多數人停在 Level 1。↳ 一句話總結四層:模型負責想,產品讓它出現在你工作的地方,記憶讓它認得你,代理讓它替你做事。大部分人只用到第一層。
📘 術語
model picker(模型選擇器):Gemini app 裡切換 Flash、Thinking、Pro 三個選項的選單
surfaces(介面/接觸點):模型悄悄接入的各個 Google 產品;重點是模型來找你
glue(黏著層):跟著你跨所有產品的記憶
agents(代理):Gemini 不再只回答、開始行動的那一層
AI studio(AI studio):Gemini 的免費 lab 版本,有 picker 裡沒有的工具
flashlight(字幕原文)(最便宜最快的 tier):為重複執行的批次工作而設:圖說、標籤、快速標註
deep research(深度研究):瀏覽數十個來源後交出附引用的完整報告
AI mode(AI 模式):Search 裡的開關,現為超過 10 億月活躍使用者的預設
generative UI(生成式介面):回傳可互動的表格而非一段文字,欄位可點開
AI overviews(AI 摘要):一般搜尋結果上方的摘要框
side panel(側邊面板):Chrome 中開在任何分頁旁,可摘要、比較並從當前頁面找答案
auto-browse(自動瀏覽):Gemini 可自行跨分頁導覽與點擊
Workspace Intelligence(Workspace Intelligence):Docs、Sheets、Meet 中 Gemini 功能的統一名稱
DocsLive(Docs 語音模式):你邊說,Gemini 邊把內容整理成有結構的文件
Live Translate(即時翻譯):Meet 中超過 70 種語言的即時語音翻譯
Vids(Vids):Workspace 裡的 Google 影片 app
talking avatar(會說話的虛擬分身):由你的自拍與短錄音生成,念指定腳本
watermark(浮水印):每段影片都帶可見標記,避免被當成真實影像
Gemini Go(Gemini Go):為平價手機打造的輕量版
personal intelligence(個人智慧):預設關閉、需 opt in,讓 Gemini 讀取你開啟的各產品以取得脈絡
opt in(主動選擇加入):功能預設關閉,要自己打開各個開關
gem(gem):有自己指令與知識庫的 Gemini 設定版本
super gems(super gems):在 gem 上加可點擊按鈕與表單,更像輕量 app
checkpoint(檢查點):遇到登入或付款時會暫停並先詢問你
Spark(Spark):跑在專用雲端機器上,闔上筆電後仍持續工作,可用 email 交辦
MCP(MCP):共用的連線標準,用來連接第三方工具
churn(流失):字幕只在定價範例提到,未解釋
tier(方案層級):Google 把存取權分成四級,從 Free 到最高級
surfaces(介面/接觸點):模型悄悄接入的各個 Google 產品;重點是模型來找你
glue(黏著層):跟著你跨所有產品的記憶
agents(代理):Gemini 不再只回答、開始行動的那一層
AI studio(AI studio):Gemini 的免費 lab 版本,有 picker 裡沒有的工具
flashlight(字幕原文)(最便宜最快的 tier):為重複執行的批次工作而設:圖說、標籤、快速標註
deep research(深度研究):瀏覽數十個來源後交出附引用的完整報告
AI mode(AI 模式):Search 裡的開關,現為超過 10 億月活躍使用者的預設
generative UI(生成式介面):回傳可互動的表格而非一段文字,欄位可點開
AI overviews(AI 摘要):一般搜尋結果上方的摘要框
side panel(側邊面板):Chrome 中開在任何分頁旁,可摘要、比較並從當前頁面找答案
auto-browse(自動瀏覽):Gemini 可自行跨分頁導覽與點擊
Workspace Intelligence(Workspace Intelligence):Docs、Sheets、Meet 中 Gemini 功能的統一名稱
DocsLive(Docs 語音模式):你邊說,Gemini 邊把內容整理成有結構的文件
Live Translate(即時翻譯):Meet 中超過 70 種語言的即時語音翻譯
Vids(Vids):Workspace 裡的 Google 影片 app
talking avatar(會說話的虛擬分身):由你的自拍與短錄音生成,念指定腳本
watermark(浮水印):每段影片都帶可見標記,避免被當成真實影像
Gemini Go(Gemini Go):為平價手機打造的輕量版
personal intelligence(個人智慧):預設關閉、需 opt in,讓 Gemini 讀取你開啟的各產品以取得脈絡
opt in(主動選擇加入):功能預設關閉,要自己打開各個開關
gem(gem):有自己指令與知識庫的 Gemini 設定版本
super gems(super gems):在 gem 上加可點擊按鈕與表單,更像輕量 app
checkpoint(檢查點):遇到登入或付款時會暫停並先詢問你
Spark(Spark):跑在專用雲端機器上,闔上筆電後仍持續工作,可用 email 交辦
MCP(MCP):共用的連線標準,用來連接第三方工具
churn(流失):字幕只在定價範例提到,未解釋
tier(方案層級):Google 把存取權分成四級,從 Free 到最高級
✏️ 小考一題
依影片說明,建立 gem 時把知識來源設為「連結一份 live Google doc」而不是上傳檔案,最主要的好處是什麼?
A. gem 會自動切換成 Pro 模型來回答B. gem 的回答會自動加上可見浮水印C. 文件更新時,gem 的知識會自動跟著更新,不必重新上傳或重寫 promptD. gem 可以在你闔上筆電後繼續在雲端執行任務看答案
答案:C。[13:04] 字幕說隨時更新該文件,gem 的知識就自動更新,不必重新上傳、也不必重建 prompt。
💛 覺得有幫助?支持一下


課本免費、沒有廣告,支持與否都能照常讀 🐰