AI 課本 › 💎 機器人與世界模型

Gemini Robotics 2 的智慧全身控制

2026/07/30 · 2 分鐘 · 官方字幕實證
展示機器人 Apollo 用全身協調控制幫孩子打包運動用品
💡 你可以怎麼用:以後看機器人展示影片,可以用三點來判斷:指令是不是模糊的日常講法、環境是不是亂的、失敗時它會不會自己發現並重來。這三點比動作帥不帥更能看出真實能力。
看全部 14 條重點

🧑‍🏫 這支影片是 Google DeepMind 展示人形機器人 Apollo,聽一句話就去幫小孩打包運動用品。重點不在打包本身,而是機器人怎麼讓「大腦理解」和「全身動作」配合起來。看完會知道為什麼讓機器人像人一樣動,比想像中難很多。

📘 術語
embodied reasoning model(具身推理模型):能理解世界、所見畫面與自然語言指令,再呼叫 VLA 控制機器人。
VLA (vision language action model)(視覺語言動作模型):被 embodied reasoning model 呼叫,用來控制機器人、產生動作。
whole-body control(全身控制):協調從腳到指尖的所有關節與致動器並維持平衡;是通用型機器人的必要條件。
actuators(致動器):字幕未解釋,只提到機器人要協調所有關節與致動器。
generalist robot(通用型機器人):能在真實世界做更多有用任務的機器人,是團隊的願景。
reactivity(反應能力):字幕未解釋;講者用臨時放 tote bag 的挑戰來壓力測試它。
✏️ 小考一題

依字幕,當機器人身體太往前傾、快要翻倒時,它需要怎麼做?

A. 把腿往後推B. 停止動作等待人類協助C. 呼叫行事曆重新規劃任務D. 立刻放下手上的物品
看答案
答案:A。[01:03] 字幕說如果往前傾得更多、快要翻倒,就需要把腿往後推,而且要在不到一秒內發生。
📺 看原片📚 在課本 App 讀
💛 覺得有幫助?支持一下台灣Pay 銀行轉帳 QRPayPal QR
課本免費、沒有廣告,支持與否都能照常讀 🐰

重點整理自 YouTube 影片字幕,每條附時間碼可跳回原片;🧑‍🏫/↳ 是 Claude 補充的白話,不是影片原話。