← 回熱門
📈 股票 🌡️ 微溫 📰

Google發表Gemini Robotics ER 2!讓機器人邁向「高階大腦」時代

👤 tanted (為何世界會那麼不單純) 🕐 Fri Jul 31 23:32:34 2026
▲ 10 推 ▼ 5 噓 → 8 回應
分享
🔔 追這個瓜,別錯過後續
挑下面的關鍵字追蹤——只要 爆了有後續延燒,第一時間通知你

文章標題 請使用 原新聞標題 勿刪減或自創標題,違者4-1處分

原文標題: 請勿刪減或自創標題,違者4-1處分,此行請刪除

Google發表Gemini Robotics ER 2!讓機器人邁向「高階大腦」時代

原文連結: 網址超過一行,請用縮網址,連結不能點擊者板規 1-2-2 處分。

https://ec.ltn.com.tw/article/breakingnews/552…

發布時間: 請勿張貼超過3天新聞

2026/07/31 17:00

記者署名:

原文內容:

〔記者邱巧貞/台北報導〕Google 30日宣布推出全新機器人AI模型 Gemini Robotics ER 2,這是目前Google最先進的「具身推理(Embodied Reasoning)」模型,可視為機器人的「高階大腦」,相較前一代 Gemini Robotics ER 1.6,新版本最大的突破在於加入連續影片理解(Video Understanding)、任務進度追蹤、工具調度(Tool

Orchestration)以及多機器人協作能力等。

Google指出,若要讓機器人在真實世界中協助人類,光具備精準的空間推理能力仍然不夠,更大的挑戰在於,機器人能否即時理解現場狀況、判斷下一步該採取什麼行動,並在執行任務的過程中,根據環境變化隨時調整策略。

請繼續往下閱讀...

因此,Gemini Robotics ER 2被定位為機器人的「高階大腦」,主要負責與人類對話、理解周遭物理環境、規劃多步驟任務,並可呼叫Google Search等工具取得資訊,或串接開發者自訂的函式與API。完成任務規劃後,再將實際動作交由底層的視覺-語言-動作模型(Vision-Language-Action,VLA)執行。

此次更新的一大突破,是導入連續影片理解(Continuous Video Understanding)能力。過去機器人大多只能分析單張影像,如今則能持續觀看攝影機畫面,即時掌握任務完成進度、判斷執行過程是否出錯、是否需要重新嘗試,以及是否可以進入下一個步驟。

Google表示,這讓機器人真正具備「即時情境感知」能力,例如能判斷燈泡是否已鎖緊、垃圾袋是否綁好,或咖啡是否已倒至適當容量,只有在確認任務完成後,才會繼續下一步。

為了更精準掌握工作進度,Gemini Robotics ER 2新增進度分類功能,可將影片中的每一個畫面依任務完成程度分為0至20%、20至40%、40至60%、60至80%及80至100%等階段,藉此判斷工作進行到哪裡、是否偏離流程,以及是否需要採取補救措施。官方測試顯示,Gemini Robotics ER 2在進度分類任務中的準確率約57.4%,優於前一代模型。

另一項重要升級則是關鍵時刻辨識(Moment Finding),可找出影片中任務完成的關鍵時間點,例如判斷咖啡何時倒至適當容量、燈泡何時完全鎖緊等。Google表示,新模型在這項測試中的準確率達 91.3%,平均時間誤差僅 0.96 秒;相較同級大型模型,在維持高準確率的同時,推論速度約快 4 倍,且運算成本更低。

Google此次也正式加入多機器人協作功能。官方指出,不同類型的機器人各有所長,例如

輪式機器人擅長室內導航,人形機器人則更適合跨越崎嶇地形,Gemini Robotics ER 2可讓不同機器人共享語意理解能力,彼此分工、交接任務,共同完成單一機器人無法獨立處理的複雜工作流程。

Google也展示與波士頓動力(Boston Dynamics)的合作成果,透過Gemini Robotics ER 2整合Spot四足機器人的導航API與機械手臂控制能力,使用者只需以自然語言下達「幫我拿爆米花」等指令,Spot便能自主導航、尋找目標物並完成取物。Google也同步於GitHub公開相關範例程式,供開發者參考與應用。

此外,Gemini Robotics ER 2也全面提升空間理解能力,涵蓋三大核心功能。首先,在成功/失敗偵測(Success / Failure Detection)方面,Gemini Robotics ER 2 現在可直接分析原始影片串流,而非僅依賴靜態影像,因此能在任務執行過程中即時偵測液體灑出、物品滑落、對位偏移等失敗情況。

其次,在儀器讀值(General Instrument Reading)方面,已從過去主要支援類比儀表,擴展至可辨識10種不同類型的儀器,包括數位顯示器、直尺、線性刻度及液體溫度計等,可因應更多工業場域的檢測需求。

最後,在視覺問答方面,受惠於Gemini多模態理解能力的提升,機器人能更準確理解複雜的視覺資訊,並回答與空間環境相關的問題。

在安全性方面,Google表示,Gemini Robotics ER 2在人員接近偵測及安全指令遵循兩項測試中,表現均優於前一代模型。舉例來說,當有人靠近機器人時,系統能自動停止作業、持續監測周遭環境,並在確認人員離開後自主恢復工作。

Google同時推出全新的安全評估基準,檢驗AI是否具備執行安全限制、持續監控環境、判斷動作是否符合物理可行性,以及在必要時主動向人類尋求確認等能力,進一步提升未來具身AI(Embodied AI)的安全性。

Google表示,Gemini Robotics ER 2已透過Gemini API(可於 Google AI Studio 使用)開放開發者;企業版則以 Private Preview 形式於 Gemini Enterprise Agent Platform提供。

心得/評論:

滿30正體中文字,心得過短或濫竽充數將以板規 1-2-3 處分

谷歌現在給機器人「高階大腦」

不只會做事

還會邊做邊看進度條

確認自己有沒有搞砸

不過再強有我們中國宇樹會後空翻機器人嗎?

--

看 PTT 原文 ↗ 接著看下一篇 ▶ 6770 力積電 本公司董事長逝世 📈 股票 · ▲876▼7看下一篇 →

🍉 更多相關的瓜

同板/同主題,繼續吃
📈 股票 台股前十大漲點紀錄(今天第一名) ▲1323▼16 📈 股票 2026/07/31 盤後閒聊 ▲763▼97 📈 股票 力積電董事長黃崇仁離世 由副董事長謝再居依法代理董事長職務 ▲506▼7 📈 股票 2026/07/31 盤中閒聊 ▲861▼78