Svmuu訊 谷歌 DeepMind 發布 Gemini Robotics-ER 1.6,定位為機器人的高層推理模型,相比前代 ER 1.5 和 Gemini 3.0 Flash 在空間推理和多視角理解上有顯著提升。模型已通過 Gemini API 和 Google AI Studio 向開發者開放,核心升級包括三項能力:
1. 指向(pointing)精度提升:可用於精確物體檢測、計數、空間關係推理(如 "指出所有能放進藍色杯子的物體 ")和運動軌跡規劃,且能正確拒絕指向畫面中不存在的物體
2. 多視角成功檢測:機器人現在能綜合多個攝像頭畫面判斷任務是否完成,即使在遮擋或動態環境下也能保持準確
3. 新增儀表讀取能力:可解讀圓形壓力表、垂直液位指示器和數字顯示屏等多種工業儀表,通過 agentic vision(視覺推理 + 代碼執行)實現逐步推理,先放大細節區域,再通過指向和代碼計算比例與間隔,最後結合世界知識得出讀數
24小時熱榜
-
1
比特幣被盜後能否立案?個人找回可能性分析
-
2
DANA幣:已停止開發的Ardana項目代幣,現狀與投資價值分析
-
3
CINEMA幣解析:Absolute Cinema與CinemaKoin項目概覽及投資考量
-
4
以太坊ETH購買指南:主流交易平台與獲取途徑解析
-
5
美國司法部指控兩名Robinhood工程師在Hyperliquid平台上利用加密貨幣上市信息進行搶先交易,據稱每人從中獲利超過5萬美元
-
6
CRI幣(Crypto International)項目解析與市場現狀
-
7
SHANG幣:Shanghai Inu解析與未來發展展望
-
8
THALES幣:Thales協議的治理代幣及其市場現狀
-
9
主流加密貨幣交易平台:蘋果App與PC客户端概覽
-
10
SK海力士正與英特爾洽談潛在的美國內存生產協議
今日行情
推薦閱讀










