北京“數據超級工廠”助機器人理解世界
訂閱已訂閱已收藏
收藏
工作人員進行機器人動作數據採集。北京人形機器人創新中心供圖
機器人想要認識世界、理解世界,就需要大量來自物理世界的數據“教材”。如今,北京正在加速打造面向全球的具身智能“數據超級工廠”。昨天,北京人形機器人創新中心宣布,其開源數據集RoboMIND全球下載量突破2000萬次,短短一個月下載量實現翻倍的背后,是我國人形機器人開源數據生態獲得全球研發群體的廣泛認可。
走進北京人形具身智能機器人數據與訓練基地,近6000平方米的實訓空間,一派忙碌的採集景象映入眼帘。家居、商超、工業裝配、倉儲物流、醫療輔助、特種作業等40余個模擬實景分區排布,數據採集員穿戴採集設備,在不同模擬場景中反復完成抓取物件、開關設備、分揀零件、整理物料、姿態調整等各類實操動作。除了搭建的模擬實景,在動作捕捉區域,動捕人員穿著特定裝備完成高難度動作,頭頂光學捕捉攝像頭,把動作細節完整記錄。每天,這些採集下來的高質量數據會源源不斷匯入數據平台,經過多輪清洗、標注、校驗、質檢,最終形成標准化樣本,用於算法模型訓練,幫助機器人不斷認識、理解世界。
自2025年12月開源以來,Robo-MIND已累計釋放30萬余條雙臂操作軌跡,覆蓋700余項實操任務,面向全球開發者全量開放。整個數據基地建成不到一年,部署了40種構型共計150余台機器人設備,搭建起多機型協同採集體系,年數據產能可達18萬小時,已經對外交付近3萬小時高質量數據,七成以上產能服務行業客戶。
目前,數據基地已經搭建起覆蓋家庭生活、工業生產、商業服務等多領域的場景矩陣,並持續擴充任務庫與動作樣本庫,長遠目標瞄准產出100萬小時高質量人形機器人交互數據。同時,基地深度參與多項國家、行業標准編制,搭建起從數據採集、標注、評測到交付的標准化體系,為整個行業輸出統一的數據規范。不久前的世界人形機器人運動會賽場,依托基地產出的海量訓練數據,天工機器人跑出百米8.64秒的好成績。
伴隨具身智能產業浪潮興起,高質量數據已成為具身智能迭代進化的核心燃料。不同於語言大模型主要學習文本語義,人形機器人需要深度理解紛繁復雜的真實物理世界,物體軟硬程度、表面摩擦力、空間距離、環境光照變化、突發障礙物等大量動態變量,無法全部依靠人工編寫代碼預設。此前很長一段時間裡,國內人形機器人賽道面臨高質量具身數據稀缺、各家數據格式不統一、數據生態碎片化等難題,不少企業需要投入高額成本自建採集體系,研發門檻居高不下。RoboMIND下載量突破2000萬次,正是整個行業對於標准化、可復用開源數據資源強烈需求的直觀印証。
這份來自北京的開源數據成果,對國內人形機器人產業發展有著深遠意義。數據集面向全球開放共享,打破行業的數據壁壘,有效降低中小機器人企業、高校科研團隊的研發門檻,避免頭部企業形成技術壟斷,凝聚產學研協同創新合力。不止於產出數據集本身,依托北京人形數據基地的持續建設,北京正在系統性夯實人形機器人產業底層數據基座,逐步打通採集、標注、訓練、評測、部署、場景回流的完整數據閉環。(記者 趙語涵)
分享讓更多人看到
- 評論
- 關注
































第一時間為您推送權威資訊
報道全球 傳播中國
關注人民網,傳播正能量