盛舒科技的 MotuBrain 確立了具身智能大腦標準,這匹跨領域的黑馬同時蟬聯兩大排行榜榜首
在具身智能領域流傳了三週之久的「神秘模型」,終於揭曉了。幾週前,一款名為MotuBrain 的模型悄然躍居物理世界理解與動作執行兩大國際基準測試的榜首,引發業界廣泛好奇。近日,以影片生成模型 Vidu 聞名的盛樹科技 正式確認,該模型正是其具身智能領域的最新商用產品。
這項跨領域的舉措絕非隨意的實驗。MotuBrain 在 WorldArena(測試實體世界理解能力)和 RoboTwin 2.0(評估動作執行能力)上均創下新紀錄。特別是在存在模擬隨機干擾的複雜環境中,它是唯一一個平均分數超過 95 分的模型,展現出強大的泛化能力。

「看與做」:打破感知與行動之間的藩籬
有別於傳統「先想像、再行動」的模型,MotuBrain 採用創新的「世界動作模型」框架。這種「看與做」的設計讓機器人能在決策時同步進行模擬,避免預測與執行錯誤相互疊加,並顯著提升反應速度。
在實際演示中,配備此系統的機器人展現出高度的智能。在火鍋情境中,機器人能透過視覺判斷湯匙是否空置,並自主決定是否再次取用,而非機械式地重複預設動作。這種「讀懂場景」的能力,標誌著機器人已從簡單的機械執行,邁向真正的智能決策。

一腦多形:無縫執行長時程任務
MotuBrain 的核心優勢在於其強大的通用性。它支持「一腦多形」的設計理念,能適應不同自由度與感測器配置的機器人機體,同時也能處理長時程任務。在插花、調製雞尾酒及整理沙發等示範中,機器人能依序完成十多項原子動作,過程流暢且無需人類介入。
數據顯示,隨著任務多樣性增加,MotuBrain 的學習成功率往往隨之提升。這表明該模型已掌握物理世界的普遍基本法則,而非僅是記憶動作模板。任務越多元,其表現越出色。
建立實體世界存在感,在數位與實體領域雙軌並進
盛樹科技 展現的實力源自其深厚的技術根基。透過全球首創的 U-ViT 架構,該公司將數位世界生成(VGM)與實體世界執行(WAM)相結合。一方面,Vidu 負責生成虛擬世界;另一方面,MotuBrain 則驅動實體互動。這種雙軌策略使其在數據獲取成本與模型迭代速度方面具備顯著優勢。
目前,盛樹科技已與多間企業建立戰略合作夥伴關係,包括武界動能與星辰智能。隨著具身智能領域的競爭焦點轉移,擁有通用型「大腦」的模型開發者正逐漸成為重塑產業格局的關鍵力量。
相關文章
Meta 在使用者強烈反對後取消了 AI 照片編輯功能
Meta,這家社交媒體巨頭,再次捲入關於人工智慧與使用者隱私之間微妙平衡的公開辯論。據 TechCrunch 報道,Meta 的 Superintelligence Labs 本週早些時候推出了一款新的 AI 影象生成器 Muse Image。然而,一個備受好評的關鍵功能——允許使用者透過“@”符號標記來修改和生成來自公開 Instagram 賬戶的影象——由於缺乏適當的通知機制,立即引發了使用者以及 CAA 等機構的強烈反對。面對強烈的批評,Meta 迅速撤銷了該決定,並於週五透過部落格文章宣佈將
DeepMind執行長哈西里斯:我每天睡六個小時,通常在凌晨1點左右感到精力充沛。
Fortune 最近刊登了對谷歌 DeepMind 執行長 Demis Hassabis 的採訪,揭示了他對休息和生產力的非傳統方法。Hassabis 透露,他睡眠時間非常少,將清醒時間劃分為兩個不同的工作階段。關於他的睡眠習慣,Hassabis 表示:“我目標睡六小時,但我的習慣非同尋常。我可以在白天有效運作。”他強調,睡眠少於六小時會對大腦健康產生負面影響。Hassabis 於 2010 年聯合創立了 DeepMind(後被谷歌收購),並因其在蛋白質結構預測方面的開創性工作榮獲 20
儘管營收未達預期,OpenAI 與 Anthropic 仍爭奪市場份額
儘管近期有報導指出 OpenAI 未達營收目標,導致本週二科技股承壓,但私人人工智慧實驗室的投資者仍展現出韌性。資深投資者已確認,儘管媒體報導負面,他們仍不會削減投資。分析師認為當前的 AI 競逐仍處於初期階段,因此排除「贏家通吃」的結果。儘管高昂的運算成本對營收造成壓力,但各實驗室可透過調高訂閱費來提升獲利能力。產業格局正經歷微妙的變化與 OpenAI 不同,競爭對手 Anthropic 獲得了
相關專題推薦
評論 (1)
0/500
在具身智能領域流傳了三週之久的「神秘模型」,終於揭曉了。幾週前,一款名為
這項跨領域的舉措絕非隨意的實驗。MotuBrain 在 WorldArena(測試實體世界理解能力)和 RoboTwin 2.0(評估動作執行能力)上均創下新紀錄。特別是在存在模擬隨機干擾的複雜環境中,它是唯一一個平均分數超過 95 分的模型,展現出強大的泛化能力。

「看與做」:打破感知與行動之間的藩籬
有別於傳統「先想像、再行動」的
在實際演示中,配備此系統的機器人展現出高度的智能。在火鍋情境中,機器人能透過視覺判斷湯匙是否空置,並自主決定是否再次取用,而非機械式地重複預設動作。這種「讀懂場景」的能力,標誌著機器人已從簡單的機械執行,邁向真正的智能決策。

一腦多形:無縫執行長時程任務
數據顯示,隨著任務多樣性
建立實體世界存在感,在數位與實體領域雙軌並進
目前,盛樹科技已與多間企業建立戰略合作夥伴關係,包括武界動能與星辰智能。隨著具身智能領域的競爭焦點轉移,擁有通用型「大腦」的模型開發者正逐漸成為重塑產業格局的關鍵力量。
Meta 在使用者強烈反對後取消了 AI 照片編輯功能
Meta,這家社交媒體巨頭,再次捲入關於人工智慧與使用者隱私之間微妙平衡的公開辯論。據 TechCrunch 報道,Meta 的 Superintelligence Labs 本週早些時候推出了一款新的 AI 影象生成器 Muse Image。然而,一個備受好評的關鍵功能——允許使用者透過“@”符號標記來修改和生成來自公開 Instagram 賬戶的影象——由於缺乏適當的通知機制,立即引發了使用者以及 CAA 等機構的強烈反對。面對強烈的批評,Meta 迅速撤銷了該決定,並於週五透過部落格文章宣佈將
DeepMind執行長哈西里斯:我每天睡六個小時,通常在凌晨1點左右感到精力充沛。
Fortune 最近刊登了對谷歌 DeepMind 執行長 Demis Hassabis 的採訪,揭示了他對休息和生產力的非傳統方法。Hassabis 透露,他睡眠時間非常少,將清醒時間劃分為兩個不同的工作階段。關於他的睡眠習慣,Hassabis 表示:“我目標睡六小時,但我的習慣非同尋常。我可以在白天有效運作。”他強調,睡眠少於六小時會對大腦健康產生負面影響。Hassabis 於 2010 年聯合創立了 DeepMind(後被谷歌收購),並因其在蛋白質結構預測方面的開創性工作榮獲 20
儘管營收未達預期,OpenAI 與 Anthropic 仍爭奪市場份額
儘管近期有報導指出 OpenAI 未達營收目標,導致本週二科技股承壓,但私人人工智慧實驗室的投資者仍展現出韌性。資深投資者已確認,儘管媒體報導負面,他們仍不會削減投資。分析師認為當前的 AI 競逐仍處於初期階段,因此排除「贏家通吃」的結果。儘管高昂的運算成本對營收造成壓力,但各實驗室可透過調高訂閱費來提升獲利能力。產業格局正經歷微妙的變化與 OpenAI 不同,競爭對手 Anthropic 獲得了





首頁






