首個完全開源的多模態物理人工智慧模型「Cosmos3」正式亮相;NVIDIA 共同創立 Cosmos 聯盟
物理人工智慧領域已取得重大進展。6月1日,NVIDIA 正式推出 Cosmos3,這是一款專為物理人工智慧設計的開放世界基礎大型模型。 作為全球首個完全開源且具備多模態能力的物理人工智慧大型模型,它採用創新的混合式 Transformer 架構,將視覺推理、世界生成與動作預測整合為單一系統。此舉有望將物理人工智慧的訓練與評估週期從數月大幅縮短至僅需數日。
Cosmos3 為業界長期面臨的挑戰——「在數據有限且模擬框架零散的情況下,難以在真實世界情境中進行泛化」——提供了嶄新的解決方案。 該模型基於包含數十億筆文字、圖像、影片、音訊及運動軌跡的龐大物理AI數據集進行訓練,能自然理解並生成跨模態內容,在物理模擬領域達到業界領先的準確度。

在技術層面上,Cosmos3 創新地將推理 Transformer 與生成式 Transformer 結合。該模型首先深入分析物體交互規則、運動狀態及時空關係,隨後精準生成影片並預測動作軌跡。 此設計賦予其強大的圖像與文字多模態理解能力、物理環境的模擬與預測能力,以及協助機器人完成特定任務的動作策略能力。在包括 Artificial Analysis、Physics-IQ 和 RoboLab 在內的數個主流物理 AI 基準測試中,Cosmos3 均名列前茅的開源模型之列。
為滿足不同開發階段的需求,NVIDIA 已發布多個版本:Cosmos3Super 專注於以極高精度對機器人與自動駕駛模型進行二次訓練;Cosmos3Nano 則能在數秒內完成高品質的影片解析與動作推理。兩者現已正式推出。 專為邊緣裝置即時推論設計的 Cosmos3Edge 版本,亦已列入發布規劃。
伴隨大型模型的發布,NVIDIA 攜手全球頂尖模型研究團隊及 AI 開發者共同創立了「NVIDIA Cosmos 聯盟」,成員包括 Agile Robots、Black Forest Labs、Generalist、LTX、Runway 及 Skild AI。 NVIDIA 創辦人暨執行長黃仁勳表示,隨著多模態推理與世界模型的持續突破,實體人工智慧的變革時代已然來臨。這些尖端開源模型的發布,將協助全球開發者實現技術飛躍,並打造出能夠在現實世界中感知、推理與行動的下一代智慧系統。
相關文章
阿里巴巴超級盃:Qwen3.8-Max 重磅登場,程式碼與辦公工具能力全面升級
阿里巴巴正式釋出了Qwen3.8-Max,這是一款擁有2.4萬億引數的下一代基礎大模型。這一重大AI進展在編碼和專業辦公任務等核心領域帶來了顯著的效能提升,展現了強大的技術能力。在權威的Arena大模型排名中,Qwen3.8-Max取得了令人矚目的成績,僅次於Anthropic的Claude系列,位居行業前列。這一里程碑標誌著國內大模型在處理複雜任務方面取得了快速進展,為開發者和企業使用者提供了先進的智慧工具。該模型的API現已在Qwen AI平臺上上線,並整合到新推出的“Qwen Offic
印度科技巨頭投資3000萬美元,打造微軟Office的AI競爭對手
連續創業者 Bhavin Turakhia 正投入 3000 萬美元自有資金,押注企業 AI 領域仍有新玩家的空間。他最新的創業專案 Neo 基於一個核心信念:傳統的職場軟體不能僅靠聊天機器人進行修補,而需要進行徹底的架構重構。46 歲的 Turakhia 有著支援雄心勃勃的企業科技專案的歷史。在過去二十年中,他聯合創立了 Directi、Radix、Titan 和 Zeta,在尋求外部投資之前,主要使用個人資本為這些專案提供資金。他正將同樣的自力更生策略應用於 Neo。Turakhia 向
前OpenAI首席科學家Ilya的SSI首次釋出模型
AI 取得了另一項重大里程碑。在從 OpenAI 離職後,前首席科學家伊利亞·蘇茨克弗(Ilya Sutskever)創立了 Safe Superintelligence Inc.(SSI),該公司最近公佈了其首個模型的詳細資訊。海外社交媒體上的報道指出,該團隊正在利用 TTT(測試時訓練)開發一個緊湊的推理引擎,這是他們在追求安全超級智慧過程中的關鍵進展。這種新穎的架構專注於使模型能夠“學習如何學習”。與在推理過程中保持引數靜態的傳統大型語言模型不同,該引擎在處理現實世界任務時會動態更新特定
相關專題推薦
評論 (0)
0/500
物理人工智慧領域已取得重大進展。6月1日,NVIDIA 正式推出 Cosmos3,這是一款專為物理人工智慧設計的開放世界基礎大型模型。 作為全球首個完全開源且具備多模態能力的物理人工智慧大型模型,它採用創新的混合式 Transformer 架構,將視覺推理、世界生成與動作預測整合為單一系統。此舉有望將物理人工智慧的訓練與評估週期從數月大幅縮短至僅需數日。
Cosmos3 為業界長期面臨的挑戰——「在數據有限且模擬框架零散的情況下,難以在真實世界情境中進行泛化」——提供了嶄新的解決方案。 該模型基於包含數十億筆文字、圖像、影片、音訊及運動軌跡的龐大物理AI數據集進行訓練,能自然理解並生成跨模態內容,在物理模擬領域達到業界領先的準確度。

在技術層面上,Cosmos3 創新地將推理 Transformer 與生成式 Transformer 結合。該模型首先深入分析物體交互規則、運動狀態及時空關係,隨後精準生成影片並預測動作軌跡。 此設計賦予其強大的圖像與文字多模態理解能力、物理環境的模擬與預測能力,以及協助機器人完成特定任務的動作策略能力。在包括 Artificial Analysis、Physics-IQ 和 RoboLab 在內的數個主流物理 AI 基準測試中,Cosmos3 均名列前茅的開源模型之列。
為滿足不同開發階段的需求,NVIDIA 已發布多個版本:Cosmos3Super 專注於以極高精度對機器人與自動駕駛模型進行二次訓練;Cosmos3Nano 則能在數秒內完成高品質的影片解析與動作推理。兩者現已正式推出。 專為邊緣裝置即時推論設計的 Cosmos3Edge 版本,亦已列入發布規劃。
伴隨大型模型的發布,NVIDIA 攜手全球頂尖模型研究團隊及 AI 開發者共同創立了「NVIDIA Cosmos 聯盟」,成員包括 Agile Robots、Black Forest Labs、Generalist、LTX、Runway 及 Skild AI。 NVIDIA 創辦人暨執行長黃仁勳表示,隨著多模態推理與世界模型的持續突破,實體人工智慧的變革時代已然來臨。這些尖端開源模型的發布,將協助全球開發者實現技術飛躍,並打造出能夠在現實世界中感知、推理與行動的下一代智慧系統。
阿里巴巴超級盃:Qwen3.8-Max 重磅登場,程式碼與辦公工具能力全面升級
阿里巴巴正式釋出了Qwen3.8-Max,這是一款擁有2.4萬億引數的下一代基礎大模型。這一重大AI進展在編碼和專業辦公任務等核心領域帶來了顯著的效能提升,展現了強大的技術能力。在權威的Arena大模型排名中,Qwen3.8-Max取得了令人矚目的成績,僅次於Anthropic的Claude系列,位居行業前列。這一里程碑標誌著國內大模型在處理複雜任務方面取得了快速進展,為開發者和企業使用者提供了先進的智慧工具。該模型的API現已在Qwen AI平臺上上線,並整合到新推出的“Qwen Offic
印度科技巨頭投資3000萬美元,打造微軟Office的AI競爭對手
連續創業者 Bhavin Turakhia 正投入 3000 萬美元自有資金,押注企業 AI 領域仍有新玩家的空間。他最新的創業專案 Neo 基於一個核心信念:傳統的職場軟體不能僅靠聊天機器人進行修補,而需要進行徹底的架構重構。46 歲的 Turakhia 有著支援雄心勃勃的企業科技專案的歷史。在過去二十年中,他聯合創立了 Directi、Radix、Titan 和 Zeta,在尋求外部投資之前,主要使用個人資本為這些專案提供資金。他正將同樣的自力更生策略應用於 Neo。Turakhia 向
前OpenAI首席科學家Ilya的SSI首次釋出模型
AI 取得了另一項重大里程碑。在從 OpenAI 離職後,前首席科學家伊利亞·蘇茨克弗(Ilya Sutskever)創立了 Safe Superintelligence Inc.(SSI),該公司最近公佈了其首個模型的詳細資訊。海外社交媒體上的報道指出,該團隊正在利用 TTT(測試時訓練)開發一個緊湊的推理引擎,這是他們在追求安全超級智慧過程中的關鍵進展。這種新穎的架構專注於使模型能夠“學習如何學習”。與在推理過程中保持引數靜態的傳統大型語言模型不同,該引擎在處理現實世界任務時會動態更新特定





首頁






