DeepSeek V4 預計將於四月與騰訊的「夢圓」模型同步推出

根據百明實驗室的獨家報導,備受矚目的 DeepSeek V4 以及姚順宇的新型 MixFormer 模型,預計將於 2026 年 4 月正式發布。DeepSeek V4 是由梁文峰領銜開發的多模態大型模型。 經過廣泛的優化,預計將在編碼能力與長期記憶方面取得重大突破。此次發布符合 DeepSeek 團隊近年來的研究方向,特別是在視覺內容處理與 AI 驅動的搜尋能力方面。
梁文峰的研究聚焦於探索「條件記憶」機制。2026年1月,他發表了題為《透過可擴展查找實現條件記憶》(Conditional Memory via Scalable Lookup)的論文,闡述了相關核心理論。 此外,他在2025年12月發表了另一項研究《mHC:流形約束超連接》,進一步優化了底層架構。這項工作旨在解決Transformer模型在記憶與訓練穩定性方面的已知限制。DeepSeek V4不僅具備強大的多模態處理能力,更針對國產晶片進行深度優化,目標是成為完全依賴國內運算基礎設施的核心模型。
與此同時,姚順宇的新模型 MixFormer 也預計於四月發布。自 2025 年 12 月起,姚順宇擔任騰訊執行委員會首席 AI 科學家,同時負責 AI 基礎設施及大型語言模型部門。 2026年2月,他推出了 CL-bench,這是一套針對「情境學習」的創新評估基準,著重於長上下文處理與代理程式(Agent)的可用性。報導指出,姚順宇的新模型將擁有約30億個參數,其團隊從一開始便優先考量實際應用,而非僅追求參數規模的競爭。
這兩款模型即將問世的消息已引起市場高度關注,凸顯了中國在人工智慧領域的加速進展。無論是DeepSeek V4在長期記憶方面的突破,還是騰訊MixFormer模型在實際任務評估中的改進,這兩項努力都從根本上探討了未來大型模型如何能更有效地整合到生產環境中。
相關文章
前OpenAI首席科學家Ilya的SSI首次釋出模型
AI 取得了另一項重大里程碑。在從 OpenAI 離職後,前首席科學家伊利亞·蘇茨克弗(Ilya Sutskever)創立了 Safe Superintelligence Inc.(SSI),該公司最近公佈了其首個模型的詳細資訊。海外社交媒體上的報道指出,該團隊正在利用 TTT(測試時訓練)開發一個緊湊的推理引擎,這是他們在追求安全超級智慧過程中的關鍵進展。這種新穎的架構專注於使模型能夠“學習如何學習”。與在推理過程中保持引數靜態的傳統大型語言模型不同,該引擎在處理現實世界任務時會動態更新特定
Lovable Leads Atech's Seed Round as AI Ambient Coding Officially Enters the Hardware Field
2026年5月14日,AI應用開發平臺Lovable宣佈參與丹麥硬體初創公司Atech的80萬美元種子輪融資。該輪由Lovable領投,吸引了包括a16z Scout Fund、Sequoia Scout Fund以及Nordic Makers在內的頂級風險投資機構。此次投資標誌著Lovable將“Vibe Coding”概念從純軟體開發戰略擴充套件至硬體工程領域。Atech旨在透過AI驅動的互動式平臺簡化複雜的硬體原型製作。使用者購買基礎硬體套件,並透過AI聊天機器人以自然語言描述其設計概念;系統
Anthropic 將 Claude AI 編碼工具擴充套件至日本,以推動海外增長
Anthropic,一家美國知名的人工智慧公司,正加強其全球推廣力度。週三,該公司在東京舉辦了一場大型開發者活動“Code with Claude”,吸引了近500名軟體工程師參加。該舉措旨在積極將Claude AI工具及相關產品引入日本市場,強調其自主編碼能力在提升企業生產力方面的核心優勢。強調自動化程式碼生成在活動中,Anthropic展示了其先進的自主編碼系統,該系統能夠獨立處理複雜的程式設計任務並最佳化現有程式碼結構。隨著全球對高效開發工具的需求不斷增長,Anthropic希望透過此類活動加強
相關專題推薦
評論 (0)
0/500

根據百明實驗室的獨家報導,備受矚目的 DeepSeek V4 以及姚順宇的新型 MixFormer 模型,預計將於 2026 年 4 月正式發布。DeepSeek V4 是由梁文峰領銜開發的多模態大型模型。 經過廣泛的優化,預計將在編碼能力與長期記憶方面取得重大突破。此次發布符合 DeepSeek 團隊近年來的研究方向,特別是在視覺內容處理與 AI 驅動的搜尋能力方面。
梁文峰的研究聚焦於探索「條件記憶」機制。2026年1月,他發表了題為《透過可擴展查找實現條件記憶》(Conditional Memory via Scalable Lookup)的論文,闡述了相關核心理論。 此外,他在2025年12月發表了另一項研究《mHC:流形約束超連接》,進一步優化了底層架構。這項工作旨在解決Transformer模型在記憶與訓練穩定性方面的已知限制。DeepSeek V4不僅具備強大的多模態處理能力,更針對國產晶片進行深度優化,目標是成為完全依賴國內運算基礎設施的核心模型。
與此同時,姚順宇的新模型 MixFormer 也預計於四月發布。自 2025 年 12 月起,姚順宇擔任騰訊執行委員會首席 AI 科學家,同時負責 AI 基礎設施及大型語言模型部門。 2026年2月,他推出了 CL-bench,這是一套針對「情境學習」的創新評估基準,著重於長上下文處理與代理程式(Agent)的可用性。報導指出,姚順宇的新模型將擁有約30億個參數,其團隊從一開始便優先考量實際應用,而非僅追求參數規模的競爭。
這兩款模型即將問世的消息已引起市場高度關注,凸顯了中國在人工智慧領域的加速進展。無論是DeepSeek V4在長期記憶方面的突破,還是騰訊MixFormer模型在實際任務評估中的改進,這兩項努力都從根本上探討了未來大型模型如何能更有效地整合到生產環境中。
前OpenAI首席科學家Ilya的SSI首次釋出模型
AI 取得了另一項重大里程碑。在從 OpenAI 離職後,前首席科學家伊利亞·蘇茨克弗(Ilya Sutskever)創立了 Safe Superintelligence Inc.(SSI),該公司最近公佈了其首個模型的詳細資訊。海外社交媒體上的報道指出,該團隊正在利用 TTT(測試時訓練)開發一個緊湊的推理引擎,這是他們在追求安全超級智慧過程中的關鍵進展。這種新穎的架構專注於使模型能夠“學習如何學習”。與在推理過程中保持引數靜態的傳統大型語言模型不同,該引擎在處理現實世界任務時會動態更新特定
Lovable Leads Atech's Seed Round as AI Ambient Coding Officially Enters the Hardware Field
2026年5月14日,AI應用開發平臺Lovable宣佈參與丹麥硬體初創公司Atech的80萬美元種子輪融資。該輪由Lovable領投,吸引了包括a16z Scout Fund、Sequoia Scout Fund以及Nordic Makers在內的頂級風險投資機構。此次投資標誌著Lovable將“Vibe Coding”概念從純軟體開發戰略擴充套件至硬體工程領域。Atech旨在透過AI驅動的互動式平臺簡化複雜的硬體原型製作。使用者購買基礎硬體套件,並透過AI聊天機器人以自然語言描述其設計概念;系統
Anthropic 將 Claude AI 編碼工具擴充套件至日本,以推動海外增長
Anthropic,一家美國知名的人工智慧公司,正加強其全球推廣力度。週三,該公司在東京舉辦了一場大型開發者活動“Code with Claude”,吸引了近500名軟體工程師參加。該舉措旨在積極將Claude AI工具及相關產品引入日本市場,強調其自主編碼能力在提升企業生產力方面的核心優勢。強調自動化程式碼生成在活動中,Anthropic展示了其先進的自主編碼系統,該系統能夠獨立處理複雜的程式設計任務並最佳化現有程式碼結構。隨著全球對高效開發工具的需求不斷增長,Anthropic希望透過此類活動加強





首頁






