DeepSeek V4 计划于4月与腾讯的“梦圆”模型同步发布

据百明实验室独家报道,备受期待的DeepSeek V4以及姚顺宇的新型MixFormer模型计划于2026年4月正式发布。DeepSeek V4是由梁文峰主导研发的多模态大模型。 经过大量优化,该模型有望在编码能力和长时记忆方面取得重大突破。此次发布契合了DeepSeek团队近年来的研究方向,特别是在视觉内容处理和AI驱动的搜索能力方面。
梁文峰的研究聚焦于探索“条件记忆”机制。2026年1月,他发表了题为《基于可扩展查找的条件记忆》的论文,阐述了相关核心理论。 此外,2025年12月,他发布了另一项研究《mHC:流形约束超连接》,进一步优化了底层架构。该研究旨在解决Transformer模型在记忆和训练稳定性方面的已知局限。DeepSeek V4不仅拥有强大的多模态处理能力,还针对国产芯片进行了深度优化,旨在成为完全依托国内计算基础设施的核心模型。
与此同时,姚顺宇的新模型MixFormer也计划于4月发布。自2025年12月起,姚顺宇担任腾讯执行委员会首席AI科学家,同时负责AI基础设施及大型语言模型部门。 2026年2月,他推出了CL-bench——一个专注于“上下文学习”的创新评估基准,该基准强调长上下文处理能力和智能体的可用性。据报道,姚顺宇的新模型参数规模约为30亿,其团队从一开始就将实际应用置于单纯的参数规模竞赛之上。
这两款模型即将发布的消息已引发市场广泛关注,凸显了中国在人工智能领域加速发展的态势。无论是DeepSeek V4在长时记忆方面的突破,还是腾讯MixFormer模型在实际任务评估中的改进,这两项成果从根本上都在探索未来大型模型如何更有效地融入生产环境。
相关文章
DeepMind首席执行官哈西里斯:我每天睡六个小时,通常在凌晨1点左右感到精力充沛。
Fortune 最近刊登了对谷歌 DeepMind 首席执行官 Demis Hassabis 的采访,揭示了他对休息和生产力的非传统方法。Hassabis 透露,他睡眠时间非常少,将清醒时间划分为两个不同的工作阶段。关于他的睡眠习惯,Hassabis 表示:“我目标睡六小时,但我的习惯非同寻常。我可以在白天有效运作。”他强调,睡眠少于六小时会对大脑健康产生负面影响。Hassabis 于 2010 年联合创立了 DeepMind(后被谷歌收购),并因其在蛋白质结构预测方面的开创性工作荣获 20
尽管营收未达预期,OpenAI与Anthropic仍在争夺市场份额
尽管近期有报道称OpenAI未达营收目标,给本周二的科技股带来压力,但私营人工智能实验室的投资者仍表现坚韧。经验丰富的投资者已确认,尽管媒体报道负面,他们仍不会减少投资。分析师认为当前的人工智能竞赛仍处于早期阶段,因此不会出现“赢家通吃”的局面。尽管高昂的计算成本给营收带来压力,但实验室可通过提高订阅费来提升盈利能力。行业格局正发生微妙变化与OpenAI不同,其竞争对手Anthropic获得了强有
加利福尼亚州自动驾驶合规:罚单、地理围栏和100万英里的新时代
Guident公司在南佛罗里达州运营一辆AuveTech自动驾驶班车,利用其远程监控技术管理西棕榈滩的一条4英里路线和博卡拉顿的一条1英里路线。| 图片来源:Guident加利福尼亚州正在重新定义无人驾驶车辆的监管格局,正逐渐摆脱科技行业“快速行动,打破常规”的思维模式,转向严格的问责制和严苛的行驶里程要求。Guident执行董事长兼首席执行官哈罗德·布劳恩(Harold Braun)在《机器人报
相关专题推荐
评论 (0)
0/500

据百明实验室独家报道,备受期待的DeepSeek V4以及姚顺宇的新型MixFormer模型计划于2026年4月正式发布。DeepSeek V4是由梁文峰主导研发的多模态大模型。 经过大量优化,该模型有望在编码能力和长时记忆方面取得重大突破。此次发布契合了DeepSeek团队近年来的研究方向,特别是在视觉内容处理和AI驱动的搜索能力方面。
梁文峰的研究聚焦于探索“条件记忆”机制。2026年1月,他发表了题为《基于可扩展查找的条件记忆》的论文,阐述了相关核心理论。 此外,2025年12月,他发布了另一项研究《mHC:流形约束超连接》,进一步优化了底层架构。该研究旨在解决Transformer模型在记忆和训练稳定性方面的已知局限。DeepSeek V4不仅拥有强大的多模态处理能力,还针对国产芯片进行了深度优化,旨在成为完全依托国内计算基础设施的核心模型。
与此同时,姚顺宇的新模型MixFormer也计划于4月发布。自2025年12月起,姚顺宇担任腾讯执行委员会首席AI科学家,同时负责AI基础设施及大型语言模型部门。 2026年2月,他推出了CL-bench——一个专注于“上下文学习”的创新评估基准,该基准强调长上下文处理能力和智能体的可用性。据报道,姚顺宇的新模型参数规模约为30亿,其团队从一开始就将实际应用置于单纯的参数规模竞赛之上。
这两款模型即将发布的消息已引发市场广泛关注,凸显了中国在人工智能领域加速发展的态势。无论是DeepSeek V4在长时记忆方面的突破,还是腾讯MixFormer模型在实际任务评估中的改进,这两项成果从根本上都在探索未来大型模型如何更有效地融入生产环境。
DeepMind首席执行官哈西里斯:我每天睡六个小时,通常在凌晨1点左右感到精力充沛。
Fortune 最近刊登了对谷歌 DeepMind 首席执行官 Demis Hassabis 的采访,揭示了他对休息和生产力的非传统方法。Hassabis 透露,他睡眠时间非常少,将清醒时间划分为两个不同的工作阶段。关于他的睡眠习惯,Hassabis 表示:“我目标睡六小时,但我的习惯非同寻常。我可以在白天有效运作。”他强调,睡眠少于六小时会对大脑健康产生负面影响。Hassabis 于 2010 年联合创立了 DeepMind(后被谷歌收购),并因其在蛋白质结构预测方面的开创性工作荣获 20
尽管营收未达预期,OpenAI与Anthropic仍在争夺市场份额
尽管近期有报道称OpenAI未达营收目标,给本周二的科技股带来压力,但私营人工智能实验室的投资者仍表现坚韧。经验丰富的投资者已确认,尽管媒体报道负面,他们仍不会减少投资。分析师认为当前的人工智能竞赛仍处于早期阶段,因此不会出现“赢家通吃”的局面。尽管高昂的计算成本给营收带来压力,但实验室可通过提高订阅费来提升盈利能力。行业格局正发生微妙变化与OpenAI不同,其竞争对手Anthropic获得了强有





首页






