Moonshot AI 推出 Kimi K2.6,在多项指标上超越全球顶尖的大型语言模型
国内大型模型领域正迎来重大更新。 4月21日,Moonshot AI正式发布了其最新旗舰模型Kimi K2.6并将其开源。该模型在编程、长距离任务处理以及多智能体协作方面实现了显著提升,目前已通过官方网站、APP、API以及Kimi Code编程助手向公众开放。
在多个衡量大型模型综合性能的权威基准测试中,Kimi K2.6均展现出强大的竞争力。 无论是难度极高的“人类最后一考”(常被称为“人类的期末考试”),还是评估真实世界软件工程技能的 SWE-Bench Pro,其成绩均跻身行业顶尖行列。 监测数据显示,K2.6 可与 GPT-5.4 和 Claude Opus4.6 等国际领先的闭源模型一较高下。

作为该系列迄今为止最强大的编程模型,K2.6 在长周期编程任务中展现出了惊人的持久力。 在实际测试中,它可不间断地持续编写代码长达13小时,单次任务即可编写或修改超过4,000行代码,非常适合开发和迭代复杂系统。 得益于视觉与编程能力的深度融合,该模型还能独立交付设计专业的 Web 应用程序。内部评估数据显示,其编程能力较上一代提升了约 20%。

值得注意的是,K2.6展现了出色的本地化泛化能力。通过Zig语言对推理过程进行优化,Kimi K2.6现已支持在Mac设备上本地部署。 在长达12小时的连续运行测试中,其吞吐量从初始的15个令牌/秒提升至193个令牌/秒,推理效率比行业标准工具LM Studio高出约20%,显著降低了开发者使用高性能模型的门槛。
相关文章
科大讯飞发布讯飞星火大模型 V2.5
9月1日,科大讯飞将开源两款面向边缘场景的大语言模型——星火X2.5-4B和星火X2.5-1.7B,据最新官方公告。这两款模型原生支持高达100万token的上下文窗口。它们在智能体交互、数学推理和通用理解等关键领域实现了显著提升,为车载系统、智能设备和物联网生态等边缘应用提供了强有力的支持。在上述边缘模型发布后,科大讯飞计划于9月7日推出拥有2930亿参数的星火X2.5基础模型。该版本将进一步推进代码生成和多智能体协作等核心技术。在公司2026年年中简报会上宣布,一款完全基于国产算力基础设施
Meta 在用户强烈反对后取消了 AI 照片编辑功能
Meta,这家社交媒体巨头,再次卷入关于人工智能与用户隐私之间微妙平衡的公开辩论。据 TechCrunch 报道,Meta 的 Superintelligence Labs 本周早些时候推出了一款新的 AI 图像生成器 Muse Image。然而,一个备受好评的关键功能——允许用户通过“@”符号标记来修改和生成来自公开 Instagram 账户的图像——由于缺乏适当的通知机制,立即引发了用户以及 CAA 等机构的强烈反对。面对强烈的批评,Meta 迅速撤销了该决定,并于周五通过博客文章宣布将
DeepMind首席执行官哈西里斯:我每天睡六个小时,通常在凌晨1点左右感到精力充沛。
Fortune 最近刊登了对谷歌 DeepMind 首席执行官 Demis Hassabis 的采访,揭示了他对休息和生产力的非传统方法。Hassabis 透露,他睡眠时间非常少,将清醒时间划分为两个不同的工作阶段。关于他的睡眠习惯,Hassabis 表示:“我目标睡六小时,但我的习惯非同寻常。我可以在白天有效运作。”他强调,睡眠少于六小时会对大脑健康产生负面影响。Hassabis 于 2010 年联合创立了 DeepMind(后被谷歌收购),并因其在蛋白质结构预测方面的开创性工作荣获 20
相关专题推荐
评论 (1)
0/500
国内大型模型领域正迎来重大更新。 4月21日,Moonshot AI正式发布了其最新旗舰模型Kimi K2.6并将其开源。该模型在编程、长距离任务处理以及多智能体协作方面实现了显著提升,目前已通过官方网站、APP、API以及Kimi Code编程助手向公众开放。
在多个衡量大型模型综合性能的权威基准测试中,Kimi K2.6均展现出强大的竞争力。 无论是难度极高的“人类最后一考”(常被称为“人类的期末考试”),还是评估真实世界软件工程技能的 SWE-Bench Pro,其成绩均跻身行业顶尖行列。 监测数据显示,K2.6 可与 GPT-5.4 和 Claude Opus4.6 等国际领先的闭源模型一较高下。

作为该系列迄今为止最强大的编程模型,K2.6 在长周期编程任务中展现出了惊人的持久力。 在实际测试中,它可不间断地持续编写代码长达13小时,单次任务即可编写或修改超过4,000行代码,非常适合开发和迭代复杂系统。 得益于视觉与编程能力的深度融合,该模型还能独立交付设计专业的 Web 应用程序。内部评估数据显示,其编程能力较上一代提升了约 20%。

值得注意的是,K2.6展现了出色的本地化泛化能力。通过Zig语言对推理过程进行优化,Kimi K2.6现已支持在Mac设备上本地部署。 在长达12小时的连续运行测试中,其吞吐量从初始的15个令牌/秒提升至193个令牌/秒,推理效率比行业标准工具LM Studio高出约20%,显著降低了开发者使用高性能模型的门槛。
科大讯飞发布讯飞星火大模型 V2.5
9月1日,科大讯飞将开源两款面向边缘场景的大语言模型——星火X2.5-4B和星火X2.5-1.7B,据最新官方公告。这两款模型原生支持高达100万token的上下文窗口。它们在智能体交互、数学推理和通用理解等关键领域实现了显著提升,为车载系统、智能设备和物联网生态等边缘应用提供了强有力的支持。在上述边缘模型发布后,科大讯飞计划于9月7日推出拥有2930亿参数的星火X2.5基础模型。该版本将进一步推进代码生成和多智能体协作等核心技术。在公司2026年年中简报会上宣布,一款完全基于国产算力基础设施
Meta 在用户强烈反对后取消了 AI 照片编辑功能
Meta,这家社交媒体巨头,再次卷入关于人工智能与用户隐私之间微妙平衡的公开辩论。据 TechCrunch 报道,Meta 的 Superintelligence Labs 本周早些时候推出了一款新的 AI 图像生成器 Muse Image。然而,一个备受好评的关键功能——允许用户通过“@”符号标记来修改和生成来自公开 Instagram 账户的图像——由于缺乏适当的通知机制,立即引发了用户以及 CAA 等机构的强烈反对。面对强烈的批评,Meta 迅速撤销了该决定,并于周五通过博客文章宣布将
DeepMind首席执行官哈西里斯:我每天睡六个小时,通常在凌晨1点左右感到精力充沛。
Fortune 最近刊登了对谷歌 DeepMind 首席执行官 Demis Hassabis 的采访,揭示了他对休息和生产力的非传统方法。Hassabis 透露,他睡眠时间非常少,将清醒时间划分为两个不同的工作阶段。关于他的睡眠习惯,Hassabis 表示:“我目标睡六小时,但我的习惯非同寻常。我可以在白天有效运作。”他强调,睡眠少于六小时会对大脑健康产生负面影响。Hassabis 于 2010 年联合创立了 DeepMind(后被谷歌收购),并因其在蛋白质结构预测方面的开创性工作荣获 20





首页






