Cursor 发布 Composer 2.5 编码模型,以极低成本与 GPT-5.5 和 Opus 4.7 抗衡
5月18日消息,Cursor今日正式发布了其自主研发的AI编程模型Composer2.5的重大升级版本。此举标志着AI编程领域的效率和性价比得到了进一步提升。
该模型基于Moonshot(Moonshot Dark Side)的开源Kimi K2.5检查点构建,训练任务规模大幅扩展,达到前代产品Composer2的25倍。 据悉,Cursor将85%的计算资源用于额外训练和强化学习(RL),从而在核心性能上实现了突破。

在 CursorBench3.1 测试中,Composer2.5 的表现与 Opus4.7 和 GPT-5.5 相当,但每项任务的成本不到 1 美元——而竞争对手的成本最高可达 11 美元。| 图片来源:Cursor
在权威基准测试中,Composer2.5 在 SWE-Bench Multilingual 测试中取得了 79.8% 的优异成绩,在 CursorBench v3.1 测试中达成了 63.2% 的准确率。 其整体性能现已完全能够与 Anthropic 的 Opus4.7 和 OpenAI 的 GPT-5.5 等顶级旗舰模型一较高下。
在保持顶级性能的同时,Composer2.5展现出极强的商业竞争力。其基础版本每百万输入和输出令牌的费用分别仅为0.50美元和2.50美元,单任务成本不到1美元,远低于竞争对手高达11美元的收费标准。 即使是定价分别为3.00美元和15.00美元的高性能快速版本,仍保持着绝对的价格优势。
目前,Composer 2.5 已在 Cursor 平台正式上线。 与此同时,更深层次的战略布局也已启动,Cursor 正与 SpaceX 和 xAI 深化合作。依托相当于 100 万颗 H100 芯片算力的 Colossus-2 集群,他们正从零开始推进更大规模后续模型的训练工作。
相关文章
距离在 TechCrunch Disrupt 2026 参展仅剩 5 天
时间所剩无几。请在截止日期——太平洋时间9月18日晚上11:59之前,抢先预订TechCrunch Disrupt 2026的展位。什么是 Disrupt?TechCrunch Disrupt 2026 定于 10 月 13 日至 15 日在旧金山莫斯康西会展中心举行,届时将汇聚超过 10,000 名创始人、投资者、行业从业者及科技领袖,为期三天的活动将聚焦初创企业建设、融资、人脉拓展、产品发掘及
CodeBuddy 和 WorkBuddy 将 Hy3 模型的免费试用期延长至 8 月 31 日
CodeBuddy 和 WorkBuddy 提供的 Hy3 模型限时免费试用期已延长至 2026 年 8 月 31 日。鉴于用户反响热烈,该平台决定继续提供免费访问权限,让更多用户有机会探索该模型的功能。Hy3 目前是一款以文本为中心的大型语言模型,不具备多模态能力。如果您尝试通过 CodeBuddy 或 WorkBuddy 生成视频或图像,系统将自动将您的请求转发至相应的多模态模型,并按标准积分
同益实验室发布搭载正交解耦技术的Qwen3.7-Max,在多项国内基准测试中名列前茅
同益实验室正式发布了新一代AI代理基础模型Qwen3.7-Max,该模型在多项权威基准测试中名列前茅,并解决了智能代理在长链生产环境中易受干扰和不稳定等关键行业挑战。在针对未知硬件平台ZW-M890L PPU进行的严格压力测试中,该模型展现了强大的长期战略连贯性,并通过运行时反馈实现了上下文内泛化能力。 该模型在1,158次工具调用下持续运行35小时未中断,成功执行了深度自主推理,并在各类工作负载
相关专题推荐
评论 (0)
0/500
5月18日消息,Cursor今日正式发布了其自主研发的AI编程模型Composer2.5的重大升级版本。此举标志着AI编程领域的效率和性价比得到了进一步提升。
该模型基于Moonshot(Moonshot Dark Side)的开源Kimi K2.5检查点构建,训练任务规模大幅扩展,达到前代产品Composer2的25倍。 据悉,Cursor将85%的计算资源用于额外训练和强化学习(RL),从而在核心性能上实现了突破。

在 CursorBench3.1 测试中,Composer2.5 的表现与 Opus4.7 和 GPT-5.5 相当,但每项任务的成本不到 1 美元——而竞争对手的成本最高可达 11 美元。| 图片来源:Cursor
在权威基准测试中,Composer2.5 在 SWE-Bench Multilingual 测试中取得了 79.8% 的优异成绩,在 CursorBench v3.1 测试中达成了 63.2% 的准确率。 其整体性能现已完全能够与 Anthropic 的 Opus4.7 和 OpenAI 的 GPT-5.5 等顶级旗舰模型一较高下。
在保持顶级性能的同时,Composer2.5展现出极强的商业竞争力。其基础版本每百万输入和输出令牌的费用分别仅为0.50美元和2.50美元,单任务成本不到1美元,远低于竞争对手高达11美元的收费标准。 即使是定价分别为3.00美元和15.00美元的高性能快速版本,仍保持着绝对的价格优势。
目前,Composer 2.5 已在 Cursor 平台正式上线。 与此同时,更深层次的战略布局也已启动,Cursor 正与 SpaceX 和 xAI 深化合作。依托相当于 100 万颗 H100 芯片算力的 Colossus-2 集群,他们正从零开始推进更大规模后续模型的训练工作。
距离在 TechCrunch Disrupt 2026 参展仅剩 5 天
时间所剩无几。请在截止日期——太平洋时间9月18日晚上11:59之前,抢先预订TechCrunch Disrupt 2026的展位。什么是 Disrupt?TechCrunch Disrupt 2026 定于 10 月 13 日至 15 日在旧金山莫斯康西会展中心举行,届时将汇聚超过 10,000 名创始人、投资者、行业从业者及科技领袖,为期三天的活动将聚焦初创企业建设、融资、人脉拓展、产品发掘及
CodeBuddy 和 WorkBuddy 将 Hy3 模型的免费试用期延长至 8 月 31 日
CodeBuddy 和 WorkBuddy 提供的 Hy3 模型限时免费试用期已延长至 2026 年 8 月 31 日。鉴于用户反响热烈,该平台决定继续提供免费访问权限,让更多用户有机会探索该模型的功能。Hy3 目前是一款以文本为中心的大型语言模型,不具备多模态能力。如果您尝试通过 CodeBuddy 或 WorkBuddy 生成视频或图像,系统将自动将您的请求转发至相应的多模态模型,并按标准积分
同益实验室发布搭载正交解耦技术的Qwen3.7-Max,在多项国内基准测试中名列前茅
同益实验室正式发布了新一代AI代理基础模型Qwen3.7-Max,该模型在多项权威基准测试中名列前茅,并解决了智能代理在长链生产环境中易受干扰和不稳定等关键行业挑战。在针对未知硬件平台ZW-M890L PPU进行的严格压力测试中,该模型展现了强大的长期战略连贯性,并通过运行时反馈实现了上下文内泛化能力。 该模型在1,158次工具调用下持续运行35小时未中断,成功执行了深度自主推理,并在各类工作负载





首页






