Cursor 推出 Composer 2.5 編碼模型,以極低成本與 GPT-5.5 及 Opus 4.7 一較高下
5月18日消息,Cursor 今日正式發布其自主研發的 AI 程式設計模型——Composer 2.5 的重大升級版本。此舉標誌著 AI 程式設計領域在效率與成本效益方面獲得進一步提升。
該模型基於 Moonshot(Moonshot Dark Side)的開源 Kimi K2.5 檢查點構建,訓練任務規模大幅擴展,達到前代產品 Composer2 的 25 倍。 據報導,Cursor 已將 85% 的運算資源投入額外訓練與強化學習(RL),從而實現了核心性能的突破。

在 CursorBench3.1 測試中,Composer2.5 的表現與 Opus4.7 及 GPT-5.5 相當,但每項任務的成本不到 1 美元——相較之下,競爭對手的成本最高可達 11 美元。| 圖片來源:Cursor
在權威的基準測試中,Composer2.5 於 SWE-Bench Multilingual 取得 79.8% 的優異成績,並在 CursorBench v3.1 上達到 63.2% 的準確率。 其整體表現現已完全具備與 Anthropic 的 Opus4.7 及 OpenAI 的 GPT-5.5 等頂級旗艦模型一較高下的實力。
在維持頂級性能的同時,Composer2.5 展現出極高的商業競爭力。其基礎版本每百萬輸入與輸出代幣的費用分別僅為 0.50 美元和 2.50 美元,單一任務成本低於 1 美元,遠低於競爭對手高達 11 美元的收費標準。 即使是定價分別為 3.00 美元和 15.00 美元的高效能快速版本,仍保持著絕對的價格優勢。
目前,Composer 2.5 已在 Cursor 平台正式上線。 與此同時,更深層的戰略佈局也已展開,Cursor 正深化與 SpaceX 及 xAI 的合作。憑藉相當於一百萬顆 H100 晶片運算能力的 Colossus-2 叢集,他們正從頭著手推進後續更大規模模型的訓練工作。
相關文章
距離 TechCrunch Disrupt 2026 參展截止日僅剩 5 天
時間所剩無幾。請在截止日期前(太平洋時間 9 月 18 日晚上 11:59)預訂 TechCrunch Disrupt 2026 的展覽攤位。什麼是 Disrupt?TechCrunch Disrupt 2026 預計於 10 月 13 日至 15 日在舊金山的莫斯康西展館(Moscone West)舉行,為期三天,將匯聚超過 10,000 名創辦人、投資人、業界從業者及科技領袖,聚焦於創業、募資
CodeBuddy 與 WorkBuddy 將 Hy3 模型的免費試用期延長至 8 月 31 日
由 CodeBuddy 和 WorkBuddy 提供的 Hy3 模型限時免費試用期已延長至 2026 年 8 月 31 日。鑑於用戶反應熱烈,該平台決定維持免費使用,讓更多用戶有機會探索該模型的功能。Hy3 目前是一款以文字為主的大型語言模型,不具備多模態功能。若您嘗試透過 CodeBuddy 或 WorkBuddy 生成影片或圖片,系統將自動將您的請求轉送至適當的多模態模型,並適用標準的點數消耗
同益實驗室推出搭載正交解耦技術的 Qwen3.7-Max,在多項國內基準測試中名列前茅
同益實驗室正式推出新一代 AI 代理基礎模型「Qwen3.7-Max」,該模型在多項權威基準測試中名列前茅,並解決了智慧代理在長鏈生產環境中面臨的脆弱性與不穩定性等關鍵產業挑戰。在針對未知硬體平台 ZW-M890L PPU 進行的嚴苛壓力測試中,該模型展現了強健的長期策略一致性,並透過執行時回饋實現了情境內泛化能力。 該模型在 35 小時內持續不間斷運作,共執行 1,158 次工具調用,不僅成功實
相關專題推薦
評論 (0)
0/500
5月18日消息,Cursor 今日正式發布其自主研發的 AI 程式設計模型——Composer 2.5 的重大升級版本。此舉標誌著 AI 程式設計領域在效率與成本效益方面獲得進一步提升。
該模型基於 Moonshot(Moonshot Dark Side)的開源 Kimi K2.5 檢查點構建,訓練任務規模大幅擴展,達到前代產品 Composer2 的 25 倍。 據報導,Cursor 已將 85% 的運算資源投入額外訓練與強化學習(RL),從而實現了核心性能的突破。

在 CursorBench3.1 測試中,Composer2.5 的表現與 Opus4.7 及 GPT-5.5 相當,但每項任務的成本不到 1 美元——相較之下,競爭對手的成本最高可達 11 美元。| 圖片來源:Cursor
在權威的基準測試中,Composer2.5 於 SWE-Bench Multilingual 取得 79.8% 的優異成績,並在 CursorBench v3.1 上達到 63.2% 的準確率。 其整體表現現已完全具備與 Anthropic 的 Opus4.7 及 OpenAI 的 GPT-5.5 等頂級旗艦模型一較高下的實力。
在維持頂級性能的同時,Composer2.5 展現出極高的商業競爭力。其基礎版本每百萬輸入與輸出代幣的費用分別僅為 0.50 美元和 2.50 美元,單一任務成本低於 1 美元,遠低於競爭對手高達 11 美元的收費標準。 即使是定價分別為 3.00 美元和 15.00 美元的高效能快速版本,仍保持著絕對的價格優勢。
目前,Composer 2.5 已在 Cursor 平台正式上線。 與此同時,更深層的戰略佈局也已展開,Cursor 正深化與 SpaceX 及 xAI 的合作。憑藉相當於一百萬顆 H100 晶片運算能力的 Colossus-2 叢集,他們正從頭著手推進後續更大規模模型的訓練工作。
距離 TechCrunch Disrupt 2026 參展截止日僅剩 5 天
時間所剩無幾。請在截止日期前(太平洋時間 9 月 18 日晚上 11:59)預訂 TechCrunch Disrupt 2026 的展覽攤位。什麼是 Disrupt?TechCrunch Disrupt 2026 預計於 10 月 13 日至 15 日在舊金山的莫斯康西展館(Moscone West)舉行,為期三天,將匯聚超過 10,000 名創辦人、投資人、業界從業者及科技領袖,聚焦於創業、募資
CodeBuddy 與 WorkBuddy 將 Hy3 模型的免費試用期延長至 8 月 31 日
由 CodeBuddy 和 WorkBuddy 提供的 Hy3 模型限時免費試用期已延長至 2026 年 8 月 31 日。鑑於用戶反應熱烈,該平台決定維持免費使用,讓更多用戶有機會探索該模型的功能。Hy3 目前是一款以文字為主的大型語言模型,不具備多模態功能。若您嘗試透過 CodeBuddy 或 WorkBuddy 生成影片或圖片,系統將自動將您的請求轉送至適當的多模態模型,並適用標準的點數消耗
同益實驗室推出搭載正交解耦技術的 Qwen3.7-Max,在多項國內基準測試中名列前茅
同益實驗室正式推出新一代 AI 代理基礎模型「Qwen3.7-Max」,該模型在多項權威基準測試中名列前茅,並解決了智慧代理在長鏈生產環境中面臨的脆弱性與不穩定性等關鍵產業挑戰。在針對未知硬體平台 ZW-M890L PPU 進行的嚴苛壓力測試中,該模型展現了強健的長期策略一致性,並透過執行時回饋實現了情境內泛化能力。 該模型在 35 小時內持續不間斷運作,共執行 1,158 次工具調用,不僅成功實





首頁






