Cursor 推出 Composer 2.5,這款 AI 程式設計工具的表現可與 GPT-5.5 一較高下
人工智慧程式設計正經歷一場重大變革。 人工智慧程式編輯器開發商 Cursor 已正式推出其專有程式設計模型「Composer 2.5」的重大升級版本。此模型基於 Moonshot AI 的開源模型 Kimi K2.5 進行微調,其訓練過程所使用的合成任務數據量較前一版本增加了 25 倍。

為了充分發揮該模型的程式設計邏輯,Cursor 將 85% 的運算預算直接投入強化學習與延伸訓練。這項大膽的研究投資帶來了顯著的效能提升,使新模型在處理複雜編碼任務時,其能力已可媲美業界領先的模型。
高性價比挑戰業界巨頭
在 SWE-Bench 多語言測試和 CursorBench v3.1 等業界標準評測中,Composer 2.5 分別取得了 79.8% 和 63.2% 的優異成績。 此表現現已可與當前最強大的模型一較高下,包括 Anthropic Opus 4.7 和 OpenAI GPT-5.5。
儘管表現令人印象深刻,其運作成本卻依然極低。Composer 2.5 每百萬個輸入標記僅收取 0.50 美元,每百萬個輸出標記則收取 2.50 美元——這僅是大型模型領域競爭對手通常收費的一小部分。
兆級運算打造次世代強機
針對追求極致速度的開發者,Cursor 亦推出了更快速的變體版本。此版本在維持同等卓越效能的同時,將輸入與輸出標記的定價分別設定為每百萬 3.00 美元及 15.00 美元。
這項高性價比的 AI 程式設計服務現已於 Cursor 編輯器中全面開放,供使用者體驗。此外,Cursor 已與 SpaceX 及 xAI 合作,在配備數百萬個 H100 運算單元的 Colossus-2 叢集上,從零開始運用十倍的運算能力,訓練下一代顛覆性的繼任模型。
相關文章
GPT 5.5 領跑 AI 安全競賽,DeepSeek 在成本效益方面位居榜首
Kasra Rahjerdi,一名安全研究人員,最近釋出了一份重要報告,詳細闡述了對主要大型語言模型的安全推理能力進行的實際測試。他透過構建一個故意存在漏洞的書評應用程式實現了這一目標。在該場景中,模擬了現實世界中的漏洞,Rahjerdi 在應用程式檔案中嵌入了 Google 移動後端服務的憑據。這些模型的任務是解壓並識別這些憑據,從而直接訪問資料庫。頂級模型對比在嚴格的兩小時時間限制和 10 美元預算約束下,各模型的表現水平各不相同。GPT-5.5 成為表現最強的模型,成功完成了 10 次嘗試
馬斯克表示,SpaceX 的人工智慧可能在半年內超越 Anthropic
SpaceXAI 執行長伊隆·馬斯克預測,該公司將在六個月內在人工智慧領域取得主導地位,並將利用運算硬體來縮小與競爭對手的差距。SpaceXAI 執行長伊隆·馬斯克近日在 X 平台上表示,他的公司目標是在約六個月內引領前沿人工智慧領域。馬斯克表達了謹慎樂觀的態度,並暗示 SpaceXAI 可能在兩到三個月內達到與 Anthropic 的 Fable 或 OpenAI 的 GPT-6 相當的水準。S
WeRide 推出 WITT,一款實體 AI 大型模型
自動駕駛技術正以驚人的速度發展。7月17日,領先的自動駕駛公司 WeRide 正式發表了其自主研發的物理人工智慧認知基礎模型「WeRide WITT」。此次發布標誌著人工智慧在理解與處理複雜的真實世界資料能力方面,邁出了重要的一步。WeRide WITT 的核心概念在於「最小物理事實單位」。 該框架旨在協助人工智慧解讀多模態輸入(例如影片、圖像和文字),將動態的真實世界情境分解為核心事實元素。透過
相關專題推薦
評論 (0)
0/500
人工智慧程式設計正經歷一場重大變革。 人工智慧程式編輯器開發商 Cursor 已正式推出其專有程式設計模型「Composer 2.5」的重大升級版本。此模型基於 Moonshot AI 的開源模型 Kimi K2.5 進行微調,其訓練過程所使用的合成任務數據量較前一版本增加了 25 倍。

為了充分發揮該模型的程式設計邏輯,Cursor 將 85% 的運算預算直接投入強化學習與延伸訓練。這項大膽的研究投資帶來了顯著的效能提升,使新模型在處理複雜編碼任務時,其能力已可媲美業界領先的模型。
高性價比挑戰業界巨頭
在 SWE-Bench 多語言測試和 CursorBench v3.1 等業界標準評測中,Composer 2.5 分別取得了 79.8% 和 63.2% 的優異成績。 此表現現已可與當前最強大的模型一較高下,包括 Anthropic Opus 4.7 和 OpenAI GPT-5.5。
儘管表現令人印象深刻,其運作成本卻依然極低。Composer 2.5 每百萬個輸入標記僅收取 0.50 美元,每百萬個輸出標記則收取 2.50 美元——這僅是大型模型領域競爭對手通常收費的一小部分。
兆級運算打造次世代強機
針對追求極致速度的開發者,Cursor 亦推出了更快速的變體版本。此版本在維持同等卓越效能的同時,將輸入與輸出標記的定價分別設定為每百萬 3.00 美元及 15.00 美元。
這項高性價比的 AI 程式設計服務現已於 Cursor 編輯器中全面開放,供使用者體驗。此外,Cursor 已與 SpaceX 及 xAI 合作,在配備數百萬個 H100 運算單元的 Colossus-2 叢集上,從零開始運用十倍的運算能力,訓練下一代顛覆性的繼任模型。
GPT 5.5 領跑 AI 安全競賽,DeepSeek 在成本效益方面位居榜首
Kasra Rahjerdi,一名安全研究人員,最近釋出了一份重要報告,詳細闡述了對主要大型語言模型的安全推理能力進行的實際測試。他透過構建一個故意存在漏洞的書評應用程式實現了這一目標。在該場景中,模擬了現實世界中的漏洞,Rahjerdi 在應用程式檔案中嵌入了 Google 移動後端服務的憑據。這些模型的任務是解壓並識別這些憑據,從而直接訪問資料庫。頂級模型對比在嚴格的兩小時時間限制和 10 美元預算約束下,各模型的表現水平各不相同。GPT-5.5 成為表現最強的模型,成功完成了 10 次嘗試
馬斯克表示,SpaceX 的人工智慧可能在半年內超越 Anthropic
SpaceXAI 執行長伊隆·馬斯克預測,該公司將在六個月內在人工智慧領域取得主導地位,並將利用運算硬體來縮小與競爭對手的差距。SpaceXAI 執行長伊隆·馬斯克近日在 X 平台上表示,他的公司目標是在約六個月內引領前沿人工智慧領域。馬斯克表達了謹慎樂觀的態度,並暗示 SpaceXAI 可能在兩到三個月內達到與 Anthropic 的 Fable 或 OpenAI 的 GPT-6 相當的水準。S
WeRide 推出 WITT,一款實體 AI 大型模型
自動駕駛技術正以驚人的速度發展。7月17日,領先的自動駕駛公司 WeRide 正式發表了其自主研發的物理人工智慧認知基礎模型「WeRide WITT」。此次發布標誌著人工智慧在理解與處理複雜的真實世界資料能力方面,邁出了重要的一步。WeRide WITT 的核心概念在於「最小物理事實單位」。 該框架旨在協助人工智慧解讀多模態輸入(例如影片、圖像和文字),將動態的真實世界情境分解為核心事實元素。透過





首頁






