Anthropic 的 Sonnet 5.5 洩露:200 萬代幣的上下文挑戰促使 DeepSeek 重拾成本效益
Anthropic 已揭曉其最新的 Sonnet 5.5 模型,內部代號為「Fennec」(取自沙漠狐之名),預計將於下個月正式發布。 外流的細節顯示,該模型支援 200 萬個標記的上下文視窗,能提供更快的推理速度、更低的延遲,並顯著提升長上下文推理與多步驟規劃能力。此外,其針對瀏覽器和終端的工具調用能力亦有所提升。 儘管其性能可與旗艦級模型 Claude Fable 5 媲美,但定價仍將維持在 Sonnet 級別,使其成為性價比方面的新領導者。

Sonnet 5 目前支援 100 萬個標記的上下文視窗,Anthropic 表示這既是預設值,也是上限。將此數值倍增至 200 萬個標記,將直接惠及管理大型程式碼庫和龐大文件的開發者。 作為 Anthropic 專注於代理能力(包含規劃、瀏覽器及終端機工具使用)的核心模型,工具互動能力的進一步提升有望推動生產力實現顯著飛躍。目前開發已進入最後階段,Sonnet 5.5 將以 DeepSeek V4 Flash 為目標,致力於在主流與進階模型之間,開拓具競爭力的性價比利基市場。
透過成本效益重新定義大型模型競爭
大型語言模型之間的競爭焦點已從基準測試分數轉向實際價值:即用戶能以同等成本獲得多少智慧能力。隨著 DeepSeek V4 Flash 以超低定價顛覆市場,海外主要企業正面臨壓力。 Anthropic 推出的 Sonnet 5.5 正是直接回應了這一趨勢。若外流資訊屬實,以 Sonnet 的價格點提供接近 Fable 5 的推理能力,將使 Claude 具備強大的性價比優勢。
值得注意的是,Anthropic 最具成本效益的 Haiku 系列已約一年未更新,市場關注點也已大幅轉移。 加上 OpenAI 在其 Luna 小型模型上表現強勁,分析師認為 Anthropic 可能會讓 Sonnet 以增強的功能接替 Haiku 在中端市場的定位。若成功,此策略將能壓縮 DeepSeek 的定價優勢,並避免內部產品線之間的競爭。 然而,Anthropic 仍面臨挑戰,因為 DeepSeek 已建立起低價的市場預期,而 OpenAI 的 Luna 正迅速佔領輕量級應用場景。Sonnet 5.5 能否真正奪得性價比之冠,尚待下個月正式發布後方能見分曉。
相關文章
Google DeepMind 成立研究所以擴大關於通用人工智慧(AGI)的討論
Google和Google DeepMind於週三成立了DeepMind研究所,以促進關於通用人工智慧(AGI)的對話。該研究所由DeepMind聯合創始人Shane Legg、Google高管James Manyika以及Google DeepMind主席Demis Hassabis領導,其中Legg擔任執行編輯。這一新舉措旨在突出Google、DeepMind以及全球研究社羣內部關於AGI的多樣化觀點。公告指出,參與者“可能並不總是達成一致”,並且隨著這一快速演進的領域出現新資料,他們可能
Chrome 推出 Gemini 技能庫:一鍵重複使用提示語,告別重複輸入
Google 已為Chrome 桌面版推出更新,為其內建的 Gemini 功能新增了「技能庫」。這項功能強化讓使用者能將複雜的 AI 提示語儲存為可重複使用的「技能」,以便在各個網頁間無縫應用。核心突破:從「聊天框」到「工具箱」過去,使用者在使用 AI 時經常需要重新輸入背景資訊。「技能庫」從根本上改變了這種互動模式:自訂技能:使用者可將常見的 AI 任務(例如分析元件、比較規格、擷取摘要)儲存起
Anthropic 執行長力推銀行式 AI 規範,專家警告不宜身兼「球員」與「裁判」雙重角色
據 CNBC 報導,Anthropic 執行長達里奧·阿莫迪(Dario Amodei)建議在領先的人工智慧企業內部設置長期獨立的第三方安全評估人員,賦予他們近乎內部風險團隊的訪問權限,並授權其在有限制的情況下獨立公布評估結果。 他明確以嵌入式銀行監管機構為例,並承諾 Anthropic 將為第三方評估人員提供與內部風險團隊同等的系統存取權限。阿莫迪在上週末發表的一篇長文中還警告,在未來 6 至
相關專題推薦
評論 (0)
0/500
Anthropic 已揭曉其最新的 Sonnet 5.5 模型,內部代號為「Fennec」(取自沙漠狐之名),預計將於下個月正式發布。 外流的細節顯示,該模型支援 200 萬個標記的上下文視窗,能提供更快的推理速度、更低的延遲,並顯著提升長上下文推理與多步驟規劃能力。此外,其針對瀏覽器和終端的工具調用能力亦有所提升。 儘管其性能可與旗艦級模型 Claude Fable 5 媲美,但定價仍將維持在 Sonnet 級別,使其成為性價比方面的新領導者。

Sonnet 5 目前支援 100 萬個標記的上下文視窗,Anthropic 表示這既是預設值,也是上限。將此數值倍增至 200 萬個標記,將直接惠及管理大型程式碼庫和龐大文件的開發者。 作為 Anthropic 專注於代理能力(包含規劃、瀏覽器及終端機工具使用)的核心模型,工具互動能力的進一步提升有望推動生產力實現顯著飛躍。目前開發已進入最後階段,Sonnet 5.5 將以 DeepSeek V4 Flash 為目標,致力於在主流與進階模型之間,開拓具競爭力的性價比利基市場。
透過成本效益重新定義大型模型競爭
大型語言模型之間的競爭焦點已從基準測試分數轉向實際價值:即用戶能以同等成本獲得多少智慧能力。隨著 DeepSeek V4 Flash 以超低定價顛覆市場,海外主要企業正面臨壓力。 Anthropic 推出的 Sonnet 5.5 正是直接回應了這一趨勢。若外流資訊屬實,以 Sonnet 的價格點提供接近 Fable 5 的推理能力,將使 Claude 具備強大的性價比優勢。
值得注意的是,Anthropic 最具成本效益的 Haiku 系列已約一年未更新,市場關注點也已大幅轉移。 加上 OpenAI 在其 Luna 小型模型上表現強勁,分析師認為 Anthropic 可能會讓 Sonnet 以增強的功能接替 Haiku 在中端市場的定位。若成功,此策略將能壓縮 DeepSeek 的定價優勢,並避免內部產品線之間的競爭。 然而,Anthropic 仍面臨挑戰,因為 DeepSeek 已建立起低價的市場預期,而 OpenAI 的 Luna 正迅速佔領輕量級應用場景。Sonnet 5.5 能否真正奪得性價比之冠,尚待下個月正式發布後方能見分曉。
Google DeepMind 成立研究所以擴大關於通用人工智慧(AGI)的討論
Google和Google DeepMind於週三成立了DeepMind研究所,以促進關於通用人工智慧(AGI)的對話。該研究所由DeepMind聯合創始人Shane Legg、Google高管James Manyika以及Google DeepMind主席Demis Hassabis領導,其中Legg擔任執行編輯。這一新舉措旨在突出Google、DeepMind以及全球研究社羣內部關於AGI的多樣化觀點。公告指出,參與者“可能並不總是達成一致”,並且隨著這一快速演進的領域出現新資料,他們可能
Chrome 推出 Gemini 技能庫:一鍵重複使用提示語,告別重複輸入
Google 已為Chrome 桌面版推出更新,為其內建的 Gemini 功能新增了「技能庫」。這項功能強化讓使用者能將複雜的 AI 提示語儲存為可重複使用的「技能」,以便在各個網頁間無縫應用。核心突破:從「聊天框」到「工具箱」過去,使用者在使用 AI 時經常需要重新輸入背景資訊。「技能庫」從根本上改變了這種互動模式:自訂技能:使用者可將常見的 AI 任務(例如分析元件、比較規格、擷取摘要)儲存起
Anthropic 執行長力推銀行式 AI 規範,專家警告不宜身兼「球員」與「裁判」雙重角色
據 CNBC 報導,Anthropic 執行長達里奧·阿莫迪(Dario Amodei)建議在領先的人工智慧企業內部設置長期獨立的第三方安全評估人員,賦予他們近乎內部風險團隊的訪問權限,並授權其在有限制的情況下獨立公布評估結果。 他明確以嵌入式銀行監管機構為例,並承諾 Anthropic 將為第三方評估人員提供與內部風險團隊同等的系統存取權限。阿莫迪在上週末發表的一篇長文中還警告,在未來 6 至





首頁






