Anthropic 推出 Opus 4.8,搭載全新的動態工作流程工具

Anthropic 於週四正式推出 Opus 4.8,這是其旗艦級公開模型的最新版本。此版本定價與前一版本相同,現已於所有平台上線。
距離 Opus 4.7 發布僅隔 41 天,Anthropic 顯著加快了開發週期,遠快於近期 Sonnet 和 Haiku 版本所見的三個月及七個月間隔。此次快速更新很可能是為了回應 Opus 4.7 所獲得的冷淡反響,該版本曾讓許多使用者感到失望。
與此同時,OpenAI 的 Codex 和 Google 的 Gemini Flash 皆推出了重大更新,這使得 Anthropic 面臨更強烈的競爭壓力,必須維持其技術優勢。
儘管 Opus 4.8 展現了頂級的基準測試表現,但它特別著重於處理模稜兩可或有缺陷的資料。早期測試者指出,該模型現在更傾向於標示不確定性,且較少做出缺乏依據的斷言。
Bridgewater Associates 對此表示認同,並特別強調該模型能主動標記輸入與輸出的異常情況——這項功能往往被其他系統忽略,通常需由使用者自行判斷。
隨著模型的推出,Anthropic 同時推出了「動態工作流程」(Dynamic Workflows),目前處於研究預覽階段。此功能使 Opus 等大型模型能夠協調數百個並行子代理執行複雜任務。
根據公告,將 Claude Code 與 Opus 4.8 結合使用,可實現涵蓋數十萬行程式的代碼庫級遷移,並透過現有測試套件從啟動到合併的整個過程進行驗證。
鑑於上個月預覽期間引發的網路安全疑慮,Anthropic 目前仍暫不釋出其先進的 Mythos 模型。不過,該公司表示,一旦實施適當的防護措施,Mythos 的預覽階段可能會很快結束。
「我們正在加速開發安全防護措施,並預期將在未來幾週內向所有客戶部署 Mythos 級別的模型,」該公司表示。
相關文章
Frontier AI Labs 拒絕透露針對失控模型的管控策略
近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr
Anthropic 推出 Fable:一款更實惠、限制更少的 AI 模型
Anthropic 於週二推出了 Fable 和 Mythos 5.1,提供了其最新 AI 技術的配對迭代版本。除了效能提升外,更新後的 Fable 版本還減少了令牌使用量,並收緊了安全過濾器,以最大限度地減少誤報限制。與其前身一樣,Mythos 5.1 僅限於專注於網路安全或生命科學的已驗證 Anthropic 合作伙伴。不受限制的 Fable 5.1 現在可透過雲平臺以及 Anthropic API 訪問。一項關鍵更新是採用了零資料保留策略,使客戶能夠在不洩露資料的情況下,將 Anthr
馬克·扎克伯格真的相信人工智慧是面向每個人的嗎?
正在載入播放器…Meta 本週推出了 Glimmer,這是一個開源權重的 AI 模型,任何人都可以下載並在個人硬體上執行——這與該公司更強大的模型 Muse Spark 形成了鮮明對比,後者仍鎖定在其自有 API 之後。此次釋出伴隨著馬克·扎克伯格(Mark Zuckerberg)的一封公開信,他在信中主張人工智慧應向所有人開放,而非由少數幾家實驗室控制。但正如 Equity 節目主持人所指出的那樣,這一願景附帶了幾個重要的限制條件。在本期 TechCrunch 的 Equity 播客中,K
相關專題推薦
評論 (0)
0/500

Anthropic 於週四正式推出 Opus 4.8,這是其旗艦級公開模型的最新版本。此版本定價與前一版本相同,現已於所有平台上線。
距離 Opus 4.7 發布僅隔 41 天,Anthropic 顯著加快了開發週期,遠快於近期 Sonnet 和 Haiku 版本所見的三個月及七個月間隔。此次快速更新很可能是為了回應 Opus 4.7 所獲得的冷淡反響,該版本曾讓許多使用者感到失望。
與此同時,OpenAI 的 Codex 和 Google 的 Gemini Flash 皆推出了重大更新,這使得 Anthropic 面臨更強烈的競爭壓力,必須維持其技術優勢。
儘管 Opus 4.8 展現了頂級的基準測試表現,但它特別著重於處理模稜兩可或有缺陷的資料。早期測試者指出,該模型現在更傾向於標示不確定性,且較少做出缺乏依據的斷言。
Bridgewater Associates 對此表示認同,並特別強調該模型能主動標記輸入與輸出的異常情況——這項功能往往被其他系統忽略,通常需由使用者自行判斷。
隨著模型的推出,Anthropic 同時推出了「動態工作流程」(Dynamic Workflows),目前處於研究預覽階段。此功能使 Opus 等大型模型能夠協調數百個並行子代理執行複雜任務。
根據公告,將 Claude Code 與 Opus 4.8 結合使用,可實現涵蓋數十萬行程式的代碼庫級遷移,並透過現有測試套件從啟動到合併的整個過程進行驗證。
鑑於上個月預覽期間引發的網路安全疑慮,Anthropic 目前仍暫不釋出其先進的 Mythos 模型。不過,該公司表示,一旦實施適當的防護措施,Mythos 的預覽階段可能會很快結束。
「我們正在加速開發安全防護措施,並預期將在未來幾週內向所有客戶部署 Mythos 級別的模型,」該公司表示。
Frontier AI Labs 拒絕透露針對失控模型的管控策略
近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr
Anthropic 推出 Fable:一款更實惠、限制更少的 AI 模型
Anthropic 於週二推出了 Fable 和 Mythos 5.1,提供了其最新 AI 技術的配對迭代版本。除了效能提升外,更新後的 Fable 版本還減少了令牌使用量,並收緊了安全過濾器,以最大限度地減少誤報限制。與其前身一樣,Mythos 5.1 僅限於專注於網路安全或生命科學的已驗證 Anthropic 合作伙伴。不受限制的 Fable 5.1 現在可透過雲平臺以及 Anthropic API 訪問。一項關鍵更新是採用了零資料保留策略,使客戶能夠在不洩露資料的情況下,將 Anthr
馬克·扎克伯格真的相信人工智慧是面向每個人的嗎?
正在載入播放器…Meta 本週推出了 Glimmer,這是一個開源權重的 AI 模型,任何人都可以下載並在個人硬體上執行——這與該公司更強大的模型 Muse Spark 形成了鮮明對比,後者仍鎖定在其自有 API 之後。此次釋出伴隨著馬克·扎克伯格(Mark Zuckerberg)的一封公開信,他在信中主張人工智慧應向所有人開放,而非由少數幾家實驗室控制。但正如 Equity 節目主持人所指出的那樣,這一願景附帶了幾個重要的限制條件。在本期 TechCrunch 的 Equity 播客中,K





首頁






