選項
首頁
新聞
深度認知發布開源AI模型,已名列前茅

深度認知發布開源AI模型,已名列前茅

2025-06-06
180

深度認知發布開源AI模型,已名列前茅

深度Cogito推出革命性AI模型

在一個突破性的舉動中,位於舊金山的尖端AI研究初創公司Deep Cogito正式推出了其首款開源大型語言模型(LLMs),命名為Cogito v1。這些模型基於Meta的Llama 3.2進行微調,擁有混合推理能力,能夠快速響應或進行內省思考——這一功能類似於OpenAI的“o”系列和DeepSeek R1。

Deep Cogito希望通過促進模型內的迭代自我改進,推動AI超越傳統的人類監督限制。他們的最終目標?開發超級智能——在所有領域超越人類能力的AI。然而,該公司保證所有模型將保持開源。

Deep Cogito的首席執行官兼聯合創始人Drishan Arora此前在Google擔任高級軟件工程師,領導Google生成式搜索產品的LLM開發。他在X上自信地表示,這些模型在其規模上是表現最強的開源模型,超越了LLaMA、DeepSeek和Qwen等競爭對手。

模型陣容

初始產品包括五種基礎規模——30億、80億、140億、320億和700億參數——現已可在Hugging Face、Ollama以及通過Fireworks和Together AI的API等平台訪問。這些模型遵循Llama許可條款,允許商業使用,每月最多支持7億用戶,超過此數量需從Meta獲得付費許可。

Deep Cogito計劃在不久的將來推出更大的模型,參數可能達到6710億。

訓練方法:迭代蒸餾與放大(IDA)

Arora介紹了IDA,這是一種不同於傳統強化學習(RLHF)或教師模型蒸餾的新方法。IDA專注於分配額外的計算資源來生成更優的解決方案,隨後將這種增強的推理嵌入模型本身——形成一個旨在提升能力的持續反饋循環。這種方法類似於Google AlphaGo的自對弈策略,適應於自然語言處理。

基準測試與評估

Deep Cogito展示了對Cogito模型與開源競爭對手的全面評估結果,涵蓋一般知識、數學推理和多語言任務等領域。主要發現包括:

  • Cogito 3B(標準版): 在MMLU上超越LLaMA 3.2 3B 6.7個百分點(65.4% vs. 58.7%),在Hellaswag上領先18.8個百分點(81.1% vs. 62.3%)。
  • Cogito 3B(推理模式): 在MMLU上得分72.6%,在ARC上得分84.2%。
  • Cogito 8B(標準版): 在MMLU上達到80.5%,比LLaMA 3.1 8B高12.8個百分點。
  • Cogito 8B(推理模式): 在MMLU上得分83.1%,在ARC上得分92.0%。
  • Cogito 70B(標準版): 在MMLU上領先LLaMA 3.3 70B 6.4個百分點(91.7% vs. 85.3%),並在總體基準測試中超越LLaMA 4 Scout 109B(54.5% vs. 53.3%)。

雖然Cogito模型在推理模式下表現出色,但在數學任務中存在一些權衡。

原生工具調用

Deep Cogito還評估了其模型的原生工具調用性能,這是代理和API集成系統的關鍵方面。

  • Cogito 3B: 支持四種工具調用任務,在簡單和多重工具調用中表現出色。
  • Cogito 8B: 在所有工具調用類型中表現強勁,顯著超越LLaMA 3.1 8B。

未來計劃

展望未來,Deep Cogito計劃推出更大的模型,包括1090億、4000億和6710億參數的專家混合變體,同時對現有檢查點進行持續更新。該公司將IDA視為實現可擴展自我改進的可持續途徑,減少對人類或靜態教師模型的依賴。

Arora強調,現實世界的實用性和適應性是成功的終極衡量標準,並表示這僅僅是一個充滿希望的旅程的開始。Deep Cogito與Hugging Face、RunPod、Fireworks AI、Together AI和Ollama等知名實體合作,確保所有模型保持開源且可自由訪問。

相關文章
華納音樂收購AI歸因初創公司Sureel AI 華納音樂收購AI歸因初創公司Sureel AI 華納音樂集團(WMG)於週三確認,其正在收購Sureel AI,一家專注於人工智慧歸因的初創公司。Sureel的專有技術為音樂曲目生成“AI DNA”,將其分解為各個組成部分,以追蹤人工智慧模型如何利用這些元素。透過此次收購,WMG旨在增強其監控其藝術家和詞曲創作者的作品在人工智慧生成內容中被使用或用於訓練人工智慧模型的能力。“將Sureel整合到WMG中,增強了我們的保護、控制和變現能力,確保創意社羣保留對其智慧財產權、姓名、肖像、形象和聲音的控制權,”WMG執行長Robert Kync
亞馬遜推出“Alexa for Shopping”,同時將Rufus邊緣化 亞馬遜推出“Alexa for Shopping”,同時將Rufus邊緣化 亞馬遜推出了“Alexa for Shopping”,將 Rufus 購物聊天機器人 Alexa+ 整合到應用程式、網站和 Echo Show 裝置中。該助手回答產品查詢、比較商品、跟蹤價格,並支援購物提醒。它還處理計劃中的購物操作和符合條件的自動購買。據該公司稱,“Alexa for Shopping”將 Rufus 的產品專業知識與 Alexa+ 的個性化助手上下文相結合。亞馬遜表示,Rufus 在 2025 年協助了超過 3 億客戶進行產品研究、比較和購買。GeekWire 報道稱,
微軟、Azure 與 AI 技術共同對抗加州野火風險 微軟、Azure 與 AI 技術共同對抗加州野火風險 微軟投資於人工智慧驅動的野火偵測技術,其首席副總裁暨首席數據科學家胡安·拉維斯塔·費雷斯(Juan Lavista Ferres)針對減輕環境損害的策略進行了探討。根據美國國家航空暨太空總署(NASA)指出,氣候變遷影響地球上的每個人,其表現為氣溫上升、降雨模式改變以及海平面上升。NASA 指出,有確鑿證據顯示地球正以前所未有的速度變暖,而人類活動是主要驅動因素。隨著全球氣溫上升,野火構成的威脅日
相關專題推薦
視頻創作 適用於 Reels、Shorts 及產品上市活動的 AI 短影片吸睛開場生成器
適用於 Reels、Shorts 及產品上市活動的 AI 短影片吸睛開場生成器

2026 年最新最佳 AI 短影片開場白生成器,適用於 Reels、Shorts 及產品上市活動!XIX.AI 嚴選備受好評、功能強大且能顛覆遊戲規則的工具,這些工具皆經過實際測試,能帶來絕對值得一試的成果。本頁面每週更新,提供免費與付費版本的比較排行榜,助您找到提升內容創意與生產力的完美解決方案。 立即探索,釋放您的 AI 競爭優勢!

11 個工具
xix.ai
寫作 適用於長篇寫作的 AI 文章大綱工具
適用於長篇寫作的 AI 文章大綱工具

2026 年最新、最受好評的長文寫作 AI 大綱工具!這份精選清單收錄了強大且具顛覆性的工具,能透過實際測試生成精準、結構化的大綱,大幅提升寫作效率。XIX.AI 正是這份菁英名單中的一員。 獲取免費版與付費版的比較指南,助您挑選最合適的工具。立即探索,釋放您的 AI 優勢!

9 個工具
xix.ai
聊天機器人 用於語言練習、面試準備和日常流利度的最佳 AI 角色扮演聊天應用
用於語言練習、面試準備和日常流利度的最佳 AI 角色扮演聊天應用

2026 年最新最佳頂級評分 AI 角色扮演聊天應用,用於語言練習、面試準備和日常流利度!XIX.AI 精心策劃了一個強大的變革性合集,提供免費與付費對比、真實世界測試以及每週更新的排名。這些必試工具可幫助您提升寫作技能,克服流利度挑戰,並提高所有日常場景下的溝通效率。立即探索,發現您語言成長的完美工具!

10 個工具
xix.ai
音樂創作 用於混音製作、取樣準備及卡拉OK母帶處理的 AI 聲部分離工具
用於混音製作、取樣準備及卡拉OK母帶處理的 AI 聲部分離工具

2026年最新、最優秀且評分最高的AI音軌分離工具彙總,專為混音製作、取樣準備以及卡拉OK音訊處理而設計。這些功能強大的創新工具經過實際測試,能夠實現精準的音訊分離,顯著提升工作效率。XIX.AI每週都會更新免費的付費產品對比指南,幫助您找到最適合自身需求的工具。立即探索,發揮您的AI優勢。

8 個工具
xix.ai
數據分析 用於收入看板、轉化漏斗分析及產品指標分析的 AI SQL 助手
用於收入看板、轉化漏斗分析及產品指標分析的 AI SQL 助手

2026年最新最優秀的AI SQL輔助工具排名揭曉!XIX.AI精心挑選了一系列功能強大的工具,這些工具會定期更新,並透過真實的場景測試來驗證其效能。使用這些值得嘗試的工具,您可以快速生成精準的收入分析報表、分析銷售流程,並追蹤產品各項指標,從而大幅提升工作效率。立即探索,找到最適合您的資料驅動決策工具!238個字元

9 個工具
xix.ai
音樂創作 最佳用於歌曲草稿的 AI 旋律創作工具
最佳用於歌曲草稿的 AI 旋律創作工具

2026 年最新最佳頂級評分 AI 旋律創作工具,助力歌曲草稿創作!XIX.AI 精心策劃了一套極具影響力且經過嚴格真實世界測試的變革性合集,旨在提供最佳的創作體驗。您可以找到詳細的免費與付費版對比、精準的排名以及必試選項,這些工具旨在幫助您輕鬆創作出令人驚豔的歌曲草稿,並顯著提升您的創意生產力。立即探索,發現您的完美工具!

8 個工具
xix.ai
評論 (11)
0/500
NicholasCarter
NicholasCarter 2026-08-30 10:00:07

Wait, another LLM from a SF startup? 🙄 Llama fine-tunes are everywhere now. Hope this one actually solves something instead of just adding to the noise. 🤖

LarryAdams
LarryAdams 2026-03-24 10:01:02

Wait, another open-source player topping charts overnight? 🤔 I'll admit the numbers look impressive on paper, but seeing a startup immediately "top the charts" feels a bit... marketing-heavy. Is this sustainable innovation or just great fine-tuning of existing bedrock like Llama 3.2? The field is getting crowded, and I genuinely wonder how many of these new models will actually be around in two years. Still, competition is good for us users! Excited to test it myself and see if it lives up to the hype.

RichardGonzález
RichardGonzález 2025-10-27 02:30:35

Interesting to see another player in the open-source AI field! I have mixed feelings—skeptical about 'revolutionary' claims from new startups, even with impressive initial benchmarks. Hope they can really deliver real-world applications beyond just chart performance. This space is getting crowded 🌱

AlbertGonzalez
AlbertGonzalez 2025-09-10 00:30:52

Deep Cogito這麼快就衝上榜單也太強了吧!看來開源模型真的越來越厲害了,不過這樣會不會讓LLM市場更競爭啊?🤔 我還是擔心小公司以後根本玩不起...

EricMartin
EricMartin 2025-07-28 09:20:21

Wow, Deep Cogito’s models are killing it! Beating the charts right out the gate is wild. Curious how they stack up against Grok in real-world tasks. 🚀

WilliamRamirez
WilliamRamirez 2025-07-28 09:19:30

Wow, Deep Cogito’s open-source models are killing it! Fine-tuning Llama 3.2 to top the charts is no small feat. I’m curious how they’ll stack up against the big players in real-world apps. Exciting times for AI! 🚀

OR