选项
首页
新闻
深度认知发布开源AI模型,已名列前茅

深度认知发布开源AI模型,已名列前茅

2025-06-06
180

深度认知发布开源AI模型,已名列前茅

深度Cogito推出革命性AI模型

深度Cogito,一家位于旧金山的尖端AI研究初创公司,正式发布了其首款开源大型语言模型(LLMs),命名为Cogito v1。这些模型基于Meta的Llama 3.2进行微调,具备混合推理能力,可快速响应或进行内省思考,类似于OpenAI的“o”系列和DeepSeek R1。

深度Cogito致力于推动AI超越传统人类监督限制,通过模型内部的迭代自我改进实现。其终极目标?开发超级智能——在所有领域超越人类能力的AI。公司承诺所有模型将保持开源。

深度Cogito首席执行官兼联合创始人Drishan Arora曾任Google高级软件工程师,领导Google生成搜索产品的LLM开发。他在X上自信表示,这些模型在其规模上是最强的开源模型,超越LLaMA、DeepSeek和Qwen等竞争对手。

模型阵容

初始产品包括五种基本规模——30亿、80亿、140亿、320亿和700亿参数,现已可在Hugging Face、Ollama及通过Fireworks和Together AI的API等平台访问。这些模型遵循Llama许可条款,允许高达7亿月活跃用户的商业使用,超出需从Meta获得付费许可。

深度Cogito计划在不久的将来推出更大规模的模型,可能达到6710亿参数。

训练方法:迭代蒸馏与放大(IDA)

Arora介绍了IDA,一种区别于传统人类反馈强化学习(RLHF)或教师模型蒸馏的新方法。IDA专注于分配额外计算资源以生成更优解决方案,随后将增强的推理能力嵌入模型本身,形成持续反馈循环以提升能力。这种方法类似于Google AlphaGo的自我对弈策略,适用于自然语言处理。

基准测试与评估

深度Cogito展示了Cogito模型与开源模型在通用知识、数学推理和多语言任务等领域的全面评估结果。主要发现包括:

  • Cogito 3B(标准版): 在MMLU上比LLaMA 3.2 3B高6.7个百分点(65.4% vs. 58.7%),在Hellaswag上高18.8个百分点(81.1% vs. 62.3%)。
  • Cogito 3B(推理模式): 在MMLU上得分72.6%,在ARC上得分84.2%。
  • Cogito 8B(标准版): 在MMLU上达到80.5%,比LLaMA 3.1 8B高12.8个百分点。
  • Cogito 8B(推理模式): 在MMLU上得分83.1%,在ARC上得分92.0%。
  • Cogito 70B(标准版): 在MMLU上比LLaMA 3.3 70B高6.4个百分点(91.7% vs. 85.3%),在综合基准测试上超越LLaMA 4 Scout 109B(54.5% vs. 53.3%)。

尽管Cogito模型在推理模式下表现出色,但在数学任务中存在一定权衡。

原生工具调用

深度Cogito还评估了其模型的原生工具调用性能,这对代理和API集成系统至关重要。

  • Cogito 3B: 支持四种工具调用任务,在简单和多工具调用中表现优异。
  • Cogito 8B: 在所有工具调用类型中表现强劲,显著超越LLaMA 3.1 8B。

未来计划

展望未来,深度Cogito计划推出更大模型,包括1090亿、4000亿和6710亿参数的专家混合变体,同时持续更新现有检查点。公司将IDA视为可扩展自我改进的可持续路径,减少对人类或静态教师模型的依赖。

Arora强调,现实世界的实用性和适应性是成功的终极衡量标准,这只是一个充满希望的旅程的开始。深度Cogito与Hugging Face、RunPod、Fireworks AI、Together AI和Ollama等知名实体合作,确保所有模型保持开源和免费访问。

相关文章
华纳音乐收购AI归因初创公司Sureel AI 华纳音乐收购AI归因初创公司Sureel AI 华纳音乐集团(WMG)于周三确认,其正在收购Sureel AI,一家专注于人工智能归因的初创公司。Sureel的专有技术为音乐曲目生成“AI DNA”,将其分解为各个组成部分,以追踪人工智能模型如何利用这些元素。通过此次收购,WMG旨在增强其监控其艺术家和词曲创作者的作品在人工智能生成内容中被使用或用于训练人工智能模型的能力。“将Sureel整合到WMG中,增强了我们的保护、控制和变现能力,确保创意社区保留对其知识产权、姓名、肖像、形象和声音的控制权,”WMG首席执行官Robert Kync
亚马逊推出“Alexa for Shopping”,同时将Rufus边缘化 亚马逊推出“Alexa for Shopping”,同时将Rufus边缘化 亚马逊推出了“Alexa for Shopping”,将 Rufus 购物聊天机器人 Alexa+ 整合到应用程序、网站和 Echo Show 设备中。该助手回答产品查询、比较商品、跟踪价格,并支持购物提醒。它还处理计划中的购物操作和符合条件的自动购买。据该公司称,“Alexa for Shopping”将 Rufus 的产品专业知识与 Alexa+ 的个性化助手上下文相结合。亚马逊表示,Rufus 在 2025 年协助了超过 3 亿客户进行产品研究、比较和购买。GeekWire 报道称,
微软、Azure 和人工智能技术共同应对加利福尼亚州野火风险 微软、Azure 和人工智能技术共同应对加利福尼亚州野火风险 微软投资于人工智能驱动的山火监测技术,其首席副总裁兼首席数据科学家胡安·拉维斯塔·费雷斯(Juan Lavista Ferres)探讨了减轻环境损害的策略。据美国国家航空航天局(NASA)称,气候变化影响着地球上的每个人,其表现为气温上升、降雨模式改变以及海平面上升。NASA指出,有确凿证据表明地球正以史无前例的速度变暖,而人类活动是其主要驱动因素。随着全球气温上升,野火构成的威胁日益加剧。 在美
相关专题推荐
数据分析 用于收入看板、转化漏斗分析及产品指标分析的 AI SQL 助手
用于收入看板、转化漏斗分析及产品指标分析的 AI SQL 助手

2026年最新最优秀的AI SQL辅助工具排名揭晓!XIX.AI精心挑选了一系列功能强大的工具,这些工具会定期更新,并通过真实的场景测试来验证其性能。使用这些值得尝试的工具,您可以快速生成精准的收入分析报表、分析销售流程,并追踪产品各项指标,从而大幅提升工作效率。立即探索,找到最适合您的数据驱动决策工具!238个字符

9 个工具
xix.ai
音乐创作 最佳用于歌曲草稿的 AI 旋律创作工具
最佳用于歌曲草稿的 AI 旋律创作工具

2026 年最新最佳顶级评分 AI 旋律创作工具,助力歌曲草稿创作!XIX.AI 精心策划了一套极具影响力且经过严格真实世界测试的变革性合集,旨在提供最佳的创作体验。您可以找到详细的免费与付费版对比、精准的排名以及必试选项,这些工具旨在帮助您轻松创作出令人惊艳的歌曲草稿,并显著提升您的创意生产力。立即探索,发现您的完美工具!

8 个工具
xix.ai
聊天机器人 最佳AI对话训练工具,助你备战面试
最佳AI对话训练工具,助你备战面试

2026年最新、最受好评的AI面试模拟训练工具现已登陆XIX.AI!这份精心精选的合集收录了功能强大、具有革命性意义的工具,它们均经过严格的实际测试,能够提供精准的反馈。 您将看到免费版与付费版的对比分析以及详细排名,助您挑选出必试之选,从而提升自信并精进技能。立即探索,发现助您面试成功的完美工具!

12 个工具
xix.ai
设计与艺术 最适合创意实验的AI风格转换工具
最适合创意实验的AI风格转换工具

2026年最新最佳、评价最高的AI风格转换工具,助您开展创意实验!XIX.AI精心甄选了一系列功能强大、颠覆性的必试工具,这些工具经过实际测试和严格排名,可带来卓越的效果。这些顶级解决方案通过加速内容创作并释放无限创意潜能,帮助创作者显著提升工作效率。 立即探索,找到最适合您的工具,今天就开始创作吧!

9 个工具
xix.ai
漫画创作 最适合视觉叙事的AI对话气泡工具
最适合视觉叙事的AI对话气泡工具

2026年最新、最受欢迎的视觉叙事AI对话气泡工具现已登陆XIX.AI!这份精心精选的合集汇集了功能强大、具有颠覆性的工具,可帮助创作者提升工作效率并突破创作瓶颈。 获取免费版与付费版的对比分析,查看实际测试结果,并查阅最新排行榜,找到最适合打造引人入胜的视觉叙事的必试解决方案。立即探索,发现您的理想工具!

10 个工具
xix.ai
会议助理 顶级AI会议摘要工具:清晰追踪决策与后续跟进
顶级AI会议摘要工具:清晰追踪决策与后续跟进

2026年最新高评分最佳AI会议摘要工具,助您清晰追踪决策并轻松跟进。这份精心筛选的清单展示了功能强大、具有颠覆性的解决方案,它们通过自动化会议记录、识别关键行动项以及简化所有项目中的团队协调,显著提升工作效率。 获取免费版与付费版的对比分析,以及实际测试报告和每周更新的排行榜,助您找到最适合的工具。立即探索,释放您的AI优势!

9 个工具
xix.ai
评论 (11)
0/500
NicholasCarter
NicholasCarter 2026-08-30 10:00:07

Wait, another LLM from a SF startup? 🙄 Llama fine-tunes are everywhere now. Hope this one actually solves something instead of just adding to the noise. 🤖

LarryAdams
LarryAdams 2026-03-24 10:01:02

Wait, another open-source player topping charts overnight? 🤔 I'll admit the numbers look impressive on paper, but seeing a startup immediately "top the charts" feels a bit... marketing-heavy. Is this sustainable innovation or just great fine-tuning of existing bedrock like Llama 3.2? The field is getting crowded, and I genuinely wonder how many of these new models will actually be around in two years. Still, competition is good for us users! Excited to test it myself and see if it lives up to the hype.

RichardGonzález
RichardGonzález 2025-10-27 02:30:35

Interesting to see another player in the open-source AI field! I have mixed feelings—skeptical about 'revolutionary' claims from new startups, even with impressive initial benchmarks. Hope they can really deliver real-world applications beyond just chart performance. This space is getting crowded 🌱

AlbertGonzalez
AlbertGonzalez 2025-09-10 00:30:52

Deep Cogito這麼快就衝上榜單也太強了吧!看來開源模型真的越來越厲害了,不過這樣會不會讓LLM市場更競爭啊?🤔 我還是擔心小公司以後根本玩不起...

EricMartin
EricMartin 2025-07-28 09:20:21

Wow, Deep Cogito’s models are killing it! Beating the charts right out the gate is wild. Curious how they stack up against Grok in real-world tasks. 🚀

WilliamRamirez
WilliamRamirez 2025-07-28 09:19:30

Wow, Deep Cogito’s open-source models are killing it! Fine-tuning Llama 3.2 to top the charts is no small feat. I’m curious how they’ll stack up against the big players in real-world apps. Exciting times for AI! 🚀

OR