深度认知发布开源AI模型,已名列前茅

深度Cogito推出革命性AI模型
深度Cogito,一家位于旧金山的尖端AI研究初创公司,正式发布了其首款开源大型语言模型(LLMs),命名为Cogito v1。这些模型基于Meta的Llama 3.2进行微调,具备混合推理能力,可快速响应或进行内省思考,类似于OpenAI的“o”系列和DeepSeek R1。
深度Cogito致力于推动AI超越传统人类监督限制,通过模型内部的迭代自我改进实现。其终极目标?开发超级智能——在所有领域超越人类能力的AI。公司承诺所有模型将保持开源。
深度Cogito首席执行官兼联合创始人Drishan Arora曾任Google高级软件工程师,领导Google生成搜索产品的LLM开发。他在X上自信表示,这些模型在其规模上是最强的开源模型,超越LLaMA、DeepSeek和Qwen等竞争对手。
模型阵容
初始产品包括五种基本规模——30亿、80亿、140亿、320亿和700亿参数,现已可在Hugging Face、Ollama及通过Fireworks和Together AI的API等平台访问。这些模型遵循Llama许可条款,允许高达7亿月活跃用户的商业使用,超出需从Meta获得付费许可。
深度Cogito计划在不久的将来推出更大规模的模型,可能达到6710亿参数。
训练方法:迭代蒸馏与放大(IDA)
Arora介绍了IDA,一种区别于传统人类反馈强化学习(RLHF)或教师模型蒸馏的新方法。IDA专注于分配额外计算资源以生成更优解决方案,随后将增强的推理能力嵌入模型本身,形成持续反馈循环以提升能力。这种方法类似于Google AlphaGo的自我对弈策略,适用于自然语言处理。
基准测试与评估
深度Cogito展示了Cogito模型与开源模型在通用知识、数学推理和多语言任务等领域的全面评估结果。主要发现包括:
- Cogito 3B(标准版): 在MMLU上比LLaMA 3.2 3B高6.7个百分点(65.4% vs. 58.7%),在Hellaswag上高18.8个百分点(81.1% vs. 62.3%)。
- Cogito 3B(推理模式): 在MMLU上得分72.6%,在ARC上得分84.2%。
- Cogito 8B(标准版): 在MMLU上达到80.5%,比LLaMA 3.1 8B高12.8个百分点。
- Cogito 8B(推理模式): 在MMLU上得分83.1%,在ARC上得分92.0%。
- Cogito 70B(标准版): 在MMLU上比LLaMA 3.3 70B高6.4个百分点(91.7% vs. 85.3%),在综合基准测试上超越LLaMA 4 Scout 109B(54.5% vs. 53.3%)。
尽管Cogito模型在推理模式下表现出色,但在数学任务中存在一定权衡。
原生工具调用
深度Cogito还评估了其模型的原生工具调用性能,这对代理和API集成系统至关重要。
- Cogito 3B: 支持四种工具调用任务,在简单和多工具调用中表现优异。
- Cogito 8B: 在所有工具调用类型中表现强劲,显著超越LLaMA 3.1 8B。
未来计划
展望未来,深度Cogito计划推出更大模型,包括1090亿、4000亿和6710亿参数的专家混合变体,同时持续更新现有检查点。公司将IDA视为可扩展自我改进的可持续路径,减少对人类或静态教师模型的依赖。
Arora强调,现实世界的实用性和适应性是成功的终极衡量标准,这只是一个充满希望的旅程的开始。深度Cogito与Hugging Face、RunPod、Fireworks AI、Together AI和Ollama等知名实体合作,确保所有模型保持开源和免费访问。
相关文章
华纳音乐收购AI归因初创公司Sureel AI
华纳音乐集团(WMG)于周三确认,其正在收购Sureel AI,一家专注于人工智能归因的初创公司。Sureel的专有技术为音乐曲目生成“AI DNA”,将其分解为各个组成部分,以追踪人工智能模型如何利用这些元素。通过此次收购,WMG旨在增强其监控其艺术家和词曲创作者的作品在人工智能生成内容中被使用或用于训练人工智能模型的能力。“将Sureel整合到WMG中,增强了我们的保护、控制和变现能力,确保创意社区保留对其知识产权、姓名、肖像、形象和声音的控制权,”WMG首席执行官Robert Kync
亚马逊推出“Alexa for Shopping”,同时将Rufus边缘化
亚马逊推出了“Alexa for Shopping”,将 Rufus 购物聊天机器人 Alexa+ 整合到应用程序、网站和 Echo Show 设备中。该助手回答产品查询、比较商品、跟踪价格,并支持购物提醒。它还处理计划中的购物操作和符合条件的自动购买。据该公司称,“Alexa for Shopping”将 Rufus 的产品专业知识与 Alexa+ 的个性化助手上下文相结合。亚马逊表示,Rufus 在 2025 年协助了超过 3 亿客户进行产品研究、比较和购买。GeekWire 报道称,
微软、Azure 和人工智能技术共同应对加利福尼亚州野火风险
微软投资于人工智能驱动的山火监测技术,其首席副总裁兼首席数据科学家胡安·拉维斯塔·费雷斯(Juan Lavista Ferres)探讨了减轻环境损害的策略。据美国国家航空航天局(NASA)称,气候变化影响着地球上的每个人,其表现为气温上升、降雨模式改变以及海平面上升。NASA指出,有确凿证据表明地球正以史无前例的速度变暖,而人类活动是其主要驱动因素。随着全球气温上升,野火构成的威胁日益加剧。 在美
相关专题推荐
评论 (11)
0/500
Wait, another LLM from a SF startup? 🙄 Llama fine-tunes are everywhere now. Hope this one actually solves something instead of just adding to the noise. 🤖
Wait, another open-source player topping charts overnight? 🤔 I'll admit the numbers look impressive on paper, but seeing a startup immediately "top the charts" feels a bit... marketing-heavy. Is this sustainable innovation or just great fine-tuning of existing bedrock like Llama 3.2? The field is getting crowded, and I genuinely wonder how many of these new models will actually be around in two years. Still, competition is good for us users! Excited to test it myself and see if it lives up to the hype.
Interesting to see another player in the open-source AI field! I have mixed feelings—skeptical about 'revolutionary' claims from new startups, even with impressive initial benchmarks. Hope they can really deliver real-world applications beyond just chart performance. This space is getting crowded 🌱
Wow, Deep Cogito’s models are killing it! Beating the charts right out the gate is wild. Curious how they stack up against Grok in real-world tasks. 🚀

深度Cogito推出革命性AI模型
深度Cogito,一家位于旧金山的尖端AI研究初创公司,正式发布了其首款开源大型语言模型(LLMs),命名为Cogito v1。这些模型基于Meta的Llama 3.2进行微调,具备混合推理能力,可快速响应或进行内省思考,类似于OpenAI的“o”系列和DeepSeek R1。
深度Cogito致力于推动AI超越传统人类监督限制,通过模型内部的迭代自我改进实现。其终极目标?开发超级智能——在所有领域超越人类能力的AI。公司承诺所有模型将保持开源。
深度Cogito首席执行官兼联合创始人Drishan Arora曾任Google高级软件工程师,领导Google生成搜索产品的LLM开发。他在X上自信表示,这些模型在其规模上是最强的开源模型,超越LLaMA、DeepSeek和Qwen等竞争对手。
模型阵容
初始产品包括五种基本规模——30亿、80亿、140亿、320亿和700亿参数,现已可在Hugging Face、Ollama及通过Fireworks和Together AI的API等平台访问。这些模型遵循Llama许可条款,允许高达7亿月活跃用户的商业使用,超出需从Meta获得付费许可。
深度Cogito计划在不久的将来推出更大规模的模型,可能达到6710亿参数。
训练方法:迭代蒸馏与放大(IDA)
Arora介绍了IDA,一种区别于传统人类反馈强化学习(RLHF)或教师模型蒸馏的新方法。IDA专注于分配额外计算资源以生成更优解决方案,随后将增强的推理能力嵌入模型本身,形成持续反馈循环以提升能力。这种方法类似于Google AlphaGo的自我对弈策略,适用于自然语言处理。
基准测试与评估
深度Cogito展示了Cogito模型与开源模型在通用知识、数学推理和多语言任务等领域的全面评估结果。主要发现包括:
- Cogito 3B(标准版): 在MMLU上比LLaMA 3.2 3B高6.7个百分点(65.4% vs. 58.7%),在Hellaswag上高18.8个百分点(81.1% vs. 62.3%)。
- Cogito 3B(推理模式): 在MMLU上得分72.6%,在ARC上得分84.2%。
- Cogito 8B(标准版): 在MMLU上达到80.5%,比LLaMA 3.1 8B高12.8个百分点。
- Cogito 8B(推理模式): 在MMLU上得分83.1%,在ARC上得分92.0%。
- Cogito 70B(标准版): 在MMLU上比LLaMA 3.3 70B高6.4个百分点(91.7% vs. 85.3%),在综合基准测试上超越LLaMA 4 Scout 109B(54.5% vs. 53.3%)。
尽管Cogito模型在推理模式下表现出色,但在数学任务中存在一定权衡。
原生工具调用
深度Cogito还评估了其模型的原生工具调用性能,这对代理和API集成系统至关重要。
- Cogito 3B: 支持四种工具调用任务,在简单和多工具调用中表现优异。
- Cogito 8B: 在所有工具调用类型中表现强劲,显著超越LLaMA 3.1 8B。
未来计划
展望未来,深度Cogito计划推出更大模型,包括1090亿、4000亿和6710亿参数的专家混合变体,同时持续更新现有检查点。公司将IDA视为可扩展自我改进的可持续路径,减少对人类或静态教师模型的依赖。
Arora强调,现实世界的实用性和适应性是成功的终极衡量标准,这只是一个充满希望的旅程的开始。深度Cogito与Hugging Face、RunPod、Fireworks AI、Together AI和Ollama等知名实体合作,确保所有模型保持开源和免费访问。
华纳音乐收购AI归因初创公司Sureel AI
华纳音乐集团(WMG)于周三确认,其正在收购Sureel AI,一家专注于人工智能归因的初创公司。Sureel的专有技术为音乐曲目生成“AI DNA”,将其分解为各个组成部分,以追踪人工智能模型如何利用这些元素。通过此次收购,WMG旨在增强其监控其艺术家和词曲创作者的作品在人工智能生成内容中被使用或用于训练人工智能模型的能力。“将Sureel整合到WMG中,增强了我们的保护、控制和变现能力,确保创意社区保留对其知识产权、姓名、肖像、形象和声音的控制权,”WMG首席执行官Robert Kync
微软、Azure 和人工智能技术共同应对加利福尼亚州野火风险
微软投资于人工智能驱动的山火监测技术,其首席副总裁兼首席数据科学家胡安·拉维斯塔·费雷斯(Juan Lavista Ferres)探讨了减轻环境损害的策略。据美国国家航空航天局(NASA)称,气候变化影响着地球上的每个人,其表现为气温上升、降雨模式改变以及海平面上升。NASA指出,有确凿证据表明地球正以史无前例的速度变暖,而人类活动是其主要驱动因素。随着全球气温上升,野火构成的威胁日益加剧。 在美
Wait, another LLM from a SF startup? 🙄 Llama fine-tunes are everywhere now. Hope this one actually solves something instead of just adding to the noise. 🤖
Wait, another open-source player topping charts overnight? 🤔 I'll admit the numbers look impressive on paper, but seeing a startup immediately "top the charts" feels a bit... marketing-heavy. Is this sustainable innovation or just great fine-tuning of existing bedrock like Llama 3.2? The field is getting crowded, and I genuinely wonder how many of these new models will actually be around in two years. Still, competition is good for us users! Excited to test it myself and see if it lives up to the hype.
Interesting to see another player in the open-source AI field! I have mixed feelings—skeptical about 'revolutionary' claims from new startups, even with impressive initial benchmarks. Hope they can really deliver real-world applications beyond just chart performance. This space is getting crowded 🌱
Wow, Deep Cogito’s models are killing it! Beating the charts right out the gate is wild. Curious how they stack up against Grok in real-world tasks. 🚀





首页






