Deep Cogito 推出具有高级推理能力的混合人工智能模型
Deep Cogito 是一家新的人工智能创新公司,它推出了一系列可公开访问的人工智能模型,这些模型可在推理和非推理模式之间无缝切换。
推理模型(如 OpenAI 的 o1)通过一步步有条不紊地验证解决方案,在数学和物理等领域表现出色。然而,这种精确性需要更多的计算资源和时间。为了解决这个问题,Anthropic 等公司正在开发混合架构,将推理与标准组件融合在一起,既能快速响应简单查询,又能深入分析复杂查询。
Deep Cogito 的模型名为 Cogito 1,全部采用混合设计。该公司声称,它们超越了同等规模的顶级开放模型,包括 Meta 和 DeepSeek 的模型。
"Deep Cogito 在一篇博文中表示:"每个模型都能立即做出反应,或在回答前进行思考,模仿推理模型。"它们是由一个精干的团队在短短 75 天内制作完成的"。
Cogito 1模型的参数范围从30亿到700亿,计划在不久的将来将模型参数提高到6710亿。参数越多,模型解决问题的能力就越强。
Cogito 1 以 Meta 的 Llama 和阿里巴巴的 Qwen 模型为基础,Deep Cogito 采用创新的训练技术来提高性能,实现可切换推理。
内部基准测试表明,启用推理功能的最大模型 Cogito 70B 在部分数学和语言任务上的表现优于 DeepSeek 的 R1。在不进行推理的情况下,它在LiveBench(一项广泛的人工智能评估)上也超过了Meta的Llama 4 Scout。
所有 Cogito 1 模型都可以在 Fireworks AI 和 Together AI 云平台上下载或通过 API 访问。

Cogito 1的性能与其他流行的公开人工智能模型相比图片来源:Deep Cogito "Deep Cogito 在其博客中指出:"我们仍处于扩展之旅的初期,仅使用了通常分配给大型语言模型训练的计算量的一小部分。"我们正在探索新的训练后自我改进方法"。
根据加州提交的文件,Deep Cogito 于 2024 年 6 月在旧金山成立,创始人是前谷歌高级软件工程师 Drishan Arora 和 Dhruv Malhotra,Dhruv Malhotra 此前是谷歌 DeepMind 的产品经理,主要负责生成式搜索。
据 PitchBook 报道,Deep Cogito 公司得到了 South Park Commons 的支持,其目标是开创 "通用超级智能"--超越大多数人类的人工智能,并释放出前所未有的能力。
相关文章
Meta 在用户强烈反对后取消了 AI 照片编辑功能
Meta,这家社交媒体巨头,再次卷入关于人工智能与用户隐私之间微妙平衡的公开辩论。据 TechCrunch 报道,Meta 的 Superintelligence Labs 本周早些时候推出了一款新的 AI 图像生成器 Muse Image。然而,一个备受好评的关键功能——允许用户通过“@”符号标记来修改和生成来自公开 Instagram 账户的图像——由于缺乏适当的通知机制,立即引发了用户以及 CAA 等机构的强烈反对。面对强烈的批评,Meta 迅速撤销了该决定,并于周五通过博客文章宣布将
DeepMind首席执行官哈西里斯:我每天睡六个小时,通常在凌晨1点左右感到精力充沛。
Fortune 最近刊登了对谷歌 DeepMind 首席执行官 Demis Hassabis 的采访,揭示了他对休息和生产力的非传统方法。Hassabis 透露,他睡眠时间非常少,将清醒时间划分为两个不同的工作阶段。关于他的睡眠习惯,Hassabis 表示:“我目标睡六小时,但我的习惯非同寻常。我可以在白天有效运作。”他强调,睡眠少于六小时会对大脑健康产生负面影响。Hassabis 于 2010 年联合创立了 DeepMind(后被谷歌收购),并因其在蛋白质结构预测方面的开创性工作荣获 20
尽管营收未达预期,OpenAI与Anthropic仍在争夺市场份额
尽管近期有报道称OpenAI未达营收目标,给本周二的科技股带来压力,但私营人工智能实验室的投资者仍表现坚韧。经验丰富的投资者已确认,尽管媒体报道负面,他们仍不会减少投资。分析师认为当前的人工智能竞赛仍处于早期阶段,因此不会出现“赢家通吃”的局面。尽管高昂的计算成本给营收带来压力,但实验室可通过提高订阅费来提升盈利能力。行业格局正发生微妙变化与OpenAI不同,其竞争对手Anthropic获得了强有
相关专题推荐
评论 (0)
0/500
Deep Cogito 是一家新的人工智能创新公司,它推出了一系列可公开访问的人工智能模型,这些模型可在推理和非推理模式之间无缝切换。
推理模型(如 OpenAI 的 o1)通过一步步有条不紊地验证解决方案,在数学和物理等领域表现出色。然而,这种精确性需要更多的计算资源和时间。为了解决这个问题,Anthropic 等公司正在开发混合架构,将推理与标准组件融合在一起,既能快速响应简单查询,又能深入分析复杂查询。
Deep Cogito 的模型名为 Cogito 1,全部采用混合设计。该公司声称,它们超越了同等规模的顶级开放模型,包括 Meta 和 DeepSeek 的模型。
"Deep Cogito 在一篇博文中表示:"每个模型都能立即做出反应,或在回答前进行思考,模仿推理模型。"它们是由一个精干的团队在短短 75 天内制作完成的"。
Cogito 1模型的参数范围从30亿到700亿,计划在不久的将来将模型参数提高到6710亿。参数越多,模型解决问题的能力就越强。
Cogito 1 以 Meta 的 Llama 和阿里巴巴的 Qwen 模型为基础,Deep Cogito 采用创新的训练技术来提高性能,实现可切换推理。
内部基准测试表明,启用推理功能的最大模型 Cogito 70B 在部分数学和语言任务上的表现优于 DeepSeek 的 R1。在不进行推理的情况下,它在LiveBench(一项广泛的人工智能评估)上也超过了Meta的Llama 4 Scout。
所有 Cogito 1 模型都可以在 Fireworks AI 和 Together AI 云平台上下载或通过 API 访问。

"Deep Cogito 在其博客中指出:"我们仍处于扩展之旅的初期,仅使用了通常分配给大型语言模型训练的计算量的一小部分。"我们正在探索新的训练后自我改进方法"。
根据加州提交的文件,Deep Cogito 于 2024 年 6 月在旧金山成立,创始人是前谷歌高级软件工程师 Drishan Arora 和 Dhruv Malhotra,Dhruv Malhotra 此前是谷歌 DeepMind 的产品经理,主要负责生成式搜索。
据 PitchBook 报道,Deep Cogito 公司得到了 South Park Commons 的支持,其目标是开创 "通用超级智能"--超越大多数人类的人工智能,并释放出前所未有的能力。
Meta 在用户强烈反对后取消了 AI 照片编辑功能
Meta,这家社交媒体巨头,再次卷入关于人工智能与用户隐私之间微妙平衡的公开辩论。据 TechCrunch 报道,Meta 的 Superintelligence Labs 本周早些时候推出了一款新的 AI 图像生成器 Muse Image。然而,一个备受好评的关键功能——允许用户通过“@”符号标记来修改和生成来自公开 Instagram 账户的图像——由于缺乏适当的通知机制,立即引发了用户以及 CAA 等机构的强烈反对。面对强烈的批评,Meta 迅速撤销了该决定,并于周五通过博客文章宣布将
DeepMind首席执行官哈西里斯:我每天睡六个小时,通常在凌晨1点左右感到精力充沛。
Fortune 最近刊登了对谷歌 DeepMind 首席执行官 Demis Hassabis 的采访,揭示了他对休息和生产力的非传统方法。Hassabis 透露,他睡眠时间非常少,将清醒时间划分为两个不同的工作阶段。关于他的睡眠习惯,Hassabis 表示:“我目标睡六小时,但我的习惯非同寻常。我可以在白天有效运作。”他强调,睡眠少于六小时会对大脑健康产生负面影响。Hassabis 于 2010 年联合创立了 DeepMind(后被谷歌收购),并因其在蛋白质结构预测方面的开创性工作荣获 20
尽管营收未达预期,OpenAI与Anthropic仍在争夺市场份额
尽管近期有报道称OpenAI未达营收目标,给本周二的科技股带来压力,但私营人工智能实验室的投资者仍表现坚韧。经验丰富的投资者已确认,尽管媒体报道负面,他们仍不会减少投资。分析师认为当前的人工智能竞赛仍处于早期阶段,因此不会出现“赢家通吃”的局面。尽管高昂的计算成本给营收带来压力,但实验室可通过提高订阅费来提升盈利能力。行业格局正发生微妙变化与OpenAI不同,其竞争对手Anthropic获得了强有





首页






