109B
模型参数数量
Meta
所属机构
开源
许可证类型
2025-04-05
发布时间
模型介绍
Llama 4 模型是自回归语言模型,采用专家混合(MoE)架构,并结合早期融合实现原生多模态。
左右滑动查看更多
语言理解能力
常出现语义误判,导致回应内容与问题存在明显逻辑断裂。
5.3
知识覆盖范围
掌握主流学科核心知识体系,但对前沿交叉学科覆盖有限。
8.4
推理能力
能完成三步以上的逻辑推演,但处理非线性关系时效率下降。
7.8
模型比较
相关模型
Llama4-Maverick-17B-128E-Instruct
Llama 4 模型是一种自动回归语言模型,采用专家混合(MoE)架构,并结合了早期融合技术以实现本地多模态。
Llama4-Maverick-17B-128E-Instruct
Llama 4 模型是自回归语言模型,采用专家混合(MoE)架构,并融入早期融合技术以实现原生多模态能力。
Llama3.1-8B-Instruct
Llama3.1 是多语言模型,具有显著更长的上下文长度 128K,最先进的工具使用能力以及整体更强的推理能力。
Llama3.1-405B-Instruct-FP8
Llama 3.1 405B 是首个在普通知识、可控性、数学、工具使用和多语言翻译等前沿能力方面可与顶级 AI 模型相媲美的开源模型。
Llama3.2-3B-Instruct
Llama 3.2 3B 模型支持长达 128K 个标记的上下文长度,并且在其设备端应用场景(如摘要、指令跟随和重写任务在边缘本地运行)方面处于同类产品的领先地位。
相关文档
科大讯飞发布讯飞星火大模型 V2.5
9月1日,科大讯飞将开源两款面向边缘场景的大语言模型——星火X2.5-4B和星火X2.5-1.7B,据最新官方公告。这两款模型原生支持高达100万token的上下文窗口。它们在智能体交互、数学推理和通用理解等关键领域实现了显著提升,为车载系统、智能设备和物联网生态等边缘应用提供了强有力的支持。在上述边缘模型发布后,科大讯飞计划于9月7日推出拥有2930亿参数的星火X2.5基础模型。该版本将进一步推进代码生成和多智能体协作等核心技术。在公司2026年年中简报会上宣布,一款完全基于国产算力基础设施
Meta 在用户强烈反对后取消了 AI 照片编辑功能
Meta,这家社交媒体巨头,再次卷入关于人工智能与用户隐私之间微妙平衡的公开辩论。据 TechCrunch 报道,Meta 的 Superintelligence Labs 本周早些时候推出了一款新的 AI 图像生成器 Muse Image。然而,一个备受好评的关键功能——允许用户通过“@”符号标记来修改和生成来自公开 Instagram 账户的图像——由于缺乏适当的通知机制,立即引发了用户以及 CAA 等机构的强烈反对。面对强烈的批评,Meta 迅速撤销了该决定,并于周五通过博客文章宣布将
DeepMind首席执行官哈西里斯:我每天睡六个小时,通常在凌晨1点左右感到精力充沛。
Fortune 最近刊登了对谷歌 DeepMind 首席执行官 Demis Hassabis 的采访,揭示了他对休息和生产力的非传统方法。Hassabis 透露,他睡眠时间非常少,将清醒时间划分为两个不同的工作阶段。关于他的睡眠习惯,Hassabis 表示:“我目标睡六小时,但我的习惯非同寻常。我可以在白天有效运作。”他强调,睡眠少于六小时会对大脑健康产生负面影响。Hassabis 于 2010 年联合创立了 DeepMind(后被谷歌收购),并因其在蛋白质结构预测方面的开创性工作荣获 20
尽管营收未达预期,OpenAI与Anthropic仍在争夺市场份额
尽管近期有报道称OpenAI未达营收目标,给本周二的科技股带来压力,但私营人工智能实验室的投资者仍表现坚韧。经验丰富的投资者已确认,尽管媒体报道负面,他们仍不会减少投资。分析师认为当前的人工智能竞赛仍处于早期阶段,因此不会出现“赢家通吃”的局面。尽管高昂的计算成本给营收带来压力,但实验室可通过提高订阅费来提升盈利能力。行业格局正发生微妙变化与OpenAI不同,其竞争对手Anthropic获得了强有
加利福尼亚州自动驾驶合规:罚单、地理围栏和100万英里的新时代
Guident公司在南佛罗里达州运营一辆AuveTech自动驾驶班车,利用其远程监控技术管理西棕榈滩的一条4英里路线和博卡拉顿的一条1英里路线。| 图片来源:Guident加利福尼亚州正在重新定义无人驾驶车辆的监管格局,正逐渐摆脱科技行业“快速行动,打破常规”的思维模式,转向严格的问责制和严苛的行驶里程要求。Guident执行董事长兼首席执行官哈罗德·布劳恩(Harold Braun)在《机器人报





首页
