谷歌推出四种规格的Gemma4开源模型,310亿参数版本全球排名第三
北京时间4月3日凌晨4点03分,谷歌正式发布了开源大型语言模型Gemma4。该模型在“单位参数效率”方面实现了突破,为驱动智能代理工作流的开源模型树立了新的标杆。
该系列包含高效的E2B(23亿参数)和E4B(45亿参数)版本,以及高性能的260亿参数MoE模型和310亿参数全连接模型。作为基于Gemini3技术栈构建的最新迭代版本,Gemma4支持完整的多模态输入(图像和视频)。 E2B和E4B模型还原生支持语音输入,可在边缘端实现实时语音理解。

在技术架构方面,这些大参数模型通过优化实现了卓越的硬件效率。在 Arena AI 文本排行榜上,31B 密集版在开源模型中位列全球第三,而 26B MoE 版则位居第六。其逻辑推理和函数调用能力足够强大,足以驱动复杂的自主智能体。
对于本地部署,Gemma4 大幅降低了获取前沿 AI 技术的门槛。31B 非量化模型的权重可在单块 80GB H100 GPU 上运行,而量化版本则兼容消费级 GPU。 针对移动和物联网设备,得益于创新的 PLE 嵌入技术以及对 128K 上下文长度的支持,E2B 和 E4B 模型可在树莓派和智能手机等平台上实现低延迟的逻辑处理。
此次发布不仅彰显了谷歌对开源生态系统的坚定承诺,更通过 Apache 2.0 许可协议,为全球开发者构建本地化、高隐私的 AI 应用奠定了基础。
相关文章
内部细节曝光:下一代 Gemini 算力紧张,内部团队在开发优先级和资源分配上存在分歧
报告显示,谷歌备受期待的下一代 Gemini 模型发布已被推迟。由于内部在开发优先级和资源分配上存在分歧,加上计算能力有限以及复杂的审批流程,导致发布时间延后了两个月。尽管谷歌拥有定制的 TPU 芯片,但由于模型训练、Google Cloud 服务以及众多消费和企业级 AI 应用对计算资源的需求相互竞争,谷歌仍面临计算资源短缺的问题。目前,高层管理人员正通过组织结构调整来解决这些部门间的冲突。与此同时,领导层也发生了变化,联合创始人谢尔盖·布林越来越多地参与到核心模型训练中,并倡导将资源专门用于
OpenAI 否认增长放缓担忧,称多个业务部门加速发展
针对外界对其销售增长放缓及未达内部基准的质疑,人工智能领域的领军企业 OpenAI 于 4 月 28 日(星期二)发表了一份信心十足的声明。该公司澄清称,其消费产品和企业服务正在快速推进,直接驳斥了近期关于业务放缓的猜测。针对该公司“未达成多项内部目标”的说法,OpenAI 将这些报道斥为“典型的标题党”。公司强调了企业对 AI 集成的强劲需求,并指出其广告业务早期增长前景良好。据 OpenAI 内部人士透露,公司内部情绪依然乐观。尽管市场竞争日益激烈,但公司正在向投资者传递信心,声称其商业
阿里巴巴超级杯:Qwen3.8-Max 重磅登场,代码与办公工具能力全面升级
阿里巴巴正式发布了Qwen3.8-Max,这是一款拥有2.4万亿参数的下一代基础大模型。这一重大AI进展在编码和专业办公任务等核心领域带来了显著的性能提升,展现了强大的技术能力。在权威的Arena大模型排名中,Qwen3.8-Max取得了令人瞩目的成绩,仅次于Anthropic的Claude系列,位居行业前列。这一里程碑标志着国内大模型在处理复杂任务方面取得了快速进展,为开发者和企业用户提供了先进的智能工具。该模型的API现已在Qwen AI平台上上线,并集成到新推出的“Qwen Offic
相关专题推荐
评论 (2)
0/500
Finally Google open-sources something decent! The 31B version ranking third globally is impressive, but I wonder how it compares to Llama 3 in real-world agent tasks? Honestly, parameter efficiency sounds like marketing fluff, but let's see the benchmarks. 🤔
北京时间4月3日凌晨4点03分,谷歌正式发布了开源大型语言模型Gemma4。该模型在“单位参数效率”方面实现了突破,为驱动智能代理工作流的开源模型树立了新的标杆。
该系列包含高效的E2B(23亿参数)和E4B(45亿参数)版本,以及高性能的260亿参数MoE模型和310亿参数全连接模型。作为基于Gemini3技术栈构建的最新迭代版本,Gemma4支持完整的多模态输入(图像和视频)。 E2B和E4B模型还原生支持语音输入,可在边缘端实现实时语音理解。

在技术架构方面,这些大参数模型通过优化实现了卓越的硬件效率。在 Arena AI 文本排行榜上,31B 密集版在开源模型中位列全球第三,而 26B MoE 版则位居第六。其逻辑推理和函数调用能力足够强大,足以驱动复杂的自主智能体。
对于本地部署,Gemma4 大幅降低了获取前沿 AI 技术的门槛。31B 非量化模型的权重可在单块 80GB H100 GPU 上运行,而量化版本则兼容消费级 GPU。 针对移动和物联网设备,得益于创新的 PLE 嵌入技术以及对 128K 上下文长度的支持,E2B 和 E4B 模型可在树莓派和智能手机等平台上实现低延迟的逻辑处理。
此次发布不仅彰显了谷歌对开源生态系统的坚定承诺,更通过 Apache 2.0 许可协议,为全球开发者构建本地化、高隐私的 AI 应用奠定了基础。
内部细节曝光:下一代 Gemini 算力紧张,内部团队在开发优先级和资源分配上存在分歧
报告显示,谷歌备受期待的下一代 Gemini 模型发布已被推迟。由于内部在开发优先级和资源分配上存在分歧,加上计算能力有限以及复杂的审批流程,导致发布时间延后了两个月。尽管谷歌拥有定制的 TPU 芯片,但由于模型训练、Google Cloud 服务以及众多消费和企业级 AI 应用对计算资源的需求相互竞争,谷歌仍面临计算资源短缺的问题。目前,高层管理人员正通过组织结构调整来解决这些部门间的冲突。与此同时,领导层也发生了变化,联合创始人谢尔盖·布林越来越多地参与到核心模型训练中,并倡导将资源专门用于
OpenAI 否认增长放缓担忧,称多个业务部门加速发展
针对外界对其销售增长放缓及未达内部基准的质疑,人工智能领域的领军企业 OpenAI 于 4 月 28 日(星期二)发表了一份信心十足的声明。该公司澄清称,其消费产品和企业服务正在快速推进,直接驳斥了近期关于业务放缓的猜测。针对该公司“未达成多项内部目标”的说法,OpenAI 将这些报道斥为“典型的标题党”。公司强调了企业对 AI 集成的强劲需求,并指出其广告业务早期增长前景良好。据 OpenAI 内部人士透露,公司内部情绪依然乐观。尽管市场竞争日益激烈,但公司正在向投资者传递信心,声称其商业
阿里巴巴超级杯:Qwen3.8-Max 重磅登场,代码与办公工具能力全面升级
阿里巴巴正式发布了Qwen3.8-Max,这是一款拥有2.4万亿参数的下一代基础大模型。这一重大AI进展在编码和专业办公任务等核心领域带来了显著的性能提升,展现了强大的技术能力。在权威的Arena大模型排名中,Qwen3.8-Max取得了令人瞩目的成绩,仅次于Anthropic的Claude系列,位居行业前列。这一里程碑标志着国内大模型在处理复杂任务方面取得了快速进展,为开发者和企业用户提供了先进的智能工具。该模型的API现已在Qwen AI平台上上线,并集成到新推出的“Qwen Offic
Finally Google open-sources something decent! The 31B version ranking third globally is impressive, but I wonder how it compares to Llama 3 in real-world agent tasks? Honestly, parameter efficiency sounds like marketing fluff, but let's see the benchmarks. 🤔





首页






