谷歌Gemma 4以开源形式发布,凭借310亿参数与顶级模型一较高下
4月3日凌晨4点03分,谷歌DeepMind正式发布了其全新的开源模型系列Gemma4。此次发布恰逢上一版本发布一周年。谷歌不仅在性能上实现了“代际飞跃”,还在开源承诺方面迈出了重要一步:将许可证从自有的专有协议切换为广泛采用的Apache 2.0协议。这一变更使开发者能够自由地将这些模型用于商业目的并进行修改。

完整产品线:覆盖移动端至工作站的四款模型
Gemma4首发推出四款各具特色的模型,覆盖所有应用场景:
31B Dense(旗舰版):拥有310亿个完全激活的参数,支持长达256K的超长上下文。该模型在Arena AI开源排行榜上名列第三。其非量化版本可在单张H100 GPU上运行。
26B A4B MoE(性价比之王):采用专家混合(Mixture-of-Experts)架构,总参数252亿,每次推理仅激活38亿参数。其推理速度媲美40亿参数模型,但质量超越同类产品,在排行榜上名列第六。
E4B & E2B(边缘精英):专为移动和嵌入式设备优化。通过采用分层嵌入技术,有效参数分别压缩至45亿和23亿。在某些设备上,E2B模型可将内存占用降至1.5GB以下。

性能飞跃:代码与数学能力取得重大突破
与上一代Gemma327B相比,Gemma4在核心基准测试中表现突飞猛进:
数学竞赛:在 AIME2026 测试中的得分从 20.8% 跃升至89.2%。
编程实力:Codeforces ELO 评级从 110 跃升至2150。在 LiveCodeBench 上的表现从 29.1% 提升至 80.0%,使其成为目前最强大的开源编程助手之一。
综合推理能力:在研究生级科学问题(GPQA Diamond)上的得分几乎翻倍,从42.4%跃升至84.3%。
多语言能力:原生支持超过140种语言,在MMMLU测试中取得88.4%的得分。

核心功能:内置“思考模式”与代理能力
Gemma4不仅拥有更多参数,其交互逻辑也与旗舰 Gemini 模型保持一致:
思考模式:包含内部推理模式,允许模型在给出答案前处理多步骤计划,从而显著提升复杂任务的准确率。
原生代理支持:支持函数调用和结构化 JSON 输出。Google 同时发布了开源的代理开发工具包 (ADK),使设备端模型能够充当“智能代理”。
深度多模态:所有版本均支持图像和视频输入。即使是较小的模型,也额外包含用于语音识别和翻译的音频编码器。
行业视角:开源领域的“权力重组”
过去一年间,国内开源模型(如DeepSeek、Qwen和GLM)发展迅猛,在一定程度上削弱了谷歌在开源领域的影响力。Gemma4的发布标志着谷歌正通过“极致的边缘端工程”和“更彻底的许可开放”重返前沿。
结论:当科技巨头开始谈论“真诚”时
相关文章
内部细节曝光:下一代 Gemini 算力紧张,内部团队在开发优先级和资源分配上存在分歧
报告显示,谷歌备受期待的下一代 Gemini 模型发布已被推迟。由于内部在开发优先级和资源分配上存在分歧,加上计算能力有限以及复杂的审批流程,导致发布时间延后了两个月。尽管谷歌拥有定制的 TPU 芯片,但由于模型训练、Google Cloud 服务以及众多消费和企业级 AI 应用对计算资源的需求相互竞争,谷歌仍面临计算资源短缺的问题。目前,高层管理人员正通过组织结构调整来解决这些部门间的冲突。与此同时,领导层也发生了变化,联合创始人谢尔盖·布林越来越多地参与到核心模型训练中,并倡导将资源专门用于
OpenAI 否认增长放缓担忧,称多个业务部门加速发展
针对外界对其销售增长放缓及未达内部基准的质疑,人工智能领域的领军企业 OpenAI 于 4 月 28 日(星期二)发表了一份信心十足的声明。该公司澄清称,其消费产品和企业服务正在快速推进,直接驳斥了近期关于业务放缓的猜测。针对该公司“未达成多项内部目标”的说法,OpenAI 将这些报道斥为“典型的标题党”。公司强调了企业对 AI 集成的强劲需求,并指出其广告业务早期增长前景良好。据 OpenAI 内部人士透露,公司内部情绪依然乐观。尽管市场竞争日益激烈,但公司正在向投资者传递信心,声称其商业
阿里巴巴超级杯:Qwen3.8-Max 重磅登场,代码与办公工具能力全面升级
阿里巴巴正式发布了Qwen3.8-Max,这是一款拥有2.4万亿参数的下一代基础大模型。这一重大AI进展在编码和专业办公任务等核心领域带来了显著的性能提升,展现了强大的技术能力。在权威的Arena大模型排名中,Qwen3.8-Max取得了令人瞩目的成绩,仅次于Anthropic的Claude系列,位居行业前列。这一里程碑标志着国内大模型在处理复杂任务方面取得了快速进展,为开发者和企业用户提供了先进的智能工具。该模型的API现已在Qwen AI平台上上线,并集成到新推出的“Qwen Offic
相关专题推荐
评论 (0)
0/500
4月3日凌晨4点03分,谷歌DeepMind正式发布了其全新的开源模型系列Gemma4。此次发布恰逢上一版本发布一周年。谷歌不仅在性能上实现了“代际飞跃”,还在开源承诺方面迈出了重要一步:将许可证从自有的专有协议切换为广泛采用的Apache 2.0协议。这一变更使开发者能够自由地将这些模型用于商业目的并进行修改。

完整产品线:覆盖移动端至工作站的四款模型
Gemma4首发推出四款各具特色的模型,覆盖所有应用场景:
31B Dense(旗舰版):拥有310亿个完全激活的参数,支持长达256K的超长上下文。该模型在Arena AI开源排行榜上名列第三。其非量化版本可在单张H100 GPU上运行。
26B A4B MoE(性价比之王):采用专家混合(Mixture-of-Experts)架构,总参数252亿,每次推理仅激活38亿参数。其推理速度媲美40亿参数模型,但质量超越同类产品,在排行榜上名列第六。
E4B & E2B(边缘精英):专为移动和嵌入式设备优化。通过采用分层嵌入技术,有效参数分别压缩至45亿和23亿。在某些设备上,E2B模型可将内存占用降至1.5GB以下。

性能飞跃:代码与数学能力取得重大突破
与上一代Gemma327B相比,Gemma4在核心基准测试中表现突飞猛进:
数学竞赛:在 AIME2026 测试中的得分从 20.8% 跃升至89.2%。
编程实力:Codeforces ELO 评级从 110 跃升至2150。在 LiveCodeBench 上的表现从 29.1% 提升至 80.0%,使其成为目前最强大的开源编程助手之一。
综合推理能力:在研究生级科学问题(GPQA Diamond)上的得分几乎翻倍,从42.4%跃升至84.3%。
多语言能力:原生支持超过140种语言,在MMMLU测试中取得88.4%的得分。

核心功能:内置“思考模式”与代理能力
Gemma4不仅拥有更多参数,其交互逻辑也与旗舰 Gemini 模型保持一致:
思考模式:包含内部推理模式,允许模型在给出答案前处理多步骤计划,从而显著提升复杂任务的准确率。
原生代理支持:支持函数调用和结构化 JSON 输出。Google 同时发布了开源的代理开发工具包 (ADK),使设备端模型能够充当“智能代理”。
深度多模态:所有版本均支持图像和视频输入。即使是较小的模型,也额外包含用于语音识别和翻译的音频编码器。
行业视角:开源领域的“权力重组”
过去一年间,国内开源模型(如DeepSeek、Qwen和GLM)发展迅猛,在一定程度上削弱了谷歌在开源领域的影响力。Gemma4的发布标志着谷歌正通过“极致的边缘端工程”和“更彻底的许可开放”重返前沿。
结论:当科技巨头开始谈论“真诚”时
内部细节曝光:下一代 Gemini 算力紧张,内部团队在开发优先级和资源分配上存在分歧
报告显示,谷歌备受期待的下一代 Gemini 模型发布已被推迟。由于内部在开发优先级和资源分配上存在分歧,加上计算能力有限以及复杂的审批流程,导致发布时间延后了两个月。尽管谷歌拥有定制的 TPU 芯片,但由于模型训练、Google Cloud 服务以及众多消费和企业级 AI 应用对计算资源的需求相互竞争,谷歌仍面临计算资源短缺的问题。目前,高层管理人员正通过组织结构调整来解决这些部门间的冲突。与此同时,领导层也发生了变化,联合创始人谢尔盖·布林越来越多地参与到核心模型训练中,并倡导将资源专门用于
OpenAI 否认增长放缓担忧,称多个业务部门加速发展
针对外界对其销售增长放缓及未达内部基准的质疑,人工智能领域的领军企业 OpenAI 于 4 月 28 日(星期二)发表了一份信心十足的声明。该公司澄清称,其消费产品和企业服务正在快速推进,直接驳斥了近期关于业务放缓的猜测。针对该公司“未达成多项内部目标”的说法,OpenAI 将这些报道斥为“典型的标题党”。公司强调了企业对 AI 集成的强劲需求,并指出其广告业务早期增长前景良好。据 OpenAI 内部人士透露,公司内部情绪依然乐观。尽管市场竞争日益激烈,但公司正在向投资者传递信心,声称其商业
阿里巴巴超级杯:Qwen3.8-Max 重磅登场,代码与办公工具能力全面升级
阿里巴巴正式发布了Qwen3.8-Max,这是一款拥有2.4万亿参数的下一代基础大模型。这一重大AI进展在编码和专业办公任务等核心领域带来了显著的性能提升,展现了强大的技术能力。在权威的Arena大模型排名中,Qwen3.8-Max取得了令人瞩目的成绩,仅次于Anthropic的Claude系列,位居行业前列。这一里程碑标志着国内大模型在处理复杂任务方面取得了快速进展,为开发者和企业用户提供了先进的智能工具。该模型的API现已在Qwen AI平台上上线,并集成到新推出的“Qwen Offic





首页






