Google 將 Gemma 4 開源,憑藉 310 億參數與頂尖模型一較高下
4月3日凌晨4時03分,Google DeepMind 正式推出其全新的開源模型系列Gemma4。此次發布恰好距上一版本發布滿一年。Google 不僅在性能上實現了「代際飛躍」,更在開源承諾方面採取了重大舉措:將授權協議從自家專有協議改為廣泛採用的Apache 2.0 授權。此項變更讓開發者得以自由地將這些模型用於商業用途並進行修改。

完整陣容:涵蓋行動裝置至工作站的四款模型
Gemma4推出四款各具特色的模型,以涵蓋所有應用場景:
31B Dense(旗艦版):具備 310 億個完全激活的參數,並支援長達 256K 的超長上下文。該模型在 Arena AI 開源排行榜上名列第三。其未量化版本可在單張 H100 GPU 上運行。
26B A4B MoE(性價比之王):採用專家混合(Mixture-of-Experts)架構,總參數達 252 億,每次推論僅需激活 38 億參數。其推理速度媲美 40 億參數模型,品質卻超越同級產品,在排行榜上名列第六。
E4B 與 E2B(邊緣精英):針對行動裝置與嵌入式設備進行優化。透過「每層嵌入式」技術,有效參數分別壓縮至 45 億與 23 億。E2B 模型在特定裝置上可將記憶體使用量降至 1.5GB 以下。

效能飛躍:程式碼與數學能力大幅提升
相較於前一代的Gemma327B,Gemma4在核心基準測試中展現出顯著的進步:
數學競賽:在 AIME2026 測試中的得分從 20.8% 飆升至89.2%。
程式設計實力:其 Codeforces ELO 評分從 110 提升至2150。在 LiveCodeBench 上的表現從 29.1% 躍升至 80.0%,使其成為目前功能最強大的開源程式設計助手之一。
綜合推理能力:在研究生級科學題目(GPQA Diamond)上的得分幾乎翻倍,從 42.4% 躍升至84.3%。
多語言能力:原生支援超過 140 種語言,在 MMMLU 測評中取得 88.4% 的成績。

核心功能:內建「思考模式」與代理能力
Gemma4不僅僅是參數的增加;其互動邏輯與旗艦級 Gemini 模型保持一致:
思考模式:內建推理模式,使模型能在提供答案前處理多步驟計畫,顯著提升複雜任務的準確性。
原生代理支援:支援函式呼叫與結構化 JSON 輸出。Google 同時發布了開源的代理開發套件 (ADK),使裝置端模型能作為「智能代理」運作。
深度多模態:所有版本均支援圖像與影片輸入。即使是較小的模型,也額外內建了用於語音辨識與翻譯的音訊編碼器。
產業觀點:開源領域的「權力重組」
過去一年間,國內開源模型(如 DeepSeek、Qwen 和 GLM)發展迅速,在某種程度上削弱了 Google 在開源領域的影響力。Gemma4的發布標誌著 Google 透過「極致的邊緣端工程」與「更徹底的授權開放」重返領先地位。
結論:當科技巨頭開始談論「誠意」時
相關文章
內部細節曝光:下一代 Gemini 算力緊張,內部團隊在開發優先順序和資源分配上存在分歧
報告顯示,谷歌備受期待的下一代 Gemini 模型釋出已被推遲。由於內部在開發優先順序和資源分配上存在分歧,加上計算能力有限以及複雜的審批流程,導致釋出時間延後了兩個月。儘管谷歌擁有定製的 TPU 晶片,但由於模型訓練、Google Cloud 服務以及眾多消費和企業級 AI 應用對計算資源的需求相互競爭,谷歌仍面臨計算資源短缺的問題。目前,高層管理人員正透過組織結構調整來解決這些部門間的衝突。與此同時,領導層也發生了變化,聯合創始人謝爾蓋·布林越來越多地參與到核心模型訓練中,並倡導將資源專門用於
OpenAI 否認增長放緩擔憂,稱多個業務部門加速發展
針對外界對其銷售增長放緩及未達內部基準的質疑,人工智慧領域的領軍企業 OpenAI 於 4 月 28 日(星期二)發表了一份信心十足的宣告。該公司澄清稱,其消費產品和企業服務正在快速推進,直接駁斥了近期關於業務放緩的猜測。針對該公司“未達成多項內部目標”的說法,OpenAI 將這些報道斥為“典型的標題黨”。公司強調了企業對 AI 整合的強勁需求,並指出其廣告業務早期增長前景良好。據 OpenAI 內部人士透露,公司內部情緒依然樂觀。儘管市場競爭日益激烈,但公司正在向投資者傳遞信心,聲稱其商業
阿里巴巴超級盃:Qwen3.8-Max 重磅登場,程式碼與辦公工具能力全面升級
阿里巴巴正式釋出了Qwen3.8-Max,這是一款擁有2.4萬億引數的下一代基礎大模型。這一重大AI進展在編碼和專業辦公任務等核心領域帶來了顯著的效能提升,展現了強大的技術能力。在權威的Arena大模型排名中,Qwen3.8-Max取得了令人矚目的成績,僅次於Anthropic的Claude系列,位居行業前列。這一里程碑標誌著國內大模型在處理複雜任務方面取得了快速進展,為開發者和企業使用者提供了先進的智慧工具。該模型的API現已在Qwen AI平臺上上線,並整合到新推出的“Qwen Offic
相關專題推薦
評論 (0)
0/500
4月3日凌晨4時03分,Google DeepMind 正式推出其全新的開源模型系列Gemma4。此次發布恰好距上一版本發布滿一年。Google 不僅在性能上實現了「代際飛躍」,更在開源承諾方面採取了重大舉措:將授權協議從自家專有協議改為廣泛採用的Apache 2.0 授權。此項變更讓開發者得以自由地將這些模型用於商業用途並進行修改。

完整陣容:涵蓋行動裝置至工作站的四款模型
Gemma4推出四款各具特色的模型,以涵蓋所有應用場景:
31B Dense(旗艦版):具備 310 億個完全激活的參數,並支援長達 256K 的超長上下文。該模型在 Arena AI 開源排行榜上名列第三。其未量化版本可在單張 H100 GPU 上運行。
26B A4B MoE(性價比之王):採用專家混合(Mixture-of-Experts)架構,總參數達 252 億,每次推論僅需激活 38 億參數。其推理速度媲美 40 億參數模型,品質卻超越同級產品,在排行榜上名列第六。
E4B 與 E2B(邊緣精英):針對行動裝置與嵌入式設備進行優化。透過「每層嵌入式」技術,有效參數分別壓縮至 45 億與 23 億。E2B 模型在特定裝置上可將記憶體使用量降至 1.5GB 以下。

效能飛躍:程式碼與數學能力大幅提升
相較於前一代的Gemma327B,Gemma4在核心基準測試中展現出顯著的進步:
數學競賽:在 AIME2026 測試中的得分從 20.8% 飆升至89.2%。
程式設計實力:其 Codeforces ELO 評分從 110 提升至2150。在 LiveCodeBench 上的表現從 29.1% 躍升至 80.0%,使其成為目前功能最強大的開源程式設計助手之一。
綜合推理能力:在研究生級科學題目(GPQA Diamond)上的得分幾乎翻倍,從 42.4% 躍升至84.3%。
多語言能力:原生支援超過 140 種語言,在 MMMLU 測評中取得 88.4% 的成績。

核心功能:內建「思考模式」與代理能力
Gemma4不僅僅是參數的增加;其互動邏輯與旗艦級 Gemini 模型保持一致:
思考模式:內建推理模式,使模型能在提供答案前處理多步驟計畫,顯著提升複雜任務的準確性。
原生代理支援:支援函式呼叫與結構化 JSON 輸出。Google 同時發布了開源的代理開發套件 (ADK),使裝置端模型能作為「智能代理」運作。
深度多模態:所有版本均支援圖像與影片輸入。即使是較小的模型,也額外內建了用於語音辨識與翻譯的音訊編碼器。
產業觀點:開源領域的「權力重組」
過去一年間,國內開源模型(如 DeepSeek、Qwen 和 GLM)發展迅速,在某種程度上削弱了 Google 在開源領域的影響力。Gemma4的發布標誌著 Google 透過「極致的邊緣端工程」與「更徹底的授權開放」重返領先地位。
結論:當科技巨頭開始談論「誠意」時
內部細節曝光:下一代 Gemini 算力緊張,內部團隊在開發優先順序和資源分配上存在分歧
報告顯示,谷歌備受期待的下一代 Gemini 模型釋出已被推遲。由於內部在開發優先順序和資源分配上存在分歧,加上計算能力有限以及複雜的審批流程,導致釋出時間延後了兩個月。儘管谷歌擁有定製的 TPU 晶片,但由於模型訓練、Google Cloud 服務以及眾多消費和企業級 AI 應用對計算資源的需求相互競爭,谷歌仍面臨計算資源短缺的問題。目前,高層管理人員正透過組織結構調整來解決這些部門間的衝突。與此同時,領導層也發生了變化,聯合創始人謝爾蓋·布林越來越多地參與到核心模型訓練中,並倡導將資源專門用於
OpenAI 否認增長放緩擔憂,稱多個業務部門加速發展
針對外界對其銷售增長放緩及未達內部基準的質疑,人工智慧領域的領軍企業 OpenAI 於 4 月 28 日(星期二)發表了一份信心十足的宣告。該公司澄清稱,其消費產品和企業服務正在快速推進,直接駁斥了近期關於業務放緩的猜測。針對該公司“未達成多項內部目標”的說法,OpenAI 將這些報道斥為“典型的標題黨”。公司強調了企業對 AI 整合的強勁需求,並指出其廣告業務早期增長前景良好。據 OpenAI 內部人士透露,公司內部情緒依然樂觀。儘管市場競爭日益激烈,但公司正在向投資者傳遞信心,聲稱其商業
阿里巴巴超級盃:Qwen3.8-Max 重磅登場,程式碼與辦公工具能力全面升級
阿里巴巴正式釋出了Qwen3.8-Max,這是一款擁有2.4萬億引數的下一代基礎大模型。這一重大AI進展在編碼和專業辦公任務等核心領域帶來了顯著的效能提升,展現了強大的技術能力。在權威的Arena大模型排名中,Qwen3.8-Max取得了令人矚目的成績,僅次於Anthropic的Claude系列,位居行業前列。這一里程碑標誌著國內大模型在處理複雜任務方面取得了快速進展,為開發者和企業使用者提供了先進的智慧工具。該模型的API現已在Qwen AI平臺上上線,並整合到新推出的“Qwen Offic





首頁






