GoogleとNVIDIAが「DiffusionGemma」をオープンソース化し、シングルカードでの推論速度を4倍に高速化
2026年6月10日、Googleは、従来の「1語ずつテキストを生成する」という自己回帰型パラダイムから脱却した、実験的なオープンソース言語モデル「DiffusionGemma」を公開した。 このモデルは、画像AIにおける拡散メカニズムをテキスト生成に応用した先駆的なもので、ランダムなノイズから始まり、反復的に精緻化を行いながら、1ステップごとに256トークンのブロックを並列に出力します。

ハードウェア性能の面では、NVIDIAによる高度な最適化により、シングルGPU・シングルユーザーモードにおいて、同等の従来型モデルと比較して約4倍の速度で実行可能です。 H100 GPUでは、1回のリクエストあたり最大1,000トークン/秒の出力速度を達成し、RTX 5090のようなハイエンドのコンシューマー向けGPUであっても、700トークン/秒を超える性能を発揮します。
DiffusionGemma は 260 億個のパラメータを持ち、Mixture-of-Experts (MoE) アーキテクチャを採用しており、1 ステップあたり 38 億個のパラメータのみを活性化します。 標準的なベンチマークでは、テキスト生成の品質と精度は従来のGemma4シリーズモデルにわずかに及ばないものの、その独自の「フルブロック認識」機能により、自己回帰モデルの「後方のみ」という制限を克服しています。 生成中にすべてのトークンが相互に参照し合えるため、テキスト補完、コード補完、数独の解法、アミノ酸配列の処理など、非線形データや構造化データを含むタスクに優れています。

このモデルの重みは現在、Apache 2.0ライセンスの下でHugging Faceにてオープンソース化されており、vLLMやMLXなどの主流の推論フレームワークとシームレスに連携します。この取り組みは、GPUの演算能力におけるメモリ帯域幅の制約を取り除くだけでなく、複雑な論理処理や非線形テキスト生成における将来のAIアプリケーションに向けた新たな技術的道筋を切り開くものです。
関連記事
DeepMindのCEOハサビス氏:1日6時間睡眠し、通常午前1時頃に活力を感じます。
フォーチュンは最近、Google DeepMindのCEOであるデミス・ハサビスへのインタビューを掲載し、彼の休息と生産性に対する非伝統的なアプローチを明らかにした。ハサビスは、睡眠時間が非常に短いことを明かし、覚醒時間を2つの明確な作業ブロックに構造化していると語った。彼の睡眠習慣について、ハサビスは「6時間の睡眠を目標としているが、私の習慣は典型的ではない。一日中効果的に機能できる」と述べた。彼は、6時間未満の睡眠は脳の健康に悪影響を及ぼすことを強調した。2010年にDeepMindを共
OpenAIとAnthropic、収益の伸び悩みにもかかわらず市場シェア争いを繰り広げる
OpenAIが収益目標を達成できなかったとする最近の報道を受け、今週火曜日にハイテク株に売り圧力が生じたにもかかわらず、AI研究機関への民間投資家は依然として堅調だ。経験豊富な出資者たちは、メディアによる否定的な報道にもかかわらず、投資額を減らすつもりはないことを明らかにしている。アナリストらは、現在のAI競争はまだ初期段階にあると見ており、「勝者総取り」という結末はあり得ないと見ている。高いコン
カリフォルニア州の自動運転車規制:違反切符、ジオフェンス、そして100万マイルという新たな時代
Guident社は南フロリダでAuveTechのシャトルを運行しており、同社の遠隔監視技術を活用して、ウェストパームビーチでの4マイルのルートとボカラトンでの1マイルのルートを管理している。 | 提供:Guidentカリフォルニア州は、自動運転車の規制環境を再定義しつつあり、テクノロジー業界の「迅速に動き、失敗を恐れない」という考え方から、厳格な説明責任と厳しい走行距離要件へと移行している。Gui
関連特集おすすめ
コメント (0)
0/500
2026年6月10日、Googleは、従来の「1語ずつテキストを生成する」という自己回帰型パラダイムから脱却した、実験的なオープンソース言語モデル「DiffusionGemma」を公開した。 このモデルは、画像AIにおける拡散メカニズムをテキスト生成に応用した先駆的なもので、ランダムなノイズから始まり、反復的に精緻化を行いながら、1ステップごとに256トークンのブロックを並列に出力します。

ハードウェア性能の面では、NVIDIAによる高度な最適化により、シングルGPU・シングルユーザーモードにおいて、同等の従来型モデルと比較して約4倍の速度で実行可能です。 H100 GPUでは、1回のリクエストあたり最大1,000トークン/秒の出力速度を達成し、RTX 5090のようなハイエンドのコンシューマー向けGPUであっても、700トークン/秒を超える性能を発揮します。
DiffusionGemma は 260 億個のパラメータを持ち、Mixture-of-Experts (MoE) アーキテクチャを採用しており、1 ステップあたり 38 億個のパラメータのみを活性化します。 標準的なベンチマークでは、テキスト生成の品質と精度は従来のGemma4シリーズモデルにわずかに及ばないものの、その独自の「フルブロック認識」機能により、自己回帰モデルの「後方のみ」という制限を克服しています。 生成中にすべてのトークンが相互に参照し合えるため、テキスト補完、コード補完、数独の解法、アミノ酸配列の処理など、非線形データや構造化データを含むタスクに優れています。

このモデルの重みは現在、Apache 2.0ライセンスの下でHugging Faceにてオープンソース化されており、vLLMやMLXなどの主流の推論フレームワークとシームレスに連携します。この取り組みは、GPUの演算能力におけるメモリ帯域幅の制約を取り除くだけでなく、複雑な論理処理や非線形テキスト生成における将来のAIアプリケーションに向けた新たな技術的道筋を切り開くものです。
DeepMindのCEOハサビス氏:1日6時間睡眠し、通常午前1時頃に活力を感じます。
フォーチュンは最近、Google DeepMindのCEOであるデミス・ハサビスへのインタビューを掲載し、彼の休息と生産性に対する非伝統的なアプローチを明らかにした。ハサビスは、睡眠時間が非常に短いことを明かし、覚醒時間を2つの明確な作業ブロックに構造化していると語った。彼の睡眠習慣について、ハサビスは「6時間の睡眠を目標としているが、私の習慣は典型的ではない。一日中効果的に機能できる」と述べた。彼は、6時間未満の睡眠は脳の健康に悪影響を及ぼすことを強調した。2010年にDeepMindを共
OpenAIとAnthropic、収益の伸び悩みにもかかわらず市場シェア争いを繰り広げる
OpenAIが収益目標を達成できなかったとする最近の報道を受け、今週火曜日にハイテク株に売り圧力が生じたにもかかわらず、AI研究機関への民間投資家は依然として堅調だ。経験豊富な出資者たちは、メディアによる否定的な報道にもかかわらず、投資額を減らすつもりはないことを明らかにしている。アナリストらは、現在のAI競争はまだ初期段階にあると見ており、「勝者総取り」という結末はあり得ないと見ている。高いコン





家






