オプション
ニュース
ハギング・フェイス:企業がパフォーマンスを維持しながらAIコストを削減する方法

ハギング・フェイス:企業がパフォーマンスを維持しながらAIコストを削減する方法

2025年12月2日
104

ハギング・フェイス:企業がパフォーマンスを維持しながらAIコストを削減する方法

多くの企業は、AIの開発には膨大な計算能力が必要だと思い込み、単にリソースを増やすことを優先している。

しかし、ハギング・フェイスのAI・気候リーダーであるサーシャ・ルッチョーニは、別の道を提案する。AIをより賢く使うことに焦点を移したらどうだろう?追加的な(そしてしばしば過剰な)計算能力を執拗に追求する代わりに、企業はモデルのパフォーマンスと精度を向上させることができる。

ルッチョーニは、核心的な問題はアプローチにあると主張する。企業は、単に計算量を増やすのではなく、より賢い計算を目指すべきだという。

「より多くのFLOPS、より多くのGPU、より多くの時間を必要とすることに固執するあまり、私たちはよりインテリジェントな方法を見落としているのです」と彼女は説明する。

あらゆる規模の企業がAIをより効率的に導入するための、Hugging Faceの5つの重要な戦略を紹介しよう。

1: タスクに適したモデルを選択する

すべてのアプリケーションに対して、巨大で汎用的なモデルをデフォルトにしたいという衝動に駆られてはいけない。特化された、あるいは抽出されたモデルは、多くの場合、特定のタスクに対して同等、あるいはそれ以上の精度を達成することができます。

ルッチョーニの研究によれば、タスクに特化したモデルは、汎用モデルよりも20倍から30倍少ないエネルギー消費で済むという。「これらのモデルは、あらゆるクエリを処理するように設計された大規模な言語モデルとは異なり、単一の目的のために構築されています」と彼女は述べている。

ここでは、モデルの蒸留が重要である。本格的なモデルは、最初に学習させ、その後特定の機能のために改良することができる。例えば、Luccioni氏は、DeepSeek R1は非常に大規模であるため、ほとんどの組織では実行する余裕がなく、少なくとも8つのGPUを必要とすることが多いと指摘した。対照的に、蒸留されたバージョンは10倍から30倍小さくなり、単一のGPUで動作することができます。

彼女はまた、ゼロからトレーニングする必要をなくすオープンソースモデルの効率的な利点を強調した。適切なモデルを探すのにリソースを浪費していた数年前とは異なり、現在ではベースモデルから始めて、ニーズに合わせて微調整することができる。

ルッチョーニ氏は、「これにより、各自がモデルをトレーニングして計算資源を効果的に浪費するような孤立した取り組みではなく、協調的で漸進的なイノベーションが促進される」と語った。

ジェネレーティブAIのコストはしばしばその利点を上回り、企業の幻滅を招くという認識が広まっている。電子メールの作成や会議の議事録作成のような一般的な用途は純粋に役立つが、タスクに特化したモデルは依然としてかなりの労力を必要とする。ルッチョーニによれば、既製のモデルでは不十分であることが多く、価格も高い。

このギャップを埋めることが、付加価値の次のフロンティアとなる。「ほとんどの企業は、特定のタスクの達成を望んでいる。「彼らは人工知能(AGI)を求めているのではなく、特化した知能を求めているのです。それが私たちが取り組むべき課題なのです」。

2.効率をデフォルトにする

ナッジ理論」の原則をシステム設計に取り入れ、保守的な計算予算を設定し、常時稼働の生成機能を制限し、高コストの計算モードを選択するようユーザーに求める。

行動科学における "ナッジ理論 "とは、積極的な行動を促すために選択をさりげなく誘導することである。ルッチョーニは、テイクアウトの食事にカトラリーを提供する典型的な例を挙げた。食器をデフォルトで提供するのではなく、オプトインで選択できるようにすることで、無駄を劇的に減らすことができる。

「オプトアウトモデルからオプトインモデルにシフトするだけで、ユーザーの行動に強力な影響を与えることができます」とルッチョーニ氏は説明する。

デフォルトの設定は、しばしば不必要な利用やコスト増につながる。例えば、検索エンジンの中には、検索結果の上部にAIの要約を自動生成するものもある。ルッチョーニ氏はまた、最近OpenAIのGPT-5を使用した際、非常に単純なクエリであっても、モデルがデフォルトで完全な推論モードになることを観察した。

「私にとっては、それは例外です。"人生の意味は何ですか?"と尋ねるなら、確かにAIの要約は役に立つかもしれません。しかし、『モントリオールの天気はどうですか』とか『近所の薬局の営業時間は?生成的な要約は必要ない。デフォルトは推論なしであるべきである"

3.ハードウェア利用の最適化

バッチ処理の実装、数値精度の調整、特定のハードウェア世代に合わせたバッチサイズの微調整を行い、無駄なメモリと電力消費を最小限に抑える。

企業は具体的なニーズを評価すべきである:モデルは継続的に実行する必要があるのか?モデルは継続的に実行する必要があるのか?このような場合、常時最適化は不可欠である、とLuccioni氏は指摘する。モデルを定期的に実行してメモリを節約したり、バッチ処理でメモリ使用を最適化したりすることもできる。

工学的な課題ではありますが、非常に特殊な課題であるため、『すべてのモデルを蒸留せよ』とか『すべてのモデルの精度を変更せよ』といった包括的なアドバイスをすることは困難です」とルッチョーニ氏は言う。

最近の研究では、理想的なバッチサイズは、特定のモデルやバージョンに至るまで、ハードウェアに大きく依存することを発見した。バッチサイズを1単位増やすだけで、より多くのメモリ・リソースが必要になるため、エネルギー使用量が増えることもある。

「これは、人々が見落としがちな点です。バッチサイズを最大化すればいい』と考えるが、真の効率は、これらすべての変数を綿密に調整することから生まれる。その結果、高度に最適化されたシステムができあがるのですが、それは非常に特殊な状況に合わせて調整されたものなのです」とルッチョーニは説明する。

4.エネルギーの透明性を高める

インセンティブは変化を促す。これを念頭に、ハギング・フェイスは今年初め、AIエネルギー・スコアを立ち上げた。このイニシアティブは、1つ星から5つ星までの評価システムを用いてエネルギー効率を促進するもので、最も効率的なモデルは「5つ星」の指定を受ける。

これは「AIのためのエネルギー・スター」ともいえるもので、効率基準を定め、対象となる家電製品にそのロゴを表示する、長年にわたる連邦政府のプログラムにヒントを得たものである。

「何十年もの間、この星評価は強力な動機づけでした。人々はそれを望んでいた。「エネルギー・スコアで同じようなインパクトを達成することは素晴らしいことです」。

ハギング・フェイスは、9月にディープシークやGPT-ossのような新しいモデルで更新し、6ヶ月ごと、あるいは新しいモデルが登場するたびに更新し続ける予定である。その目的は、モデル開発者が高評価を「名誉の証」とみなすことだ、とルッチョーニは語った。

5.コンピュート数が多ければ多いほど良い」という考え方を見直す

最大のGPUクラスターを追い求めるのではなく、こう問い直すことから始めよう:「望む結果を達成するための最もインテリジェントな方法は何か?数多くのアプリケーションにおいて、よりスマートなアーキテクチャと、よりよくキュレーションされたデータセットは、総当たり的なスケーリングよりも良い結果をもたらします。

「おそらくほとんどの人は、考えているほど多くのGPUを必要としていないと思います」とLuccioni氏は述べた。彼女は、GPUが処理する実際のタスク、GPUが必要な理由、そのようなタスクが以前はどのように実行されていたのか、GPUを追加することで実際にどのような具体的なメリットが得られるのかを再考するよう企業に促した。

「より大きなクラスタが必要だと誰もが感じるようになった。「重要なのは、AIを何のために使うのか、どのような具体的なテクニックが必要なのか、そしてそのテクニックが本当に要求するものは何なのかを分析することです。

関連記事
Metaの新型AIチップ、9月に生産開始へ Metaの新型AIチップ、9月に生産開始へ ロイターが引用した社内メモによると、前例のない部品不足の中でGPUのコストを削減するため、Metaは9月からAI専用チップの最新バージョンの生産を開始する計画だ。同メモによると、少なくとも1つのチップが約6週間でテスト段階を完了した。Metaはチップの設計においてブロードコムと協力しているが、製造は台湾のTSMCに委託する予定だ。また、同報道によると、同社はサムスンからRAMを、サンディスクから
Amazonは2025年にAIに1,000億ドルをコミットします Amazonは2025年にAIに1,000億ドルをコミットします DeepseekがAI予算の減少の時代を導くことを示唆している最近の話題にもかかわらず、Big Techがブレーキを打っているという兆候はありません。それどころか、彼らはガスを踏んでいます。 Amazonは、1,000億ドルを超えるCAPIを予測するための最新の巨人です。
Nvidiaは次世代GPUを発表します:Blackwell Ultra、Vera Rubin、Feynman Nvidiaは次世代GPUを発表します:Blackwell Ultra、Vera Rubin、Feynman 火曜日にサンノゼで開催されたNVIDIAのGTC 2025会議で、CEOのJensen Huangは、今後数か月で市場に出回るGPUSセットのラインナップを発表しました。ショーのスター? Vera Rubin GPUは、2026年後半のリリースを予定しています。この獣は数十ギガバイトの記憶を誇っていて、監護権が付いています
関連特集おすすめ
チャットボット 面接練習用のベストなAI会話トレーニングツール
面接練習用のベストなAI会話トレーニングツール

2026年最新版・最高評価のAI会話トレーニングツールが、面接練習に最適です。XIX.AIにてご提供しています!この厳選コレクションには、現実世界での厳格なテストを経て正確なフィードバックを提供する強力なツールが含まれています。無料版と有料版の比較や詳細なランキングをご覧いただき、自信とスキルを高めるための必須オプションをお選びください。今すぐ探索して、面接成功に最適なツールを見つけましょう!

12 ツール
xix.ai
デザインとアート クリエイティブな実験に最適なAIスタイル転送ツール
クリエイティブな実験に最適なAIスタイル転送ツール

2026年版 クリエイティブな実験に最適な、最新・最高評価のAIスタイル転送ツール!XIX.AIは、実地テストと厳格なランキングを通じて卓越した結果をもたらす、強力で画期的な「必試」ツールを厳選しました。これらのトップソリューションは、コンテンツ制作を加速させ、無限の創造的可能性を切り拓くことで、クリエイターの生産性を大幅に向上させます。 今すぐチェックして、あなたにぴったりのツールを見つけ、今日から創作を始めましょう!

9 ツール
xix.ai
漫画制作 ビジュアルストーリーテリングに最適なAI吹き出しツール
ビジュアルストーリーテリングに最適なAI吹き出しツール

2026年版、ビジュアルストーリーテリングに最適な高評価AIダイアログバブルツールがXIX.AIに登場!この厳選コレクションには、クリエイターの生産性を高め、創作上のボトルネックを解消する、画期的な強力ツールが揃っています。 無料版と有料版の比較、実地テストの結果、最新のランキングを確認して、魅力的なビジュアルストーリーを構築するのに最適な、ぜひ試すべきソリューションを見つけましょう。今すぐチェックして、あなたにぴったりのツールを発見してください!

10 ツール
xix.ai
ミーティングアシスタント AI会議要約ツールのトップ選定:決定事項とフォローアップを明確に把握
AI会議要約ツールのトップ選定:決定事項とフォローアップを明確に把握

2026年版:意思決定の追跡を明確にし、フォローアップを容易にする、高評価のAI会議要約ツールベストセレクション。この厳選リストでは、会議メモの自動化、重要なアクション項目の特定、すべてのプロジェクトにわたるチーム連携の効率化を通じて、生産性を劇的に向上させる、強力で画期的なソリューションをご紹介します。 無料版と有料版の比較、実地テストの結果、毎週更新されるランキングを参考に、最適なツールを見つけてください。今すぐチェックして、AIの力を最大限に活用しましょう!

9 ツール
xix.ai
データ分析 最強のAIデータクリーニングツール:欠損値や重複データを迅速に修正
最強のAIデータクリーニングツール:欠損値や重複データを迅速に修正

2026年最新かつ最も評価の高いAIデータクリーニングツールをご紹介。欠損値や重複データを迅速に修正できるこれらのツールは、生産性を大幅に向上させる強力なソリューションです。各ツールは信頼性を確保するため、厳格な実環境でのテストを経ています。無料版と有料版の比較情報もご用意しており、あなたのニーズに最も合ったツールを見つけ出せます。今すぐXIX.AIで詳細を確認し、AI活用の強みを最大限に引き出しましょう。

11 ツール
xix.ai
デザインとアート アーティストのための最高のAIクリエイティブアイディエーションツール:ビジュアルブロックを打破する
アーティストのための最高のAIクリエイティブアイディエーションツール:ビジュアルブロックを打破する

2026年最新版・最高評価のAIクリエイティブ発想ツールは、XIX.AIによって厳選され、クリエイターが視覚的な壁を打破し、創造性を即座に高めることを支援します。これらの革新的なツールは、実際のテスト結果、無料版と有料版の詳細比較、そして週次更新されるランキングを提供しています。コンテンツ制作を加速し、AIによる優位性を解き放つための最適なツールを見つけてください。今すぐ探索しましょう!

14 ツール
xix.ai
コメント (0)
0/500
OR