オプション
ニュース
15億ドルの新ルーターモデルが93%の精度を達成、高額な再トレーニングコストを排除

15億ドルの新ルーターモデルが93%の精度を達成、高額な再トレーニングコストを排除

2025年11月24日
144

Katanemo Labs の研究者が、ユーザからのクエリを最も適切な大規模言語モデル(LLM)にインテリジェントに誘導するために設計された高度なルーティングモデルとフレームワーク Arch-Router を発表しました。

複数の LLM を活用する製品を開発している企業にとって、Arch-Rolver は中心的なジレンマである、柔軟性に欠けるロジックや更新が必要なたびに高価な再トレーニングに依存することなく、各リクエストをタスクに最適なモデルに自動的にルーティングする方法に取り組んでいます。

LLMルーティングの課題

利用可能なLLMの種類が増えるにつれて、開発者は単一モデル構成から、コードの生成、テキストの要約、画像の編集など、特殊な機能に対して異なるモデルの能力を利用するマルチモデルアーキテクチャに移行しつつあります。

LLMルーティングは、このようなシステムの構築と実行に不可欠な技術となっており、各ユーザークエリを、その処理に最も適したモデルに導くインテリジェントなトラフィックディレクタの役割を果たしている。

現在のルーティング・アプローチは、一般的に2つの主要なグループに分類される。タスク・ベースのルーティングは、あらかじめ定義されたタスク・カテゴリーに従ってクエリを割り当てるものであり、パフォーマンス・ベースのルーティングは、費用と出力品質の間の最良のトレードオフを追求するものである。

しかし、タスクベースのシステムは、ユーザーの意図があいまいであったり、会話の過程で変化したりする場合、特に複数回にわたる対話の場合、しばしば失敗する。一方、パフォーマンス・ベースのルーティングは、静的なベンチマーク結果を優先する傾向があり、実際のユーザーの好みを見落としたり、コストのかかる再トレーニングを行わずに新しいモデルへの適応が遅れることが多い。

Katanemo Labsの研究者が論文で述べているように、より深い問題は、「既存のルーティング手法には、実世界のアプリケーションにおいて実用的な限界がある」ということだ。大半はベンチマークの性能に最適化されているが、主観的な評価基準によって導かれる人間の嗜好は無視されている」。

研究チームは、"主観的な人間の判断を反映し、より高い透明性を提供し、モデルとアプリケーションの両方が進化しても容易に調整可能な "ルーティングシステムの重要性を強調している。

プリファレンスに沿ったルーティングのための新しいフレームワーク

これらの問題を克服するため、研究者たちは、ユーザーの好みに基づいて、入力されたクエリをルーティングルールに適合させる「プリファレンス・アラインド・ルーティング」フレームワークを開発した。

このシステムでは、ユーザーは2階層構造の "Domain-Action Taxonomy "を通じて、自然言語を使ってルーティングポリシーを定義する。この構造は、人々が自然にタスクを記述する方法を反映している。"法律 "や "金融 "といった大まかなカテゴリー(Domain)から始まり、"要約 "や "コーディング "といった特定のタスク(Action)へと掘り下げていく。

そして、各ポリシーが優先モデルにマッピングされ、開発者はベンチマーク指標だけでなく、実用的な要件に基づいてルーティングを選択できるようになる。論文によれば、"この分類法は、ユーザーが明確に定義され、構造化されたルーティングポリシーを作成するためのメンタルモデルとして機能する"。

ルーティングの手順は2段階に分かれている。第一に、嗜好に沿ったルーターモデルが、ユーザーのクエリーを利用可能な全てのポリシーと並べて評価し、最適なものを選択する。次に、選択されたポリシーと割り当てられたLLMをマッピング関数で接続する。

モデルを選択するロジックはポリシーの定義から分離されているため、開発者はルーティング・ルールを編集するだけでモデルを追加、削除、更新することができます。この分離により、モデルやアプリケーションが常に変化する本番環境に必要な柔軟性が実現される。

プリファレンスに沿ったルーティングフレームワーク(出典:arXiv)
プリファレンスに沿ったルーティングフレームワーク Source: arXiv

ポリシーの選択はArch-Routerによって行われます。Arch-Routerは、プリファレンスアウェアルーティングに最適化されたコンパクトな15億パラメータの言語モデルです。Arch-Routerはユーザのクエリとポリシーの説明の完全なリストを入力として受け取り、最適なポリシーの識別子を出力する。

ポリシーが入力に含まれているため、システムは推論中に新しいルートや更新されたルートに適応することができます。この生成的な戦略により、Arch-Routerは事前に訓練された理解を活用してクエリとポリシーの両方の意味を解釈し、完全な会話履歴を一度に分析することができます。

プロンプトに長大なポリシー・リストを含める際によく懸念されるのは、待ち時間が長くなるリスクだ。しかし、チームはArch-Routerを高効率に構築した。「広範なルーティング・ポリシーを使用しても、Arch-Routerのコンテキスト・ウィンドウを拡張しても、レイテンシにはほとんど影響しません」と、論文の共著者でKatanemo Labsの創設者/CEOであるSalman Paracha氏は言う。Arch-Routerは、"image_editing "や "document_creation "のような短いポリシー名しか出力しません。

Arch-Routerの動作

Arch-Routerを作成するために、チームは43,000のサンプルからなる入念に組み立てられたデータセットを使って、Qwen 2.5モデルの1.5Bパラメータバリアントを微調整した。そして、会話AIシステムをテストするために設計された4つの公開データセットで、OpenAI、Anthropic、Googleの主要な独自モデルとベンチマークを行った。

その結果、Arch-Routerは93.17%というトップの総合ルーティングスコアを達成し、他のすべてのモデル(トップクラスのプロプライエタリモデルを含む)を平均7.71%上回った。Arch-Routerの優位性は長時間の会話でより明らかになり、複数のやりとりにわたってコンテキストを維持する優れた能力が示されました。

Arch-Routerと他のモデルの比較(出典:arXiv)
Arch-Routerと他のモデルの比較 出典:ArXiv

実世界での使用において、この方法論はすでに複数の場面で応用されているとパラチャ氏は指摘する。例えば、オープンソースのコーディングプラットフォームでは、開発者はArch-Routerを利用して、「コード設計」、「コード理解」、「コード生成」といったワークフローのさまざまな部分を、それぞれのステップに最も効果的なLLMに導いている。同様に、組織はドキュメント作成タスクをClaude 3.7 Sonnetのようなモデルにルーティングする一方で、画像編集リクエストをGemini 2.5 Proに送ることができる。

このシステムはまた、"ユーザーがテキストの要約から事実に関する質問への回答まで、様々な活動を行う様々な分野のパーソナルアシスタントにも適しています "とParacha氏は説明し、"このような状況において、Arch-Routerは製品チームがユーザーの全体的な体験を統合し、向上させるのに役立ちます "と付け加えた。

このフレームワークは、Katanemo LabsのAIネイティブなエージェント用プロキシサーバーであるArchに組み込まれており、きめ細かいトラフィック管理ルールの実装をサポートしている。例えば、新しいLLMを追加する場合、チームは特定のポリシーの下でトラフィックのごく一部を新しいモデルにルーティングし、内部分析を使ってそのパフォーマンスを検証した後、自信を持ってすべてのトラフィックを移行させることができる。同社はまた、企業の開発者がこのワークフローをさらにスムーズに行えるよう、評価プラットフォームとのツールの統合にも取り組んでいる。

Arch-Routerの中核にあるのは、企業がバラバラのAI実装から脱却するのを支援することだ。「Arch-Router、そしてArchプラットフォーム全体は、開発者や企業が断片的なLLMの使用から、統一されたポリシーで管理されたシステムへと進化することを可能にします」とParacha氏は述べる。"ユーザーが幅広いタスクを実行するとき、私たちのプラットフォームは、タスクとモデルの多様性をまとまりのあるエクスペリエンスに変換し、最終的な製品をシームレスで直感的なものにします。"

関連記事
OpenAIは、10代の若者がChatGPTを使い始めてから数年を経て、より安全なChatGPTをリリースした OpenAIは、10代の若者がChatGPTを使い始めてから数年を経て、より安全なChatGPTをリリースした AIチャットボットに安全対策が欠如していたことによる一連の訴訟――これが10代の自殺やその他のメンタルヘルスの危機の一因となった――を受け、OpenAIは月曜日に「ChatGPT for Teens」を発表した。この新サービスには強化された安全機能が組み込まれており、学校現場でAIツールによって助長されている学業上の不正行為という深刻化する問題に対処している。教育的な観点から、「ChatGPT f
Google、AIによるディープフェイクを使ったなりすまし詐欺からユーザーを守るため、偽の着信検知機能を導入 Google、AIによるディープフェイクを使ったなりすまし詐欺からユーザーを守るため、偽の着信検知機能を導入 Googleは火曜日、AIによるディープフェイクを使ったなりすまし詐欺からユーザーを守るため、Androidに「偽の着信検出」機能を導入すると発表した。この機能は今月、Pixel端末を皮切りに、Android 12以降の端末向け「Phone by Google」アプリを通じて世界中で順次提供される。見知らぬ番号からの着信に応答することを避ける人が増えるにつれ、詐欺師たちは手口を変え、信頼できる電話
フロンティアAIラボ、異常挙動を示すモデルの封じ込め戦略の開示を拒否 フロンティアAIラボ、異常挙動を示すモデルの封じ込め戦略の開示を拒否 最近の調査によると、主要なAI研究所のうち、封じ込め対応計画を公表または実証しているところはごくわずかであることが示されている。封じ込め計画とは、AIシステムが人間の制御を覆そうとした場合の対応手順を定義するもので、どのアクセス権限を取り消すか、またいつシステムを完全にシャットダウンするかを具体的に規定している。この調査結果は、安全な最先端AI開発の実践を推進することに注力する組織「Guideli
関連特集おすすめ
作曲 曲のドラフト作成に最適なAIメロディ作成ツール
曲のドラフト作成に最適なAIメロディ作成ツール

2026年最新版 高評価のAIメロディ作成ツールで曲のドラフト作成!XIX.AIは、厳格な実世界テストを経て最高の作成体験を提供する、革新的な強力なコレクションを厳選しました。詳細な無料版と有料版の比較、正確なランキング、そして素晴らしい曲のドラフトを楽に作成し、創造的な生産性を大幅に向上させるためにぜひ試すべきオプションが見つかります。今すぐ探索して、あなたに最適なツールを見つけましょう!

8 ツール
xix.ai
チャットボット 面接練習用のベストなAI会話トレーニングツール
面接練習用のベストなAI会話トレーニングツール

2026年最新版・最高評価のAI会話トレーニングツールが、面接練習に最適です。XIX.AIにてご提供しています!この厳選コレクションには、現実世界での厳格なテストを経て正確なフィードバックを提供する強力なツールが含まれています。無料版と有料版の比較や詳細なランキングをご覧いただき、自信とスキルを高めるための必須オプションをお選びください。今すぐ探索して、面接成功に最適なツールを見つけましょう!

12 ツール
xix.ai
デザインとアート クリエイティブな実験に最適なAIスタイル転送ツール
クリエイティブな実験に最適なAIスタイル転送ツール

2026年版 クリエイティブな実験に最適な、最新・最高評価のAIスタイル転送ツール!XIX.AIは、実地テストと厳格なランキングを通じて卓越した結果をもたらす、強力で画期的な「必試」ツールを厳選しました。これらのトップソリューションは、コンテンツ制作を加速させ、無限の創造的可能性を切り拓くことで、クリエイターの生産性を大幅に向上させます。 今すぐチェックして、あなたにぴったりのツールを見つけ、今日から創作を始めましょう!

9 ツール
xix.ai
漫画制作 ビジュアルストーリーテリングに最適なAI吹き出しツール
ビジュアルストーリーテリングに最適なAI吹き出しツール

2026年版、ビジュアルストーリーテリングに最適な高評価AIダイアログバブルツールがXIX.AIに登場!この厳選コレクションには、クリエイターの生産性を高め、創作上のボトルネックを解消する、画期的な強力ツールが揃っています。 無料版と有料版の比較、実地テストの結果、最新のランキングを確認して、魅力的なビジュアルストーリーを構築するのに最適な、ぜひ試すべきソリューションを見つけましょう。今すぐチェックして、あなたにぴったりのツールを発見してください!

10 ツール
xix.ai
ミーティングアシスタント AI会議要約ツールのトップ選定:決定事項とフォローアップを明確に把握
AI会議要約ツールのトップ選定:決定事項とフォローアップを明確に把握

2026年版:意思決定の追跡を明確にし、フォローアップを容易にする、高評価のAI会議要約ツールベストセレクション。この厳選リストでは、会議メモの自動化、重要なアクション項目の特定、すべてのプロジェクトにわたるチーム連携の効率化を通じて、生産性を劇的に向上させる、強力で画期的なソリューションをご紹介します。 無料版と有料版の比較、実地テストの結果、毎週更新されるランキングを参考に、最適なツールを見つけてください。今すぐチェックして、AIの力を最大限に活用しましょう!

9 ツール
xix.ai
データ分析 最強のAIデータクリーニングツール:欠損値や重複データを迅速に修正
最強のAIデータクリーニングツール:欠損値や重複データを迅速に修正

2026年最新かつ最も評価の高いAIデータクリーニングツールをご紹介。欠損値や重複データを迅速に修正できるこれらのツールは、生産性を大幅に向上させる強力なソリューションです。各ツールは信頼性を確保するため、厳格な実環境でのテストを経ています。無料版と有料版の比較情報もご用意しており、あなたのニーズに最も合ったツールを見つけ出せます。今すぐXIX.AIで詳細を確認し、AI活用の強みを最大限に引き出しましょう。

11 ツール
xix.ai
コメント (1)
0/500
WillGarcía
WillGarcía 2026年4月6日 11:00:35 JST

Arch-Routerの構想は面白いね。社内でどのLLMを使うか毎回悩んでたから、これがあれば効率化に繋がりそう。ただ、精度93%って、結局残りの7%で重大なミスルーティングが起きたりしない? 医療や法務のようなクリティカルな分野への適用は少し不安かな。😅 開発元のKatanemo Labs、これでインフラ市場に本格参戦するつもり?

OR