オプション
ニュース
15億ドルの新ルーターモデルが93%の精度を達成、高額な再トレーニングコストを排除

15億ドルの新ルーターモデルが93%の精度を達成、高額な再トレーニングコストを排除

2025年11月24日
145

Katanemo Labs の研究者が、ユーザからのクエリを最も適切な大規模言語モデル(LLM)にインテリジェントに誘導するために設計された高度なルーティングモデルとフレームワーク Arch-Router を発表しました。

複数の LLM を活用する製品を開発している企業にとって、Arch-Rolver は中心的なジレンマである、柔軟性に欠けるロジックや更新が必要なたびに高価な再トレーニングに依存することなく、各リクエストをタスクに最適なモデルに自動的にルーティングする方法に取り組んでいます。

LLMルーティングの課題

利用可能なLLMの種類が増えるにつれて、開発者は単一モデル構成から、コードの生成、テキストの要約、画像の編集など、特殊な機能に対して異なるモデルの能力を利用するマルチモデルアーキテクチャに移行しつつあります。

LLMルーティングは、このようなシステムの構築と実行に不可欠な技術となっており、各ユーザークエリを、その処理に最も適したモデルに導くインテリジェントなトラフィックディレクタの役割を果たしている。

現在のルーティング・アプローチは、一般的に2つの主要なグループに分類される。タスク・ベースのルーティングは、あらかじめ定義されたタスク・カテゴリーに従ってクエリを割り当てるものであり、パフォーマンス・ベースのルーティングは、費用と出力品質の間の最良のトレードオフを追求するものである。

しかし、タスクベースのシステムは、ユーザーの意図があいまいであったり、会話の過程で変化したりする場合、特に複数回にわたる対話の場合、しばしば失敗する。一方、パフォーマンス・ベースのルーティングは、静的なベンチマーク結果を優先する傾向があり、実際のユーザーの好みを見落としたり、コストのかかる再トレーニングを行わずに新しいモデルへの適応が遅れることが多い。

Katanemo Labsの研究者が論文で述べているように、より深い問題は、「既存のルーティング手法には、実世界のアプリケーションにおいて実用的な限界がある」ということだ。大半はベンチマークの性能に最適化されているが、主観的な評価基準によって導かれる人間の嗜好は無視されている」。

研究チームは、"主観的な人間の判断を反映し、より高い透明性を提供し、モデルとアプリケーションの両方が進化しても容易に調整可能な "ルーティングシステムの重要性を強調している。

プリファレンスに沿ったルーティングのための新しいフレームワーク

これらの問題を克服するため、研究者たちは、ユーザーの好みに基づいて、入力されたクエリをルーティングルールに適合させる「プリファレンス・アラインド・ルーティング」フレームワークを開発した。

このシステムでは、ユーザーは2階層構造の "Domain-Action Taxonomy "を通じて、自然言語を使ってルーティングポリシーを定義する。この構造は、人々が自然にタスクを記述する方法を反映している。"法律 "や "金融 "といった大まかなカテゴリー(Domain)から始まり、"要約 "や "コーディング "といった特定のタスク(Action)へと掘り下げていく。

そして、各ポリシーが優先モデルにマッピングされ、開発者はベンチマーク指標だけでなく、実用的な要件に基づいてルーティングを選択できるようになる。論文によれば、"この分類法は、ユーザーが明確に定義され、構造化されたルーティングポリシーを作成するためのメンタルモデルとして機能する"。

ルーティングの手順は2段階に分かれている。第一に、嗜好に沿ったルーターモデルが、ユーザーのクエリーを利用可能な全てのポリシーと並べて評価し、最適なものを選択する。次に、選択されたポリシーと割り当てられたLLMをマッピング関数で接続する。

モデルを選択するロジックはポリシーの定義から分離されているため、開発者はルーティング・ルールを編集するだけでモデルを追加、削除、更新することができます。この分離により、モデルやアプリケーションが常に変化する本番環境に必要な柔軟性が実現される。

プリファレンスに沿ったルーティングフレームワーク(出典:arXiv)
プリファレンスに沿ったルーティングフレームワーク Source: arXiv

ポリシーの選択はArch-Routerによって行われます。Arch-Routerは、プリファレンスアウェアルーティングに最適化されたコンパクトな15億パラメータの言語モデルです。Arch-Routerはユーザのクエリとポリシーの説明の完全なリストを入力として受け取り、最適なポリシーの識別子を出力する。

ポリシーが入力に含まれているため、システムは推論中に新しいルートや更新されたルートに適応することができます。この生成的な戦略により、Arch-Routerは事前に訓練された理解を活用してクエリとポリシーの両方の意味を解釈し、完全な会話履歴を一度に分析することができます。

プロンプトに長大なポリシー・リストを含める際によく懸念されるのは、待ち時間が長くなるリスクだ。しかし、チームはArch-Routerを高効率に構築した。「広範なルーティング・ポリシーを使用しても、Arch-Routerのコンテキスト・ウィンドウを拡張しても、レイテンシにはほとんど影響しません」と、論文の共著者でKatanemo Labsの創設者/CEOであるSalman Paracha氏は言う。Arch-Routerは、"image_editing "や "document_creation "のような短いポリシー名しか出力しません。

Arch-Routerの動作

Arch-Routerを作成するために、チームは43,000のサンプルからなる入念に組み立てられたデータセットを使って、Qwen 2.5モデルの1.5Bパラメータバリアントを微調整した。そして、会話AIシステムをテストするために設計された4つの公開データセットで、OpenAI、Anthropic、Googleの主要な独自モデルとベンチマークを行った。

その結果、Arch-Routerは93.17%というトップの総合ルーティングスコアを達成し、他のすべてのモデル(トップクラスのプロプライエタリモデルを含む)を平均7.71%上回った。Arch-Routerの優位性は長時間の会話でより明らかになり、複数のやりとりにわたってコンテキストを維持する優れた能力が示されました。

Arch-Routerと他のモデルの比較(出典:arXiv)
Arch-Routerと他のモデルの比較 出典:ArXiv

実世界での使用において、この方法論はすでに複数の場面で応用されているとパラチャ氏は指摘する。例えば、オープンソースのコーディングプラットフォームでは、開発者はArch-Routerを利用して、「コード設計」、「コード理解」、「コード生成」といったワークフローのさまざまな部分を、それぞれのステップに最も効果的なLLMに導いている。同様に、組織はドキュメント作成タスクをClaude 3.7 Sonnetのようなモデルにルーティングする一方で、画像編集リクエストをGemini 2.5 Proに送ることができる。

このシステムはまた、"ユーザーがテキストの要約から事実に関する質問への回答まで、様々な活動を行う様々な分野のパーソナルアシスタントにも適しています "とParacha氏は説明し、"このような状況において、Arch-Routerは製品チームがユーザーの全体的な体験を統合し、向上させるのに役立ちます "と付け加えた。

このフレームワークは、Katanemo LabsのAIネイティブなエージェント用プロキシサーバーであるArchに組み込まれており、きめ細かいトラフィック管理ルールの実装をサポートしている。例えば、新しいLLMを追加する場合、チームは特定のポリシーの下でトラフィックのごく一部を新しいモデルにルーティングし、内部分析を使ってそのパフォーマンスを検証した後、自信を持ってすべてのトラフィックを移行させることができる。同社はまた、企業の開発者がこのワークフローをさらにスムーズに行えるよう、評価プラットフォームとのツールの統合にも取り組んでいる。

Arch-Routerの中核にあるのは、企業がバラバラのAI実装から脱却するのを支援することだ。「Arch-Router、そしてArchプラットフォーム全体は、開発者や企業が断片的なLLMの使用から、統一されたポリシーで管理されたシステムへと進化することを可能にします」とParacha氏は述べる。"ユーザーが幅広いタスクを実行するとき、私たちのプラットフォームは、タスクとモデルの多様性をまとまりのあるエクスペリエンスに変換し、最終的な製品をシームレスで直感的なものにします。"

関連記事
OpenAIは、10代の若者がChatGPTを使い始めてから数年を経て、より安全なChatGPTをリリースした OpenAIは、10代の若者がChatGPTを使い始めてから数年を経て、より安全なChatGPTをリリースした AIチャットボットに安全対策が欠如していたことによる一連の訴訟――これが10代の自殺やその他のメンタルヘルスの危機の一因となった――を受け、OpenAIは月曜日に「ChatGPT for Teens」を発表した。この新サービスには強化された安全機能が組み込まれており、学校現場でAIツールによって助長されている学業上の不正行為という深刻化する問題に対処している。教育的な観点から、「ChatGPT f
Google、AIによるディープフェイクを使ったなりすまし詐欺からユーザーを守るため、偽の着信検知機能を導入 Google、AIによるディープフェイクを使ったなりすまし詐欺からユーザーを守るため、偽の着信検知機能を導入 Googleは火曜日、AIによるディープフェイクを使ったなりすまし詐欺からユーザーを守るため、Androidに「偽の着信検出」機能を導入すると発表した。この機能は今月、Pixel端末を皮切りに、Android 12以降の端末向け「Phone by Google」アプリを通じて世界中で順次提供される。見知らぬ番号からの着信に応答することを避ける人が増えるにつれ、詐欺師たちは手口を変え、信頼できる電話
フロンティアAIラボ、異常挙動を示すモデルの封じ込め戦略の開示を拒否 フロンティアAIラボ、異常挙動を示すモデルの封じ込め戦略の開示を拒否 最近の調査によると、主要なAI研究所のうち、封じ込め対応計画を公表または実証しているところはごくわずかであることが示されている。封じ込め計画とは、AIシステムが人間の制御を覆そうとした場合の対応手順を定義するもので、どのアクセス権限を取り消すか、またいつシステムを完全にシャットダウンするかを具体的に規定している。この調査結果は、安全な最先端AI開発の実践を推進することに注力する組織「Guideli
関連特集おすすめ
チャットボット 言語練習、面接対策、そして日常の流暢さのための最高のAIロールプレイチャットアプリ
言語練習、面接対策、そして日常の流暢さのための最高のAIロールプレイチャットアプリ

2026年最新版・最高評価のAIロールプレイチャットアプリ|語学練習、面接対策、日常会話の流暢さ向上に!XIX.AIは、無料と有料の比較、実世界でのテスト、毎週更新されるランキングを提供する革新的なコレクションを厳選しています。これらの必須ツールは、ライティングスキルの向上、流暢さの課題克服、そしてあらゆる日常シナリオにおけるコミュニケーション効率の改善をサポートします。今すぐ探索して、あなたの言語成長に最適なツールを見つけましょう!

10 ツール
xix.ai
作曲 リミックス制作、サンプリングの準備、カラオケマスター作成のためのAIステム分離ツール
リミックス制作、サンプリングの準備、カラオケマスター作成のためのAIステム分離ツール

2026年最新・最高評価のAIステム分離ツール。リミックス制作、サンプリング準備、カラオケマスター向けに厳選されました。これらの強力で画期的なツールは、実環境でのテストを経て、正確なオーディオ分離を実現し、生産性を大幅に向上させます。 XIX.AIでは、ニーズに合った「必試」のソリューションを見つけるお手伝いをするため、無料版と有料版の比較ガイドを毎週更新して提供しています。今すぐチェックして、AIの力を最大限に活用しましょう。

8 ツール
xix.ai
データ分析 収益ダッシュボード、ファネル分析、および製品指標向けのAI SQLコピロット
収益ダッシュボード、ファネル分析、および製品指標向けのAI SQLコピロット

2026年最新かつ最も優れたAI SQLコピロットが最高評価でランクイン!XIX.AIは、毎週更新される実際の環境でのテストに対応した、強力で革新的なツール群を厳選しています。これらの必見ツールを使えば、正確な収益ダッシュボードの作成や販売プロセスの分析、製品指標の迅速な追跡が可能となり、生産性を大幅に向上させることができます。今すぐチェックして、データに基づいた意思決定に最適なツールを見つけましょう!238文字

9 ツール
xix.ai
作曲 曲のドラフト作成に最適なAIメロディ作成ツール
曲のドラフト作成に最適なAIメロディ作成ツール

2026年最新版 高評価のAIメロディ作成ツールで曲のドラフト作成!XIX.AIは、厳格な実世界テストを経て最高の作成体験を提供する、革新的な強力なコレクションを厳選しました。詳細な無料版と有料版の比較、正確なランキング、そして素晴らしい曲のドラフトを楽に作成し、創造的な生産性を大幅に向上させるためにぜひ試すべきオプションが見つかります。今すぐ探索して、あなたに最適なツールを見つけましょう!

8 ツール
xix.ai
チャットボット 面接練習用のベストなAI会話トレーニングツール
面接練習用のベストなAI会話トレーニングツール

2026年最新版・最高評価のAI会話トレーニングツールが、面接練習に最適です。XIX.AIにてご提供しています!この厳選コレクションには、現実世界での厳格なテストを経て正確なフィードバックを提供する強力なツールが含まれています。無料版と有料版の比較や詳細なランキングをご覧いただき、自信とスキルを高めるための必須オプションをお選びください。今すぐ探索して、面接成功に最適なツールを見つけましょう!

12 ツール
xix.ai
デザインとアート クリエイティブな実験に最適なAIスタイル転送ツール
クリエイティブな実験に最適なAIスタイル転送ツール

2026年版 クリエイティブな実験に最適な、最新・最高評価のAIスタイル転送ツール!XIX.AIは、実地テストと厳格なランキングを通じて卓越した結果をもたらす、強力で画期的な「必試」ツールを厳選しました。これらのトップソリューションは、コンテンツ制作を加速させ、無限の創造的可能性を切り拓くことで、クリエイターの生産性を大幅に向上させます。 今すぐチェックして、あなたにぴったりのツールを見つけ、今日から創作を始めましょう!

9 ツール
xix.ai
コメント (1)
0/500
WillGarcía
WillGarcía 2026年4月6日 11:00:35 JST

Arch-Routerの構想は面白いね。社内でどのLLMを使うか毎回悩んでたから、これがあれば効率化に繋がりそう。ただ、精度93%って、結局残りの7%で重大なミスルーティングが起きたりしない? 医療や法務のようなクリティカルな分野への適用は少し不安かな。😅 開発元のKatanemo Labs、これでインフラ市場に本格参戦するつもり?

OR