Maison
OpenRouter dévoile l'API Fusion pour optimiser les performances et les coûts des équipes d'achat basées sur l'IA
Dans le domaine des grands modèles d’IA, la recherche de performances accrues et de coûts réduits est depuis longtemps une priorité pour les développeurs et les entreprises. Récemment, OpenRouter , la célèbre plateforme d’agrégation de modèles d’IA, a lancé un service de modèles composites baptisé « Fusion API », conçu pour offrir aux utilisateurs une solution alliant performances et rentabilité grâce à la collaboration entre plusieurs modèles.
La Fusion API ne repose pas sur un modèle unique, mais sur un système de collaboration multimodèle éprouvé. Son flux de travail envoie la requête de l’utilisateur à plusieurs modèles pour un traitement parallèle ; ensuite, un modèle de révision effectue une analyse structurée de chaque réponse ; enfin, un modèle intègre la meilleure réponse finale. Ce mécanisme de « complémentarité multi-modèles » améliore efficacement la précision et la qualité des réponses.

Selon les données de tests comparatifs publiées par OpenRouter, le système affiche d’excellentes performances. Une configuration associant Claude Opus4.8 et GPT-5.5, Opus4.8 se chargeant de la synthèse finale, a atteint un score de performance de 69,0 %, surpassant ainsi le modèle haute performance reconnu par le secteur, Claude Fable5 . De plus, une collaboration entre « trois poids lourds » — Claude Opus 4.8, GPT-5.5 et Gemini 3.1Pro — a également surpassé Claude Fable5 dans l’ensemble.
Au-delà de ces avancées en matière de performances, Fusion API est également très compétitive en termes de maîtrise des coûts. Des tests officiels montrent qu’en combinant intelligemment Gemini3Flash, Kimi K2.6 et DeepSeek V4Pro, les utilisateurs peuvent maintenir l’écart de score de test à moins de 1 % tout en ne payant qu’environ la moitié du coût de Claude Fable5, ce qui démontre un rapport coût-performance exceptionnel.
Alors que les scénarios d’application des grands modèles d’IA ne cessent de se diversifier, l’optimisation de l’allocation des ressources et la réduction des coûts d’appel par des moyens techniques sont devenues un défi commun à l’ensemble du secteur. Le service collaboratif lancé par OpenRouter, Fusion API, offre aux développeurs une nouvelle approche technique susceptible de modifier la logique de calcul des coûts lors de la sélection et de l’utilisation de grands modèles.
Article connexe
iFLYTEK dévoile le grand modèle général Spark X2.5
Le 1er septembre, iFlytek ouvrira en open source deux grands modèles de langage axés sur l’edge, Xinghuo X2.5-4B et Xinghuo X2.5-1.7B, selon la dernière annonce officielle. Ces deux modèles prennent nativement en charge une fenêtre de contexte allant
Meta supprime la fonction de retouche photo par IA suite aux critiques des utilisateurs
Meta, le géant des réseaux sociaux, est une fois de plus au cœur d’un débat public concernant l’équilibre délicat entre l’intelligence artificielle et la vie privée des utilisateurs. Selon TechCrunch, les Superintelligence Labs de Meta ont présenté u
PDG de DeepMind, Hassabis : Je dors six heures par jour et je me sens généralement plein d’énergie vers 1 h du matin.
Fortune a récemment publié une interview avec Demis Hassabis, PDG de Google DeepMind, révélant son approche non conventionnelle du repos et de la productivité. Hassabis a divulgué qu’il dort très peu, structurant ses heures d’éveil en deux blocs de t
Recommandations de sujets spéciaux liés
commentaires (0)
Dans le domaine des grands modèles d’IA, la recherche de performances accrues et de coûts réduits est depuis longtemps une priorité pour les développeurs et les entreprises. Récemment,
La Fusion API ne repose pas sur un modèle unique, mais sur un système de collaboration multimodèle éprouvé. Son flux de travail envoie la requête de l’utilisateur à plusieurs modèles pour un traitement parallèle ; ensuite, un modèle de révision effectue une analyse structurée de chaque réponse ; enfin, un modèle intègre la meilleure réponse finale. Ce mécanisme de « complémentarité multi-modèles » améliore efficacement la précision et la qualité des réponses.

Selon les données de tests comparatifs publiées par OpenRouter, le système affiche d’excellentes performances. Une configuration associant Claude Opus4.8 et GPT-5.5, Opus4.8 se chargeant de la synthèse finale, a atteint un score de performance de 69,0 %, surpassant ainsi le modèle haute performance reconnu par le secteur,
Au-delà de ces avancées en matière de performances, Fusion API est également très compétitive en termes de maîtrise des coûts. Des tests officiels montrent qu’en combinant intelligemment Gemini3Flash, Kimi K2.6 et DeepSeek V4Pro, les utilisateurs peuvent maintenir l’écart de score de test à moins de 1 % tout en ne payant qu’environ la moitié du coût de Claude Fable5, ce qui démontre un rapport coût-performance exceptionnel.
Alors que les scénarios d’application des grands modèles d’IA ne cessent de se diversifier, l’optimisation de l’allocation des ressources et la réduction des coûts d’appel par des moyens techniques sont devenues un défi commun à l’ensemble du secteur. Le service collaboratif lancé par OpenRouter, Fusion API, offre aux développeurs une nouvelle approche technique susceptible de modifier la logique de calcul des coûts lors de la sélection et de l’utilisation de grands modèles.
iFLYTEK dévoile le grand modèle général Spark X2.5
Le 1er septembre, iFlytek ouvrira en open source deux grands modèles de langage axés sur l’edge, Xinghuo X2.5-4B et Xinghuo X2.5-1.7B, selon la dernière annonce officielle. Ces deux modèles prennent nativement en charge une fenêtre de contexte allant
Meta supprime la fonction de retouche photo par IA suite aux critiques des utilisateurs
Meta, le géant des réseaux sociaux, est une fois de plus au cœur d’un débat public concernant l’équilibre délicat entre l’intelligence artificielle et la vie privée des utilisateurs. Selon TechCrunch, les Superintelligence Labs de Meta ont présenté u
PDG de DeepMind, Hassabis : Je dors six heures par jour et je me sens généralement plein d’énergie vers 1 h du matin.
Fortune a récemment publié une interview avec Demis Hassabis, PDG de Google DeepMind, révélant son approche non conventionnelle du repos et de la productivité. Hassabis a divulgué qu’il dort très peu, structurant ses heures d’éveil en deux blocs de t











