Option
Heim
Eilmeldung
Inhalt
HarryClark
HarryClark
29. September 2026

Fireworks AI hat „FireRouter with Opus“ eingeführt, ein cache-optimiertes Routing-Modell zur Optimierung von Claude Opus, GLM5.3 und GLM5.3Flash. Interne A/B-Tests zeigen eine Kostensenkung von 57 % pro Sitzung – von 15,36 $ auf 6,63 $ – bei einem Genauigkeitsverlust von nur 1,5 Prozentpunkten (98,1 % im Vergleich zu Opus allein). Das System leitet Aufgaben dynamisch weiter, um Qualität und Kosten in Einklang zu bringen, und erreicht eine Cache-Trefferquote von 94,2 %, indem Routineaufgaben an kostengünstigere Modelle weitergeleitet werden.

Fireworks AI hat „FireRouter with Opus“ eingeführt, ein cache-optimiertes Routing-Modell zur Optimierung von Claude Opus, GLM5.3 und GLM5.3Flash. Interne A/B-Tests zeigen eine Kostensenkung von 57 % pro Sitzung – von 15,36 $ auf 6,63 $ – bei einem Genauigkeitsverlust von nur 1,5 Prozentpunkten (98,1 % im Vergleich zu Opus allein). Das System leitet Aufgaben dynamisch weiter, um Qualität und Kosten in Einklang zu bringen, und erreicht eine Cache-Trefferquote von 94,2 %, indem Routineaufgaben an kostengünstigere Modelle weitergeleitet werden. Fireworks AI hat „FireRouter with Opus“ eingeführt, ein cache-optimiertes Routing-Modell zur Optimierung von Claude Opus, GLM5.3 und GLM5.3Flash. Interne A/B-Tests zeigen eine Kostensenkung von 57 % pro Sitzung – von 15,36 $ auf 6,63 $ – bei einem Genauigkeitsverlust von nur 1,5 Prozentpunkten (98,1 % im Vergleich zu Opus allein). Das System leitet Aufgaben dynamisch weiter, um Qualität und Kosten in Einklang zu bringen, und erreicht eine Cache-Trefferquote von 94,2 %, indem Routineaufgaben an kostengünstigere Modelle weitergeleitet werden.
Kommentare (0)
0/300
OR