opción
Hogar
Última hora
Contenido
HarryClark
HarryClark
29 de septiembre de 2026

Fireworks AI ha lanzado FireRouter con Opus, un modelo de enrutamiento que tiene en cuenta la caché y que optimiza Claude Opus, GLM5.3 y GLM5.3Flash. Las pruebas internas A/B muestran una reducción del coste por sesión del 57 %, pasando de 15,36 a 6,63 dólares, con una disminución de la precisión de tan solo 1,5 puntos porcentuales (un 98,1 % en comparación con Opus solo). El sistema distribuye dinámicamente las tareas para equilibrar calidad y coste, logrando una tasa de aciertos en caché del 94,2 % al dirigir las tareas rutinarias a modelos más económicos.

Fireworks AI ha lanzado FireRouter con Opus, un modelo de enrutamiento que tiene en cuenta la caché y que optimiza Claude Opus, GLM5.3 y GLM5.3Flash. Las pruebas internas A/B muestran una reducción del coste por sesión del 57 %, pasando de 15,36 a 6,63 dólares, con una disminución de la precisión de tan solo 1,5 puntos porcentuales (un 98,1 % en comparación con Opus solo). El sistema distribuye dinámicamente las tareas para equilibrar calidad y coste, logrando una tasa de aciertos en caché del 94,2 % al dirigir las tareas rutinarias a modelos más económicos. Fireworks AI ha lanzado FireRouter con Opus, un modelo de enrutamiento que tiene en cuenta la caché y que optimiza Claude Opus, GLM5.3 y GLM5.3Flash. Las pruebas internas A/B muestran una reducción del coste por sesión del 57 %, pasando de 15,36 a 6,63 dólares, con una disminución de la precisión de tan solo 1,5 puntos porcentuales (un 98,1 % en comparación con Opus solo). El sistema distribuye dinámicamente las tareas para equilibrar calidad y coste, logrando una tasa de aciertos en caché del 94,2 % al dirigir las tareas rutinarias a modelos más económicos.
comentario (0)
0/300
OR