opción
Hogar
Noticias
Un nuevo modelo de enrutador de 1.500 millones de dólares alcanza una precisión del 93%, eliminando los costosos costes de reentrenamiento

Un nuevo modelo de enrutador de 1.500 millones de dólares alcanza una precisión del 93%, eliminando los costosos costes de reentrenamiento

24 de noviembre de 2025
144

Los investigadores de Katanemo Labs han presentado Arch-Router, un modelo de enrutamiento avanzado y un marco diseñado para dirigir de forma inteligente las consultas de los usuarios al modelo de gran lenguaje (LLM) más apropiado.

Para las empresas que desarrollan productos que utilizan múltiples LLM, Arch-Rolver aborda un dilema central: cómo dirigir automáticamente cada solicitud al modelo ideal para la tarea, sin depender de una lógica inflexible o de un costoso reentrenamiento cada vez que se necesitan actualizaciones.

Los retos del enrutamiento LLM

A medida que aumenta la variedad de LLM disponibles, los desarrolladores están pasando de configuraciones de un solo modelo a arquitecturas multimodelo que utilizan las distintas capacidades de diferentes modelos para funciones especializadas, como generar código, resumir texto o editar imágenes.

El enrutamiento LLM se ha convertido en una técnica esencial para construir y ejecutar este tipo de sistemas, ya que actúa como un director de tráfico inteligente que guía cada consulta del usuario hacia el modelo más adecuado para gestionarla.

Los métodos actuales de enrutamiento se dividen en dos grupos principales: el enrutamiento basado en tareas, que asigna las consultas según categorías de tareas predefinidas, y el enrutamiento basado en el rendimiento, que busca el mejor equilibrio entre gasto y calidad del resultado.

Sin embargo, los sistemas basados en tareas suelen fallar cuando la intención del usuario es ambigua o cambia a lo largo de la conversación, sobre todo en diálogos de varios turnos. Por su parte, el enrutamiento basado en el rendimiento tiende a dar prioridad a los resultados estáticos de referencia, pasando por alto con frecuencia las preferencias reales del usuario y adaptándose lentamente a los nuevos modelos sin un costoso reciclaje.

Como afirman los investigadores de Katanemo Labs en su artículo, un problema más profundo es que "los métodos de enrutamiento existentes tienen limitaciones prácticas en las aplicaciones del mundo real. La mayoría están optimizados para obtener un rendimiento de referencia, pero ignoran las preferencias humanas, que se guían por criterios de evaluación subjetivos".

El equipo subraya la importancia de los sistemas de enrutamiento que "reflejan juicios humanos subjetivos, ofrecen mayor transparencia y siguen siendo fácilmente ajustables a medida que evolucionan tanto los modelos como las aplicaciones."

Un nuevo marco para el encaminamiento alineado con las preferencias

Para superar estos problemas, los investigadores desarrollaron un marco de "enrutamiento alineado con las preferencias" que empareja las consultas entrantes con las reglas de enrutamiento basadas en las preferencias personalizadas del usuario.

En este sistema, los usuarios definen sus políticas de enrutamiento mediante lenguaje natural a través de una "taxonomía dominio-acción" de dos niveles. Esta estructura refleja la forma en que las personas describen naturalmente las tareas: empezando por una categoría amplia -el dominio, como "jurídico" o "financiero"- y profundizando en una tarea específica -la acción, como "resumir" o "codificar"-.

A continuación, cada política se asigna a un modelo preferido, lo que permite a los desarrolladores basar sus decisiones de enrutamiento en requisitos prácticos y no sólo en parámetros de referencia. Según el artículo, "esta taxonomía actúa como modelo mental para ayudar a los usuarios a crear políticas de enrutamiento bien definidas y estructuradas".

El procedimiento de enrutamiento funciona en dos fases. En primer lugar, un modelo de enrutador alineado con las preferencias evalúa la consulta del usuario junto con todas las políticas disponibles y elige la que mejor se ajusta. En segundo lugar, una función de mapeo conecta la política seleccionada con su LLM asignado.

Dado que la lógica de selección de un modelo está separada de la definición de la política, los desarrolladores pueden añadir, eliminar o actualizar modelos simplemente editando las reglas de enrutamiento, sin necesidad de volver a entrenar o cambiar el enrutador. Esta separación ofrece la flexibilidad necesaria para los entornos de producción, en los que los modelos y las aplicaciones cambian constantemente.

Marco de enrutamiento basado en preferencias (fuente: arXiv)
Marco de enrutamiento alineado con las preferencias Fuente: arXiv

La selección de políticas se realiza mediante Arch-Router, un modelo de lenguaje compacto de 1.500 millones de parámetros optimizado para el enrutamiento basado en preferencias. Arch-Router toma como datos de entrada la consulta del usuario y la lista completa de descripciones de políticas, y a continuación proporciona el identificador de la política más adecuada.

Dado que las políticas se incluyen en la entrada, el sistema puede ajustarse a rutas nuevas o actualizadas durante la inferencia a través del aprendizaje en contexto, sin necesidad de reentrenamiento. Esta estrategia generativa permite a Arch-Router aprovechar su conocimiento preformado para interpretar el significado tanto de la consulta como de las políticas, y analizar historiales de conversación completos de una sola vez.

Una de las preocupaciones habituales a la hora de incluir largas listas de políticas en una consulta es el riesgo de que aumente la latencia. Sin embargo, el equipo construyó Arch-Router para lograr una alta eficiencia. "Incluso con políticas de enrutamiento extensas, podemos ampliar la ventana de contexto de Arch-Router con muy poco efecto sobre la latencia", afirma Salman Paracha, coautor del artículo y fundador y director ejecutivo de Katanemo Labs. Señala que la latencia está determinada principalmente por la longitud de la salida, y Arch-Router sólo emite un nombre de política corto, como "image_editing" o "document_creation".

Arch-Router en acción

Para crear Arch-Router, el equipo ajustó una variante de 1,5 mil millones de parámetros del modelo Qwen 2.5 utilizando un conjunto de datos cuidadosamente recopilado de 43.000 ejemplos. A continuación, lo compararon con los principales modelos patentados de OpenAI, Anthropic y Google en cuatro conjuntos de datos públicos diseñados para probar sistemas de IA conversacional.

Los resultados indican que Arch-Router obtuvo la mejor puntuación global de enrutamiento, un 93,17%, superando a todos los demás modelos -incluidos los patentados de primer nivel- en una media del 7,71%. La ventaja del modelo se hizo más evidente en las conversaciones más largas, mostrando su capacidad superior para mantener el contexto a través de múltiples intercambios.

Arch-Router frente a otros modelos (fuente: arXiv)
Arch-Router frente a otros modelos Fuente: arXiv

En el mundo real, esta metodología ya se está aplicando en múltiples entornos, señala Paracha. Por ejemplo, en las plataformas de codificación de código abierto, los desarrolladores confían en Arch-Router para guiar las distintas partes de su flujo de trabajo -como el "diseño de código", la "comprensión de código" y la "generación de código"- hacia los LLM más eficaces para cada paso. Del mismo modo, las organizaciones pueden dirigir las tareas de creación de documentos a un modelo como Claude 3.7 Sonnet y enviar las solicitudes de edición de imágenes a Gemini 2.5 Pro.

El sistema también es adecuado "para asistentes personales de diversos campos, en los que los usuarios realizan toda una serie de actividades, desde resumir textos hasta responder a consultas sobre hechos", explica Paracha, y añade que "en tales situaciones, Arch-Router ayuda a los equipos de producto a consolidar y mejorar la experiencia global del usuario".

Este marco está integrado en Arch, el servidor proxy nativo de IA para agentes de Katanemo Labs, que admite la implementación de reglas granulares de gestión del tráfico. Por ejemplo, al añadir un nuevo LLM, un equipo puede enrutar un pequeño porcentaje del tráfico bajo una determinada política al nuevo modelo, validar su rendimiento utilizando análisis internos y, a continuación, cambiar con confianza todo el tráfico. La empresa también está trabajando en la integración de sus herramientas con plataformas de evaluación para facilitar aún más este flujo de trabajo a los desarrolladores corporativos.

En el fondo, el objetivo es ayudar a las organizaciones a ir más allá de las implementaciones de IA desconectadas. "Arch-Router -y la plataforma Arch en general- permite a los desarrolladores y a las empresas evolucionar desde un uso fragmentado de la IA a un sistema unificado y gobernado por políticas", afirma Paracha. "Cuando los usuarios realizan una amplia gama de tareas, nuestra plataforma convierte esa diversidad de tareas y modelos en una experiencia cohesiva, haciendo que el producto final se sienta fluido e intuitivo."

Artículo relacionado
OpenAI lanza una versión más segura de ChatGPT para adolescentes, años después de que estos empezaran a utilizarla OpenAI lanza una versión más segura de ChatGPT para adolescentes, años después de que estos empezaran a utilizarla Tras una serie de demandas relacionadas con la ausencia de protocolos de seguridad en los chatbots de IA —que contribuyeron a suicidios de adolescentes y otras crisis de salud mental—, OpenAI presentó
Google lanza una función de detección de llamadas falsas para proteger a los usuarios contra las estafas de suplantación de identidad mediante «deepfakes» generados por IA Google lanza una función de detección de llamadas falsas para proteger a los usuarios contra las estafas de suplantación de identidad mediante «deepfakes» generados por IA Google anunció el martes que Android va a lanzar una función de detección de llamadas falsas para proteger a los usuarios frente a las estafas de suplantación de identidad mediante deepfakes generados
Frontier AI Labs se niega a revelar las estrategias de contención para los modelos rebeldes Frontier AI Labs se niega a revelar las estrategias de contención para los modelos rebeldes Investigaciones recientes indican que muy pocos laboratorios líderes en IA han publicado o demostrado planes de respuesta de contención. Un plan de contención define los procedimientos a seguir cuando
Recomendaciones de temas especiales relacionados
Diseño y Arte Las mejores herramientas de transferencia de estilos con IA para experimentos creativos
Las mejores herramientas de transferencia de estilos con IA para experimentos creativos

¡Las mejores herramientas de transferencia de estilo con IA de 2026, mejor valoradas para experimentos creativos! XIX.AI ha seleccionado una colección de herramientas potentes y revolucionarias que no te puedes perder, capaces de ofrecer resultados excepcionales según pruebas reales y clasificaciones rigurosas. Estas soluciones de primera categoría ayudan a los creativos a aumentar significativamente su productividad, acelerando la creación de contenidos y abriendo un sinfín de posibilidades creativas. ¡Explora ahora mismo para descubrir tu herramienta perfecta y empieza a crear hoy mismo!

9 herramientas
xix.ai
Creación de cómics Las mejores herramientas de burbujas de diálogo con IA para la narración visual
Las mejores herramientas de burbujas de diálogo con IA para la narración visual

¡Ya están aquí, en XIX.AI, las mejores herramientas de 2026 con las mejores valoraciones para crear bocadillos de diálogo con IA y contar historias visuales! Esta selección incluye potentes herramientas revolucionarias que ayudan a los creadores a aumentar su productividad y superar los bloqueos creativos. Consulta una comparación entre las versiones gratuitas y de pago, echa un vistazo a las pruebas en condiciones reales y revisa las últimas clasificaciones para encontrar las soluciones imprescindibles, perfectas para crear narrativas visuales cautivadoras. ¡Explora ahora mismo y descubre tu herramienta ideal!

10 herramientas
xix.ai
Asistente de reuniones Las mejores herramientas de resumen de reuniones con IA: realiza un seguimiento claro de las decisiones y las acciones de seguimiento
Las mejores herramientas de resumen de reuniones con IA: realiza un seguimiento claro de las decisiones y las acciones de seguimiento

Las mejores herramientas de resumen de reuniones con IA de 2026, mejor valoradas para un seguimiento claro de las decisiones y un seguimiento posterior sin esfuerzo. Esta lista seleccionada presenta soluciones potentes y revolucionarias que aumentan drásticamente la productividad al automatizar las notas de las reuniones, identificar las acciones clave y agilizar la coordinación del equipo en todos los proyectos. Consigue una comparación entre las versiones gratuitas y de pago, junto con pruebas en condiciones reales y clasificaciones actualizadas semanalmente, para ayudarte a encontrar la herramienta perfecta. ¡Explora ahora mismo y aprovecha las ventajas de la IA!

9 herramientas
xix.ai
Análisis de datos Mejores herramientas de limpieza de datos con IA: corrige valores faltantes y duplicados rápidamente
Mejores herramientas de limpieza de datos con IA: corrige valores faltantes y duplicados rápidamente

2026: Las mejores herramientas de limpieza de datos basadas en IA, mejor calificadas y más actualizadas, para corregir rápidamente valores faltantes y duplicados. Esta lista cuidadosamente seleccionada presenta soluciones potentes que transforman el trabajo y aumentan significativamente la productividad. Cada opción ha sido sometida a pruebas rigurosas en entornos reales para garantizar su fiabilidad. Obtenga una comparación gratuita entre las opciones gratuitas y de pago y descubra la herramienta imprescindible que mejor se adapte a sus necesidades. Explore ahora en XIX.AI para darle un vantaje con la inteligencia artificial.

11 herramientas
xix.ai
Diseño y Arte Mejores herramientas de IA para la ideación creativa de artistas: superar los bloqueos visuales
Mejores herramientas de IA para la ideación creativa de artistas: superar los bloqueos visuales

2026 Últimas Mejores Herramientas de Ideación Creativa con IA Mejor Valoradas para Artistas son seleccionadas por XIX.AI para ayudar a los creadores a superar los bloqueos visuales y potenciar la creatividad al instante. Estas poderosas herramientas que cambian las reglas del juego ofrecen pruebas en el mundo real, una comparación detallada entre versiones gratuitas y de pago, y clasificaciones actualizadas semanalmente. Descubre tu herramienta perfecta para acelerar la creación de contenido y desbloquear tu ventaja con IA hoy mismo. ¡Explora ahora!

14 herramientas
xix.ai
composicion musical Creadores de ritmos con IA para pistas de fondo de TikTok, audio de Reels y música promocional para creadores
Creadores de ritmos con IA para pistas de fondo de TikTok, audio de Reels y música promocional para creadores

¡Los mejores creadores de ritmos con IA de 2026 para pistas de fondo de TikTok, audio de Reels y música promocional para creadores! XIX.AI ha elaborado una lista de las herramientas más valoradas y revolucionarias, sometidas a pruebas en el mundo real para ofrecer música impecable que se adapte a cualquier necesidad de contenido. Encontrarás datos detallados que comparan las versiones gratuitas con las de pago, clasificaciones actualizadas semanalmente y opciones imprescindibles que te ayudarán a potenciar tu creatividad y productividad. ¡Explora ahora mismo y descubre tu herramienta perfecta!

11 herramientas
xix.ai
comentario (1)
0/500
WillGarcía
WillGarcía 6 de abril de 2026 04:00:35 GMT+02:00

Arch-Routerの構想は面白いね。社内でどのLLMを使うか毎回悩んでたから、これがあれば効率化に繋がりそう。ただ、精度93%って、結局残りの7%で重大なミスルーティングが起きたりしない? 医療や法務のようなクリティカルな分野への適用は少し不安かな。😅 開発元のKatanemo Labs、これでインフラ市場に本格参戦するつもり?

OR