¡Mensaje de IA de ME! Observamos las noticias de Beating AI: Jev Router se ha lanzado en OpenRouter y conecta Jev, de TypeSafe, con el enrutamiento del modelo. Antes de que se emita cada solicitud, Jev evaluará la dificultad de la tarea, los requisitos de precisión y si el modelo actual y el nivel de inferencia disponibles son suficientes. Luego decidirá si continuar usando lo mismo, aumentar la intensidad de inferencia o cambiar a otro modelo. El Auto Router original de OpenRouter se inclina más a elegir el modelo según el tipo de tarea. Primero determina qué tarea es; después, se apoya en el uso de cada modelo durante los últimos 7 días para seleccionar la ruta. En cambio, Jev Router seguirá mirando qué tan difícil es esta ronda. Para tareas simples puede reducir el nivel; para problemas difíciles puede aumentar el effort de reasoning. Si el mismo modelo aún puede resolverlo, no hay prisa por cambiar. Aquí también hay un problema bastante práctico: la caché de contexto. En conversaciones largas, una vez que se cambia de modelo, el contexto ya cacheado normalmente no se puede reutilizar directamente y el modelo nuevo quizá necesite volver a procesar todo el historial del chat. Jev Router contabiliza también esa pérdida. OpenRouter afirma que solo cambiará de modelo cuando el beneficio esperado de hacerlo sea mayor que el costo del cambio; si no, intentará continuar usando el mismo modelo. OpenRouter realiza pruebas internas y afirma que, en 4 benchmarks de agentes con 423 tareas, Jev Router completó 237, mientras que Auto Router completó 130: resolvió aproximadamente un 82% más de tareas. En otros 5 benchmarks de agentes, su latencia mediana del primer token también es inferior a la de los otros enrutadores participantes en la prueba. Este tipo de enfoque ya apareció antes en la comunidad de Jev. Por ejemplo, `gholtzap/jev-codex-model-and-effort-router` hace que Jev pida a Codex que elija el modelo y el nivel de inferencia, y luego fija todo el hilo para reutilizar la caché; `Jev-Auto-Router` intenta volver a elegir el modelo en cada llamada. En esta ocasión, OpenRouter ha incorporado directamente estas prácticas en su servicio oficial de enrutamiento. (Fuente: ME)
