Enrutamiento, latencia, gasto y calidad en una sola vista.
A dónde fue el tráfico, cuánto costó, con qué rapidez respondió y si las decisiones del enrutador se mantienen.
- Combinación de modelos a lo largo del tiempo — observa cómo el enrutamiento adaptativo cambia a medida que evoluciona la distribución de tus prompts.
- Gasto por clave, espacio de trabajo, agente y modelo, de modo que una partida inesperada siempre tiene un responsable.
- Los picos en la tasa de llamadas a herramientas del agente se detectan comparándolos con líneas base aprendidas por hora del día de la semana, en lugar de un umbral fijo.
Picos medidos frente a tu propia normalidad
Las anomalías en la tasa de llamadas a herramientas se puntúan contra una línea base aprendida por hora del día de la semana, de modo que el tráfico del lunes a las 9h nunca se compara con el del domingo a las 3h. Las líneas base son por espacio de trabajo, lo que significa que no hay ningún umbral global que ajustar, y las detecciones aparecen junto con la actividad del cortafuegos de la que provienen.
Observa cómo cambia la mezcla.
La distribución de tus prompts cambia, y el enrutamiento adaptativo cambia con ella. Insights muestra ese proceso — qué modelos están tomando el trabajo esta semana, cuánto cuestan, qué tan rápido respondieron y si la calidad se mantuvo mientras la mezcla cambiaba.
Las sorpresas llegan temprano.
Los picos en la tasa de llamadas a herramientas se puntúan contra una línea base aprendida por espacio de trabajo y por hora del día de la semana — de modo que el lunes a las 9h se compara con otros lunes a las 9h, no con el domingo a las 3h. Te llega como una señal, mientras todavía es una señal.