Routage, latence, dépenses et qualité en une seule vue.
Où le trafic est allé, ce qu'il a coûté, à quelle vitesse il est revenu, et si les choix du routeur tiennent la route.
- Répartition des modèles dans le temps — observez le routage adaptatif évoluer au fil des changements dans votre distribution de prompts.
- Dépenses par clé, espace de travail, agent et modèle, afin qu'une ligne de coût inattendue ait toujours un responsable identifié.
- Les pics du taux d'appels d'outils des agents sont signalés par rapport à des lignes de base apprises par heure de la semaine, plutôt qu'à un seuil fixe.
Pics mesurés par rapport à votre propre normale
Les anomalies du taux d'appels d'outils sont évaluées par rapport à une ligne de base apprise par heure de la semaine, de sorte que le trafic du lundi à 9h n'est jamais comparé à celui du dimanche à 3h. Les lignes de base sont définies par espace de travail, ce qui signifie qu'il n'y a aucun seuil global à ajuster, et les détections apparaissent aux côtés de l'activité du pare-feu dont elles sont issues.
Observez l'évolution de la composition.
La distribution de vos invites évolue, et le routage adaptatif évolue avec elle. Insights montre ce qui se passe — quels modèles prennent le travail cette semaine, ce qu'ils coûtent, leur vitesse de réponse, et si la qualité a tenu pendant que la composition changeait.
Les surprises arrivent tôt.
Les pics du taux d'appels d'outils sont évalués par rapport à une ligne de base apprise par espace de travail et par heure de la semaine — ainsi, le lundi à 9h est comparé aux autres lundis à 9h, et non au dimanche à 3h. Vous en êtes informé comme d'un signal, pendant qu'il l'est encore.