Cloud/AI Governance/Fiabilité des Outils
Fiabilité des Outils
Chaque outil que votre IA peut appeler, noté : les plus lents classés avec leurs pics, ceux qui échouent répartis en causes Agent, Upstream et Vinkius, et une matrice latence contre échec de toute la surface.
Une flotte peut être en bonne santé pendant qu'un outil traîne chaque conversation dans la boue en silence. Tool Reliability est l'écran qui met fin aux devinettes : chaque outil que vos agents peuvent appeler, classé deux fois, par lenteur et par échec, chaque échec étant attribué à une cause. La ligne de la console elle-même : "See which tools are slowing everything down and which ones are failing silently. Ranked, diagnosed, and ready for you to act on."

Tool Reliability
See which tools are slowing everything down and which ones are failing silently. Ranked, diagnosed, and ready for you to act on.
Slowest Tools
Avg latency (amber) · max spike (red)Most Failing Tools
Stacked by Agent / Upstream / VinkiusHealth Matrix
Latency × Failure rate · bubble = call volumeSlowest Tools Detail
| Tool | Calls | API | Total | Max | Rate |
|---|---|---|---|---|---|
| search_documents | 412 | 512ms | 823ms | 1682ms | 2.2% |
| create_issue | 386 | 448ms | 761ms | 1503ms | 1.8% |
| list_channels | 341 | 401ms | 704ms | 1412ms | 1.5% |
| get_user_profile | 298 | 372ms | 655ms | 1341ms | 1% |
| send_notification | 264 | 338ms | 592ms | 1204ms | 0.8% |
| update_task | 231 | 305ms | 531ms | 1086ms | 1.7% |
| query_database | 208 | 271ms | 478ms | 967ms | 0.5% |
| upload_file | 187 | 238ms | 413ms | 854ms | 1.1% |
| delete_record | 156 | 205ms | 352ms | 728ms | 0.6% |
| sync_calendar | 124 | 168ms | 297ms | 601ms | 0% |
Most Failing Tools Detail
| Tool | Calls | Errors | Agent | Upstream | Rate |
|---|---|---|---|---|---|
| search_documents | 412 | 28 | 20 | 7 | 6.8% |
| create_issue | 386 | 24 | 17 | 6 | 6.2% |
| list_channels | 341 | 19 | 13 | 5 | 5.6% |
| get_user_profile | 298 | 15 | 10 | 4 | 4.9% |
| send_notification | 264 | 11 | 8 | 3 | 4.1% |
| update_task | 231 | 9 | 6 | 2 | 3.9% |
| query_database | 208 | 7 | 5 | 2 | 3.4% |
| upload_file | 187 | 5 | 3 | 1 | 2.7% |
| delete_record | 156 | 3 | 2 | 1 | 1.9% |
| sync_calendar | 124 | 0 | 0 | 0 | 0% |
Le mockup s'exécute sur le Sample Data de la console. Sur un plan payant, le même écran note vos outils en direct, par organisation.
Les quatre compteurs
- Tool Calls avec le taux de réussite dérivé : la santé de toute la surface d'outils en un chiffre.
- Unique Tools actives sur la période, pour que vous sachiez à quel point la surface notée est large.
- Avg Latency avec la répartition habituelle : la part émeraude est l'API upstream, la part ambre est le overhead de Vinkius. La lenteur d'un outil n'est presque jamais le proxy.
- Total Errors, en rouge dès qu'ils existent, avec la répartition en trois dessous : Agent (4xx, la faute de l'appelant), Upstream (5xx, le fournisseur) et Vinkius (levé par le proxy lui-même).
Les deux classements
Slowest Tools classe les outils par latence moyenne, et chaque barre porte son pic maximum sous forme de point rouge : un outil peut afficher une moyenne de 300ms et dépasser quand même la seconde à 2 heures du matin, et ce graphique refuse de le cacher. Voilà la liste à apporter à celui qui possède le Connector.
Most Failing Tools classe par nombre d'erreurs, et chaque barre est empilée par cause : ambre pour les erreurs Agent, rouge pour Upstream, violet pour Vinkius. La pile vous dit à qui appartient le problème avant même que vous ouvriez le tableau. Un outil qui échoue surtout sur des erreurs Agent signifie généralement un problème de scope ou de paramètre côté appelant ; surtout Upstream signifie que le fournisseur est capricieux ; le moindre filament violet signifie que le proxy a intercepté quelque chose et l'a dit.
La Health Matrix
Le troisième graphique trace chaque outil sous forme de bulle : latence sur un axe, taux d'échec sur l'autre, la taille de la bulle est le volume d'appels. Le coin supérieur droit est la zone de danger, un outil lent qui échoue souvent ; une grosse bulle là est votre prochain incident, et la matrice est l'endroit où vous le voyez se former.
Les deux tableaux de détail
Slowest Tools Detail donne à chaque outil lent ses appels, la répartition de latence API / Overhead / Total et le pic maximal. Most Failing Tools Detail donne à chaque outil qui échoue son nombre et son taux d'erreurs, ventilés dans les colonnes Agent / Upstream / Vinkius, si bien que le diagnostic accompagne le chiffre. Les deux tableaux sont cliquables vers le détail de l'outil, et les deux états vides sont ceux de la console elle-même : "No tool performance data recorded in this period." et "No tool error data recorded in this period."
Du symptôme au responsable
Le lien Details de la Tool Health Matrix de Mission Control vous dépose ici. Depuis un outil qui échoue, la prochaine étape est Request Failures pour voir les requests réels qui ont cassé, et les réglages de Connector Policy sont l'endroit où un outil abusé de façon répétée finit limité. Cet écran transforme "l'IA semble lente" en : cet outil, ce serveur, cette latence, cette cause, ce responsable.