Cloud/AI Governance/Fiabilité des Outils

Fiabilité des Outils

Demandez à l’IA à propos de Vinkius

Chaque outil que votre IA peut appeler, noté : les plus lents classés avec leurs pics, ceux qui échouent répartis en causes Agent, Upstream et Vinkius, et une matrice latence contre échec de toute la surface.

Une flotte peut être en bonne santé pendant qu'un outil traîne chaque conversation dans la boue en silence. Tool Reliability est l'écran qui met fin aux devinettes : chaque outil que vos agents peuvent appeler, classé deux fois, par lenteur et par échec, chaque échec étant attribué à une cause. La ligne de la console elle-même : "See which tools are slowing everything down and which ones are failing silently. Ranked, diagnosed, and ready for you to act on."

R

Tool Reliability

AI Briefing
Upgrade to unlock

See which tools are slowing everything down and which ones are failing silently. Ranked, diagnosed, and ready for you to act on.

Tool Calls8,420
98.3% success rate
Unique Tools24
Active in this period
Avg Latency187ms
API 112ms · Overhead 75ms
Total Errors142
Agent 99 · Upstream 36 · Vinkius 7

Slowest Tools

Avg latency (amber) · max spike (red)
Details
search_documents
823ms
create_issue
761ms
list_channels
704ms
get_user_profile
655ms
send_notification
592ms
update_task
531ms
query_database
478ms
upload_file
413ms
delete_record
352ms
sync_calendar
297ms

Most Failing Tools

Stacked by Agent / Upstream / Vinkius
Details
search_documents
28
create_issue
24
list_channels
19
get_user_profile
15
send_notification
11
update_task
9
query_database
7
upload_file
5
delete_record
3
sync_calendar
0

Health Matrix

Latency × Failure rate · bubble = call volume
Details
latency →↑ failures

Slowest Tools Detail

ToolCallsAPITotalMaxRate
search_documents412512ms823ms1682ms2.2%
create_issue386448ms761ms1503ms1.8%
list_channels341401ms704ms1412ms1.5%
get_user_profile298372ms655ms1341ms1%
send_notification264338ms592ms1204ms0.8%
update_task231305ms531ms1086ms1.7%
query_database208271ms478ms967ms0.5%
upload_file187238ms413ms854ms1.1%
delete_record156205ms352ms728ms0.6%
sync_calendar124168ms297ms601ms0%

Most Failing Tools Detail

ToolCallsErrorsAgentUpstreamRate
search_documents412282076.8%
create_issue386241766.2%
list_channels341191355.6%
get_user_profile298151044.9%
send_notification26411834.1%
update_task2319623.9%
query_database2087523.4%
upload_file1875312.7%
delete_record1563211.9%
sync_calendar1240000%
Tool Reliability, live. The slowest tools with their max spikes, the failing ones stacked by Agent, Upstream and Vinkius causes, a health matrix of the whole surface and the two detail tables. Console sample data, as the free tier sees it.

Le mockup s'exécute sur le Sample Data de la console. Sur un plan payant, le même écran note vos outils en direct, par organisation.

Les quatre compteurs

  • Tool Calls avec le taux de réussite dérivé : la santé de toute la surface d'outils en un chiffre.
  • Unique Tools actives sur la période, pour que vous sachiez à quel point la surface notée est large.
  • Avg Latency avec la répartition habituelle : la part émeraude est l'API upstream, la part ambre est le overhead de Vinkius. La lenteur d'un outil n'est presque jamais le proxy.
  • Total Errors, en rouge dès qu'ils existent, avec la répartition en trois dessous : Agent (4xx, la faute de l'appelant), Upstream (5xx, le fournisseur) et Vinkius (levé par le proxy lui-même).

Les deux classements

Slowest Tools classe les outils par latence moyenne, et chaque barre porte son pic maximum sous forme de point rouge : un outil peut afficher une moyenne de 300ms et dépasser quand même la seconde à 2 heures du matin, et ce graphique refuse de le cacher. Voilà la liste à apporter à celui qui possède le Connector.

Most Failing Tools classe par nombre d'erreurs, et chaque barre est empilée par cause : ambre pour les erreurs Agent, rouge pour Upstream, violet pour Vinkius. La pile vous dit à qui appartient le problème avant même que vous ouvriez le tableau. Un outil qui échoue surtout sur des erreurs Agent signifie généralement un problème de scope ou de paramètre côté appelant ; surtout Upstream signifie que le fournisseur est capricieux ; le moindre filament violet signifie que le proxy a intercepté quelque chose et l'a dit.

La Health Matrix

Le troisième graphique trace chaque outil sous forme de bulle : latence sur un axe, taux d'échec sur l'autre, la taille de la bulle est le volume d'appels. Le coin supérieur droit est la zone de danger, un outil lent qui échoue souvent ; une grosse bulle là est votre prochain incident, et la matrice est l'endroit où vous le voyez se former.

Les deux tableaux de détail

Slowest Tools Detail donne à chaque outil lent ses appels, la répartition de latence API / Overhead / Total et le pic maximal. Most Failing Tools Detail donne à chaque outil qui échoue son nombre et son taux d'erreurs, ventilés dans les colonnes Agent / Upstream / Vinkius, si bien que le diagnostic accompagne le chiffre. Les deux tableaux sont cliquables vers le détail de l'outil, et les deux états vides sont ceux de la console elle-même : "No tool performance data recorded in this period." et "No tool error data recorded in this period."

Du symptôme au responsable

Le lien Details de la Tool Health Matrix de Mission Control vous dépose ici. Depuis un outil qui échoue, la prochaine étape est Request Failures pour voir les requests réels qui ont cassé, et les réglages de Connector Policy sont l'endroit où un outil abusé de façon répétée finit limité. Cet écran transforme "l'IA semble lente" en : cet outil, ce serveur, cette latence, cette cause, ce responsable.