Cloud/AI Governance/Confiabilidad de Herramientas

Confiabilidad de Herramientas

Pregunta a la IA sobre Vinkius

Cada herramienta que tu IA puede llamar, con nota: las más lentas ranqueadas con sus picos, las que fallan divididas en causas Agent, Upstream y Vinkius, y una matriz de latencia contra fallo de toda la superficie.

Una flota puede estar sana mientras una herramienta arrastra cada conversación por el barro en silencio. Tool Reliability es la pantalla que acaba con las conjeturas: cada herramienta que tus agentes pueden llamar, ranqueada dos veces, por lentitud y por fallo, con cada fallo atribuido a una causa. La línea de la propia consola: "See which tools are slowing everything down and which ones are failing silently. Ranked, diagnosed, and ready for you to act on."

R

Tool Reliability

AI Briefing
Upgrade to unlock

See which tools are slowing everything down and which ones are failing silently. Ranked, diagnosed, and ready for you to act on.

Tool Calls8,420
98.3% success rate
Unique Tools24
Active in this period
Avg Latency187ms
API 112ms · Overhead 75ms
Total Errors142
Agent 99 · Upstream 36 · Vinkius 7

Slowest Tools

Avg latency (amber) · max spike (red)
Details
search_documents
823ms
create_issue
761ms
list_channels
704ms
get_user_profile
655ms
send_notification
592ms
update_task
531ms
query_database
478ms
upload_file
413ms
delete_record
352ms
sync_calendar
297ms

Most Failing Tools

Stacked by Agent / Upstream / Vinkius
Details
search_documents
28
create_issue
24
list_channels
19
get_user_profile
15
send_notification
11
update_task
9
query_database
7
upload_file
5
delete_record
3
sync_calendar
0

Health Matrix

Latency × Failure rate · bubble = call volume
Details
latency →↑ failures

Slowest Tools Detail

ToolCallsAPITotalMaxRate
search_documents412512ms823ms1682ms2.2%
create_issue386448ms761ms1503ms1.8%
list_channels341401ms704ms1412ms1.5%
get_user_profile298372ms655ms1341ms1%
send_notification264338ms592ms1204ms0.8%
update_task231305ms531ms1086ms1.7%
query_database208271ms478ms967ms0.5%
upload_file187238ms413ms854ms1.1%
delete_record156205ms352ms728ms0.6%
sync_calendar124168ms297ms601ms0%

Most Failing Tools Detail

ToolCallsErrorsAgentUpstreamRate
search_documents412282076.8%
create_issue386241766.2%
list_channels341191355.6%
get_user_profile298151044.9%
send_notification26411834.1%
update_task2319623.9%
query_database2087523.4%
upload_file1875312.7%
delete_record1563211.9%
sync_calendar1240000%
Tool Reliability, live. The slowest tools with their max spikes, the failing ones stacked by Agent, Upstream and Vinkius causes, a health matrix of the whole surface and the two detail tables. Console sample data, as the free tier sees it.

El mockup se ejecuta con el Sample Data de la consola. En un plan de pago la misma pantalla califica tus herramientas en vivo, por organización.

Los cuatro contadores

  • Tool Calls con la tasa de éxito derivada: la salud de toda la superficie de herramientas en un número.
  • Unique Tools activas en el período, así sabes cuán ancha es la superficie evaluada.
  • Avg Latency con la división de siempre: la parte esmeralda es la API upstream, la parte ámbar es el overhead de Vinkius. La lentitud de una herramienta casi nunca es el proxy.
  • Total Errors, en rojo en cuanto existen, con la división en tres debajo: Agent (4xx, culpa de quien llama), Upstream (5xx, el proveedor) y Vinkius (lanzado por el propio proxy).

Los dos rankings

Slowest Tools ordena las herramientas por latencia media, y cada barra lleva su pico máximo como un punto rojo: una herramienta puede promediar 300ms y aun así superar un segundo a las 2 de la madrugada, y este gráfico se niega a esconderlo. Esta es la lista para llevar a quien sea dueño del Connector.

Most Failing Tools ordena por recuento de errores, y cada barra está apilada por causa: ámbar para errores de Agent, rojo para Upstream, violeta para Vinkius. La pila te dice de quién es el problema antes incluso de abrir la tabla. Una herramienta que falla sobre todo en errores de Agent suele significar un problema de scope o de parámetros del lado de quien llama; sobre todo Upstream significa que el proveedor es inestable; cualquier porción violeta significa que el proxy interceptó algo y lo dijo.

La Health Matrix

El tercer gráfico traza cada herramienta como una burbuja: latencia en un eje, tasa de fallo en el otro, el tamaño de la burbuja es el volumen de llamadas. La esquina superior derecha es la zona de peligro, una herramienta lenta que falla a menudo; una burbuja grande ahí es tu próximo incidente, y la matriz es donde lo ves formarse.

Las dos tablas de detalle

Slowest Tools Detail da a cada herramienta lenta sus llamadas, la división de latencia API / Overhead / Total y el pico máximo. Most Failing Tools Detail da a cada herramienta que falla su recuento y tasa de errores, repartidos en las columnas Agent / Upstream / Vinkius, así el diagnóstico llega junto con el número. Las dos tablas son clicables hasta el detalle de la herramienta, y los dos estados vacíos son los de la propia consola: "No tool performance data recorded in this period." y "No tool error data recorded in this period."

Del síntoma al dueño

El enlace Details de la Tool Health Matrix de Mission Control te deja aquí. Desde una herramienta que falla, la siguiente parada es Request Failures para ver los requests reales que se rompieron, y la configuración de Connector Policy es donde una herramienta abusada repetidamente pasa a ser limitada. Esta pantalla convierte "la IA va lenta" en: esta herramienta, este servidor, esta latencia, esta causa, este dueño.