Cloud/AI Governance/Confiabilidade de Ferramentas

Confiabilidade de Ferramentas

Pergunte à IA sobre a Vinkius

Toda ferramenta que sua IA pode chamar, com nota: as mais lentas ranqueadas com os picos, as que falham divididas em causas Agent, Upstream e Vinkius, e uma matriz de latência contra falha de toda a superfície.

Uma frota pode estar saudável enquanto uma ferramenta arrasta toda conversa para a lama em silêncio. Tool Reliability é a tela que acaba com o achismo: toda ferramenta que seus agentes podem chamar, ranqueada duas vezes, por lentidão e por falha, com cada falha atribuída a uma causa. A linha do próprio console: "See which tools are slowing everything down and which ones are failing silently. Ranked, diagnosed, and ready for you to act on."

R

Tool Reliability

AI Briefing
Upgrade to unlock

See which tools are slowing everything down and which ones are failing silently. Ranked, diagnosed, and ready for you to act on.

Tool Calls8,420
98.3% success rate
Unique Tools24
Active in this period
Avg Latency187ms
API 112ms · Overhead 75ms
Total Errors142
Agent 99 · Upstream 36 · Vinkius 7

Slowest Tools

Avg latency (amber) · max spike (red)
Details
search_documents
823ms
create_issue
761ms
list_channels
704ms
get_user_profile
655ms
send_notification
592ms
update_task
531ms
query_database
478ms
upload_file
413ms
delete_record
352ms
sync_calendar
297ms

Most Failing Tools

Stacked by Agent / Upstream / Vinkius
Details
search_documents
28
create_issue
24
list_channels
19
get_user_profile
15
send_notification
11
update_task
9
query_database
7
upload_file
5
delete_record
3
sync_calendar
0

Health Matrix

Latency × Failure rate · bubble = call volume
Details
latency →↑ failures

Slowest Tools Detail

ToolCallsAPITotalMaxRate
search_documents412512ms823ms1682ms2.2%
create_issue386448ms761ms1503ms1.8%
list_channels341401ms704ms1412ms1.5%
get_user_profile298372ms655ms1341ms1%
send_notification264338ms592ms1204ms0.8%
update_task231305ms531ms1086ms1.7%
query_database208271ms478ms967ms0.5%
upload_file187238ms413ms854ms1.1%
delete_record156205ms352ms728ms0.6%
sync_calendar124168ms297ms601ms0%

Most Failing Tools Detail

ToolCallsErrorsAgentUpstreamRate
search_documents412282076.8%
create_issue386241766.2%
list_channels341191355.6%
get_user_profile298151044.9%
send_notification26411834.1%
update_task2319623.9%
query_database2087523.4%
upload_file1875312.7%
delete_record1563211.9%
sync_calendar1240000%
Tool Reliability, live. The slowest tools with their max spikes, the failing ones stacked by Agent, Upstream and Vinkius causes, a health matrix of the whole surface and the two detail tables. Console sample data, as the free tier sees it.

O mockup roda com o Sample Data do console. Num plano pago a mesma tela dá nota nas suas ferramentas ao vivo, por organização.

Os quatro contadores

  • Tool Calls com a taxa de sucesso derivada: a saúde de toda a superfície de ferramentas em um número.
  • Unique Tools ativas no período, para você saber quão larga é a superfície avaliada.
  • Avg Latency com a divisão de sempre: a fatia verde é a API upstream, a âmbar é o overhead da Vinkius. A lentidão de ferramenta quase nunca é o proxy.
  • Total Errors, vermelho no momento em que existem, com a divisão em três embaixo: Agent (4xx, culpa de quem chamou), Upstream (5xx, o provedor) e Vinkius (lançado pelo próprio proxy).

Os dois rankings

Slowest Tools ordena as ferramentas por latência média, e cada barra carrega o pico máximo como um ponto vermelho: uma ferramenta pode ter média de 300ms e ainda assim passar de um segundo às 2 da manhã, e este gráfico se recusa a esconder isso. Esta é a lista para levar a quem é dono do Connector.

Most Failing Tools ordena por contagem de erros, e cada barra é empilhada por causa: âmbar para erros de Agent, vermelho para Upstream, violeta para Vinkius. A pilha diz de quem é o problema antes de você abrir a tabela. Uma ferramenta falhando principalmente em erros de Agent normalmente significa problema de escopo ou parâmetro do lado de quem chama; principalmente Upstream significa provedor instável; qualquer fatia violeta significa que o proxy interceptou algo e disse isso.

A Health Matrix

O terceiro gráfico plota cada ferramenta como uma bolha: latência num eixo, taxa de falha no outro, o tamanho da bolha é o volume de chamadas. O canto superior direito é a zona de perigo, uma ferramenta lenta que falha bastante; uma bolha grande ali é o seu próximo incidente, e a matriz é onde você o vê se formando.

As duas tabelas de detalhe

Slowest Tools Detail dá a cada ferramenta lenta suas chamadas, a divisão de latência API / Overhead / Total e o pico máximo. Most Failing Tools Detail dá a cada ferramenta que falha a contagem e a taxa de erros, quebradas nas colunas Agent / Upstream / Vinkius, então o diagnóstico vem junto com o número. As duas tabelas são clicáveis até o detalhe da ferramenta, e os dois estados vazios são os do próprio console: "No tool performance data recorded in this period." e "No tool error data recorded in this period."

Do sintoma ao dono

O link Details da Tool Health Matrix do Mission Control derruba você aqui. De uma ferramenta que falha, a próxima parada é Request Failures para ver os requests que quebraram de verdade, e as políticas de Connector Policy são onde uma ferramenta abusada repetidamente passa a ser limitada. Esta tela transforma "a IA está lenta" em: esta ferramenta, este servidor, esta latência, esta causa, este dono.