Cloud/AI Governance/ツール信頼性

ツール信頼性

VinkiusについてAIに質問

AIが呼び出せるすべてのツールを評価します。最も遅いツールはスパイクとともにランキングされ、失敗するツールはAgent、Upstream、Vinkiusの原因別に分類され、さらに全サーフェスのレイテンシ対失敗率のマトリクスを提供します。

フリート全体は健全でも、1つのツールが静かにすべての会話を泥沼に引きずり込んでいることがあります。Tool Reliabilityは推測に終止符を打つ画面です。エージェントが呼び出せるすべてのツールが、遅さと失敗の2軸でランク付けされ、それぞれの失敗が原因に帰属されます。コンソール自体の言葉は次のとおりです。"See which tools are slowing everything down and which ones are failing silently. Ranked, diagnosed, and ready for you to act on."

R

Tool Reliability

AI Briefing
Upgrade to unlock

See which tools are slowing everything down and which ones are failing silently. Ranked, diagnosed, and ready for you to act on.

Tool Calls8,420
98.3% success rate
Unique Tools24
Active in this period
Avg Latency187ms
API 112ms · Overhead 75ms
Total Errors142
Agent 99 · Upstream 36 · Vinkius 7

Slowest Tools

Avg latency (amber) · max spike (red)
Details
search_documents
823ms
create_issue
761ms
list_channels
704ms
get_user_profile
655ms
send_notification
592ms
update_task
531ms
query_database
478ms
upload_file
413ms
delete_record
352ms
sync_calendar
297ms

Most Failing Tools

Stacked by Agent / Upstream / Vinkius
Details
search_documents
28
create_issue
24
list_channels
19
get_user_profile
15
send_notification
11
update_task
9
query_database
7
upload_file
5
delete_record
3
sync_calendar
0

Health Matrix

Latency × Failure rate · bubble = call volume
Details
latency →↑ failures

Slowest Tools Detail

ToolCallsAPITotalMaxRate
search_documents412512ms823ms1682ms2.2%
create_issue386448ms761ms1503ms1.8%
list_channels341401ms704ms1412ms1.5%
get_user_profile298372ms655ms1341ms1%
send_notification264338ms592ms1204ms0.8%
update_task231305ms531ms1086ms1.7%
query_database208271ms478ms967ms0.5%
upload_file187238ms413ms854ms1.1%
delete_record156205ms352ms728ms0.6%
sync_calendar124168ms297ms601ms0%

Most Failing Tools Detail

ToolCallsErrorsAgentUpstreamRate
search_documents412282076.8%
create_issue386241766.2%
list_channels341191355.6%
get_user_profile298151044.9%
send_notification26411834.1%
update_task2319623.9%
query_database2087523.4%
upload_file1875312.7%
delete_record1563211.9%
sync_calendar1240000%
Tool Reliability, live. The slowest tools with their max spikes, the failing ones stacked by Agent, Upstream and Vinkius causes, a health matrix of the whole surface and the two detail tables. Console sample data, as the free tier sees it.

モックアップはコンソールのSample Dataで動作します。有料プランでは、同じ画面が組織ごとに稼働中のツールを評価します。

4つのカウンター

  • Tool Calls。そこから算出された成功率が付きます。ツールサーフェス全体の健全性が1つの数字でわかります。
  • 期間内にアクティブだったUnique Tools。評価対象の範囲がどれほど広いかがわかります。
  • Avg Latency。おなじみの分割付きです。エメラルドの部分がupstream API、アンバーの部分がVinkiusのoverhead。ツールの遅さの原因がプロキシであることはほとんどありません。
  • Total Errors。エラーが存在する時点で赤く表示され、その下に3分割があります。Agent(4xx、呼び出し側の過ち)、Upstream(5xx、プロバイダー)、Vinkius(プロキシ自身が投げたもの)。

2つのランキング

Slowest Toolsは平均レイテンシでツールをランク付けし、各バーには最大スパイクが赤い点として付きます。平均300msのツールでも、午前2時に1秒を超えるスパイクが出ることはあり得ますが、このグラフはそれを隠しません。これが、Connectorの所有者に持っていくべきリストです。

Most Failing Toolsはエラー件数でランク付けし、各バーは原因別に積み上げられています。アンバーがAgentエラー、赤がUpstream、紫がVinkiusです。表を開く前に、積み上げが誰の問題かを教えてくれます。主にAgentエラーで失敗するツールは、呼び出し側のscopeやパラメーターの問題を意味することが多く、主にUpstreamならプロバイダーが不安定、そして少しでも紫があれば、プロキシが何かを傍受してそのことを告げたという意味です。

Health Matrix

3つ目のグラフは各ツールをバブルで描きます。片方の軸はレイテンシ、もう片方は失敗率、バブルの大きさは呼び出し量です。右上のコーナーが危険地帯で、頻繁に失敗する遅いツールが現れます。そこにある大きなバブルは次のインシデントであり、このマトリクスはその兆候が形作られていくのを見る場所です。

2つの詳細テーブル

Slowest Tools Detailは、遅い各ツールの呼び出し数、API / Overhead / Totalのレイテンシ分割、そして最大スパイクを示します。Most Failing Tools Detailは、失敗している各ツールのエラー件数と率をAgent / Upstream / Vinkiusの列に分けて示し、診断が数字と一緒に届きます。両テーブルともクリックでツールの詳細に進めます。両方の空の状態はコンソール本来のものです。"No tool performance data recorded in this period.""No tool error data recorded in this period."

症状からオーナーへ

Mission ControlのTool Health MatrixにあるDetailsリンクがここに着地します。失敗しているツールからは、実際に壊れたリクエストを見るためにRequest Failuresへ、繰り返し乱用されるツールのスロットリングはConnector Policyの設定で行います。この画面は「AIが遅く感じる」をこう変換します。このツール、このサーバー、このレイテンシ、この原因、このオーナー、と。