• PASS
  • FAIL
  • REVIEW
  • HUMAN

Evaluierungs-Benchmarks mit KI festlegen

Verbinden Sie diesen MCP mit Ihrem KI-Client, um die exakten Schwellenwerte für Ihre Qualitätsprüfungen abzurufen.

Fragen Sie die KI zu dieser Seite

Kurzantwort

Wie lege ich Benchmarks für meine KI fest?

Ihre KI nutzt das Tool get_dimension_benchmarks, um spezifische Schwellenwerte für verschiedene Qualitätsdimensionen abzurufen. So erhält Ihr Agent die exakten Zahlen, um zu entscheiden, ob ein Wert hoch oder niedrig ist. Die entsprechenden Ergebnisse sehen Sie unten.

Benchmark-Ergebnisse

Einordnung der Scores.

Die KI nutzt diese Schwellenwerte, um Ihre Anwendungsergebnisse zu kategorisieren.

PASS

Hohe Qualität

Die KI identifiziert Scores, die den erforderlichen Schwellenwert erreichen oder überschreiten. Diese Ergebnisse werden als starke Leistung markiert.

FAIL

Geringe Qualität

Die KI erkennt Scores, die unter dem definierten Minimum liegen. Diese werden als unzureichend markiert.

REVIEW

Grenzfälle

Scores, die genau an der Grenze eines Schwellenwerts liegen, werden zur Überprüfung markiert. Hier entscheiden Sie, ob das Urteil der KI korrekt ist.

HUMAN

Manuelle Korrektur

Wenn die KI einen Konflikt mit den Schwellenwerten meldet, können Sie eingreifen, um den Benchmark oder die Entscheidung anzupassen.

Der Ablauf

Was Ihre KI bei einer Anfrage tut.

Die KI übernimmt den Datenabruf, damit Sie sich auf die Analyse konzentrieren können.

  1. Schwellenwerte abrufen

    Ihr Agent fordert die spezifischen Grenzwerte für jede Qualitätsdimension an.

    get_dimension_benchmarks
  2. Scores vergleichen

    Die KI gleicht Ihre aktuellen Anwendungsergebnisse mit den abgerufenen Benchmarks ab.

    get_dimension_benchmarks
  3. Ergebnisse kategorisieren

    Der Agent ordnet jeden Score basierend auf den Daten in die Kategorien Pass, Fail oder Review ein.

    get_dimension_benchmarks
  4. Ausreißer markieren

    Die KI hebt Scores hervor, die im Vergleich zu den Benchmarks statistisch ungewöhnlich sind.

    get_dimension_benchmarks

Probieren Sie es

Kopieren Sie diese Vorlagen.

Nutzen Sie diese Prompts, um den Benchmarking-Prozess zu starten.

Startpunkte

Dies sind Vorlagen. Passen Sie die Namen der Dimensionen an Ihre tatsächlichen Qualitätsmetriken an.

Accelerator Application Quality Score Connector

Alles bereit. Wählen Sie Ihren MCP-Client und folgen Sie den Einrichtungsschritten.

Connector-Linkhttps://edge.vinkius.com/vk_preview_jzP4NK1jm33dd0NP6aFfcuMCufj9juqr2jZ0gJ25/mcp

Claude Desktop

Folgen Sie den Schritten unten, um sich in Sekunden zu verbinden.

  1. 1In Claude Desktop, open Settings → Connectors.
  2. 2Click “Add custom connector” and paste the connector link above as the remote MCP server URL.
  3. 3Click Add and start a new chat — Accelerator Application Quality Score capabilities are ready to use.
Konfiguration · claude_desktop_config.jsonKopieren
{
  "mcpServers": {
    "accelerator-application-quality-score-mcp": {
      "url": "https://edge.vinkius.com/vk_preview_jzP4NK1jm33dd0NP6aFfcuMCufj9juqr2jZ0gJ25/mcp"
    }
  }
}
In den Chat kopieren04
  • Rufe die Benchmarks für die Dimension 'Accuracy' ab, damit ich diesen Batch bewerten kann.

  • Vergleiche die Scores in meiner 'User Experience' Tabelle mit den aktuellen Schwellenwerten.

  • Wie hoch sind aktuell die Pass/Fail-Limits für die Dimension 'Security'?

  • Prüfe die neuesten Anwendungsergebnisse in meinem GitHub-Repo gegen die Qualitäts-Benchmarks.

  • Claude
  • ChatGPT
  • Cursor
  • VS Code
  • Windsurf
  • Claude Code
  • JetBrains
  • Cline

Starten Sie hier

Einmal verbinden, dann fragen.

Klicken Sie einfach auf den Link, um den MCP mit Ihrem Client zu verbinden. Ihre Logins bleiben auf unserer Seite verschlüsselt. Details finden Sie auf der Connector-Seite.

Accelerator Application Quality Score mit Ihrer KI verbinden

FAQ

Funktionsweise

  • 01

    Kann die KI die Schwellenwerte ändern?

    Nein. Die KI kann die bestehenden Schwellenwerte über das Tool lediglich abrufen. Änderungen müssen in Ihrem Quellsystem vorgenommen werden.

  • 02

    Löscht die KI meine Scoring-Daten?

    Nein. Die KI liest die Benchmark-Daten nur aus, um Vergleiche durchzuführen. Sie kann keine Datensätze löschen oder verändern.

  • 03

    Kann ich das Tool nutzen, um neue Regeln festzulegen?

    Nein. Die KI nutzt ausschließlich die bereits existierenden Regeln. Sie kann keine neue Scoring-Logik erstellen oder neue Benchmark-Werte schreiben.

  • 04

    Was passiert, wenn für eine Dimension kein Benchmark existiert?

    Die KI meldet, dass für diese spezifische Dimension kein Schwellenwert definiert wurde.

  • 05

    Woran erkennt die KI einen 'starken' Score?

    Sie vergleicht den numerischen Wert mit dem spezifischen Wert, den das Tool get_dimension_benchmarks zurückgibt.

  • Weitere Fragen zum Accelerator Application Quality Score? Die Connector-Seite liefert Antworten. Alle Funktionen des Accelerator Application Quality Score Connectors sehen

Verbinde Accelerator Application Quality Score mit Claude, Cursor, ChatGPT & mehr