Nachfrage
Alle Kennzahlen folgen dem Filter oben. Karten oeffnen ihre Ursachen und betroffenen Requests.
Mandanten
Kosten im Vergleich
| Mandant | Tokens | Direktkosten |
|---|
Kosten je Antwort = direkte Modellkosten geteilt durch beantwortete Chat-Anfragen.
Direktkosten
Modellkosten pro Tag
Datenqualitaet
Preisabdeckung
Kostenarten
Workflow, Chat und Embedding
| Bereich | Aufrufe | Tokens | Direktkosten | Umlage | Unbepreist |
|---|
Buchungsdetails
Modellkosten
| Tag | Provider | Modell | Zweck | Tokens | Kosten | Unbepreist |
|---|
Der Funnel zeigt die durchschnittliche Zahl der Quellen je RAG-Anfrage. ACL (Access Control List) ist die Berechtigungspruefung: Quellen ohne Zugriff fuer den Nutzer werden ausgeschlossen.
Funnel
Kandidaten bis Kontext
Reranker
Status und Fallbacks
Einordnung
So ist der Funnel zu lesen
Wissensluecken
Unzureichend abgedeckte Themen
| Thema | Luecken | Durchschnittliche Aehnlichkeit | Zuletzt |
|---|
p95 bezeichnet die Dauer, unter der 95 Prozent der gefilterten Werte liegen.
Workflows
Laeufe, Fehler und Kosten
| Workflow | Laeufe | Erfolgreich | Fehlgeschlagen | Erfolgsquote | p95 Dauer | Tokens | Direktkosten | Umlage | Unbepreist |
|---|
Request-Metadaten ohne Nachrichteninhalte. Waehle eine UUID aus der Liste oder gib sie manuell ein.
Gefilterte Auswahl
Requests
| Zeitpunkt | Mandant | Nutzer | Outcome | Latenz | No-Hit | UUID |
|---|
Ausgewahlte Anfrage