Handbuch · Kapitel 19 · Teil D Betrieb im Alltag

Verbrauch und Kosten

Wozu

Jeder Aufruf eines Sprachmodells kostet Geld, meist Bruchteile eines Cents, in Summe aber spürbar. dAI Pro protokolliert jeden Aufruf je Sammlung, Zweck und Modell und rechnet ihn mit hinterlegten Listenpreisen in Kosten um. So sehen Sie, was der Chat, die Suche, die Agenten und die Indexierung kosten, und was eine gelöste Anfrage im Durchschnitt wert ist.

Wo

Öffnen Sie in der Sammlungs-Schiene Verbrauch.

Die Seite „Verbrauch“ mit Gesprächsausgang, Verbrauch nach Tag und Export

Preise hinterlegen

Der Kasten Preise konfigurieren gilt für alle Sammlungen der Instanz. Je Modell tragen Sie die Listenpreise des Anbieters ein: Eingabe und Ausgabe je Million Tokens, für Texterkennung je 1.000 Seiten, für Audio je Minute, dazu den Anteil, den ein Treffer im Zwischenspeicher des Anbieters kostet. Preise in der Währung des Anbieters; Dollar-Preise rechnet dAI Pro zum aktuellen Referenzkurs der Europäischen Zentralbank in Euro um. Ohne Preis erscheinen nur Tokens, keine Kosten.

Gesprächsausgang und Kosten je gelöster Anfrage

Der obere Block bewertet den laufenden Monat ohne KI-Urteil, allein aus Signalen: Eine Absage zählt als Wissenslücke; Daumen, Folgefrage, Umformulierung und Übergabe schreiben die Antwort davor fort.

KennzahlBedeutung
AntwortenAlle Antworten des Chats im Monat.
GelöstBeantwortet, bestätigt, Folgefrage, Aktion ausgelöst.
Nicht gelöstWissenslücke, abgelehnt, umformuliert, Übergabe, Fehler.
LösungsquoteGelöst geteilt durch alle.
KI-Kosten der AntwortenKosten aller Antworten mit hinterlegtem Preis.
Kosten je gelöster AnfrageDie Zahl, die zählt: Was kostet eine Anfrage, die der Chat wirklich erledigt hat.

Verbrauch nach Tag

Je Tag ein aufklappbarer Block mit Aufrufen, Tokens und Kosten, darin die Tabelle je Zweck und Modell:

SpalteBedeutung
Für wasDer Zweck: Chat, Suche, Embedding, Agent, Copilot, Sprach-Chat, Endpunkt für Agenten.
ModellDas verwendete Modell.
AufrufeAnzahl der Aufrufe.
Tokens ein, davon Cache-Treffer, davon Cache neuEingabe-Tokens und wie viele davon aus dem Zwischenspeicher des Anbieters kamen. Ein hoher Anteil Cache-Treffer macht den CAG-Modus günstig.
Tokens ausAusgabe-Tokens.
Seiten, MinutenFür Texterkennung und Audio.
KostenNach hinterlegtem Preis, in Euro.

Export

Excel-Export und CSV-Export liefern eine Zeile je Tag, Zweck und Modell im gewählten Zeitraum, mit Kosten in Euro. Für die Kostenstelle, für den Abgleich mit der Rechnung des Anbieters oder für eigene Auswertungen.

Was Kosten treibt

  • Lange Antworten und lange Gespräche. Jede Antwort trägt den Verlauf mit. Der Haupt-Prompt darf knapp sein.
  • Suche beim Tippen (Kapitel 9): jede Zwischeneingabe eine Zusammenfassung.
  • Neu indexieren. Jedes verarbeitete Dokument kostet Embeddings; der Frische-Wächter verarbeitet nur Geändertes.
  • Agenten mit KI-Urteil: Qualitätsprüfung, Golden Set mit Richter, Inhalts-Wächter. Ihr Zeitplan bestimmt die Kosten.
  • Der Antwort-Cache spart: Gleiche Fragen kosten kein zweites Mal.

Häufige Fragen

Die Kosten stehen auf 0,00 Euro. Für das Modell ist kein Preis hinterlegt. Tragen Sie ihn im Kasten „Preise konfigurieren“ ein; die Umrechnung gilt rückwirkend für den Verbrauch.

Die Summe weicht von der Rechnung des Anbieters ab. Listenpreise, Kursschwankungen und Rundungen. Der Verbrauch in Tokens stimmt; die Kosten sind eine Schätzung auf Listenpreisbasis.

Zählt der Test-Chat im Backend mit? Ja, wie jeder andere Aufruf.

Siehe auch