Handbuch · Kapitel 19 · Teil D Betrieb im Alltag
Verbrauch und Kosten
Wozu
Jeder Aufruf eines Sprachmodells kostet Geld, meist Bruchteile eines Cents, in Summe aber spürbar. dAI Pro protokolliert jeden Aufruf je Sammlung, Zweck und Modell und rechnet ihn mit hinterlegten Listenpreisen in Kosten um. So sehen Sie, was der Chat, die Suche, die Agenten und die Indexierung kosten, und was eine gelöste Anfrage im Durchschnitt wert ist.
Wo
Öffnen Sie in der Sammlungs-Schiene Verbrauch.

Preise hinterlegen
Der Kasten Preise konfigurieren gilt für alle Sammlungen der Instanz. Je Modell tragen Sie die Listenpreise des Anbieters ein: Eingabe und Ausgabe je Million Tokens, für Texterkennung je 1.000 Seiten, für Audio je Minute, dazu den Anteil, den ein Treffer im Zwischenspeicher des Anbieters kostet. Preise in der Währung des Anbieters; Dollar-Preise rechnet dAI Pro zum aktuellen Referenzkurs der Europäischen Zentralbank in Euro um. Ohne Preis erscheinen nur Tokens, keine Kosten.
Gesprächsausgang und Kosten je gelöster Anfrage
Der obere Block bewertet den laufenden Monat ohne KI-Urteil, allein aus Signalen: Eine Absage zählt als Wissenslücke; Daumen, Folgefrage, Umformulierung und Übergabe schreiben die Antwort davor fort.
| Kennzahl | Bedeutung |
|---|---|
| Antworten | Alle Antworten des Chats im Monat. |
| Gelöst | Beantwortet, bestätigt, Folgefrage, Aktion ausgelöst. |
| Nicht gelöst | Wissenslücke, abgelehnt, umformuliert, Übergabe, Fehler. |
| Lösungsquote | Gelöst geteilt durch alle. |
| KI-Kosten der Antworten | Kosten aller Antworten mit hinterlegtem Preis. |
| Kosten je gelöster Anfrage | Die Zahl, die zählt: Was kostet eine Anfrage, die der Chat wirklich erledigt hat. |
Verbrauch nach Tag
Je Tag ein aufklappbarer Block mit Aufrufen, Tokens und Kosten, darin die Tabelle je Zweck und Modell:
| Spalte | Bedeutung |
|---|---|
| Für was | Der Zweck: Chat, Suche, Embedding, Agent, Copilot, Sprach-Chat, Endpunkt für Agenten. |
| Modell | Das verwendete Modell. |
| Aufrufe | Anzahl der Aufrufe. |
| Tokens ein, davon Cache-Treffer, davon Cache neu | Eingabe-Tokens und wie viele davon aus dem Zwischenspeicher des Anbieters kamen. Ein hoher Anteil Cache-Treffer macht den CAG-Modus günstig. |
| Tokens aus | Ausgabe-Tokens. |
| Seiten, Minuten | Für Texterkennung und Audio. |
| Kosten | Nach hinterlegtem Preis, in Euro. |
Export
Excel-Export und CSV-Export liefern eine Zeile je Tag, Zweck und Modell im gewählten Zeitraum, mit Kosten in Euro. Für die Kostenstelle, für den Abgleich mit der Rechnung des Anbieters oder für eigene Auswertungen.
Was Kosten treibt
- Lange Antworten und lange Gespräche. Jede Antwort trägt den Verlauf mit. Der Haupt-Prompt darf knapp sein.
- Suche beim Tippen (Kapitel 9): jede Zwischeneingabe eine Zusammenfassung.
- Neu indexieren. Jedes verarbeitete Dokument kostet Embeddings; der Frische-Wächter verarbeitet nur Geändertes.
- Agenten mit KI-Urteil: Qualitätsprüfung, Golden Set mit Richter, Inhalts-Wächter. Ihr Zeitplan bestimmt die Kosten.
- Der Antwort-Cache spart: Gleiche Fragen kosten kein zweites Mal.
Häufige Fragen
Die Kosten stehen auf 0,00 Euro. Für das Modell ist kein Preis hinterlegt. Tragen Sie ihn im Kasten „Preise konfigurieren“ ein; die Umrechnung gilt rückwirkend für den Verbrauch.
Die Summe weicht von der Rechnung des Anbieters ab. Listenpreise, Kursschwankungen und Rundungen. Der Verbrauch in Tokens stimmt; die Kosten sind eine Schätzung auf Listenpreisbasis.
Zählt der Test-Chat im Backend mit? Ja, wie jeder andere Aufruf.
Siehe auch
- Kapitel 15 · Agenten
- Kapitel 16 · Qualitäts-Cockpit
- Kapitel 24 · Sprachmodelle konfigurieren