Handbuch · Kapitel 4 · Teil B Wissen
Sammlungen einrichten
Wozu
Die Einstellungen der Sammlung legen fest, welches Sprachmodell antwortet, wie es antwortet, was Besucher dürfen und welche Wege aus dem Chat heraus führen. Änderungen wirken auf alle Kanäle der Sammlung: Chat, Suche, Assistenten, Agenten.
Wo
Öffnen Sie in der Sammlungs-Schiene Bearbeiten. Die Seite ist in acht Abschnitte gegliedert; beim ersten Aufruf ist nur „Grundlagen“ offen. Alle Änderungen gelten nach Speichern am Ende der Seite.
Änderungen an Sprachen und Sprachmodellen wirken sich auf nachfolgende Indexierungen aus. Schon indexierte Inhalte bleiben erhalten.
Grundlagen

| Feld | Bedeutung |
|---|---|
| Titel | Name der Sammlung in Listen und Kopfzeile. |
| Sprachen | Sprachcodes mit Komma, zum Beispiel de,en. Bestimmt die Sprachauswahl im Chat, die Antwortsprache und die Sprachtabs aller Texte. |
| Typ (Frontend-Verhalten) | Standardverhalten der Einbettungen: Chatbot oder Webseitensuche. Der Typ eines Assistenten überschreibt diese Einstellung. |
| Schema | Der technische Name der Sammlung, beim Anlegen aus dem Titel abgeleitet, nicht änderbar. |
| Chat-/Antwort-LLM | Das Sprachmodell, das Chat-Anfragen beantwortet und Texte erzeugt. Die Auswahl kommt aus den LLM-Konfigurationen (Kapitel 24). |
| Embedding-LLM | Das Modell, das die Vektoren für den Index erzeugt. Nach dem Indexieren gesperrt, weil die Vektor-Dimension festliegt. |
Steht die Sammlung noch auf dem globalen Standard ohne hinterlegten Zugang, erscheint hier ein Hinweis: Dann antwortet der Chat nicht, und es entsteht kein Index.
Weitere Sprachmodelle und Verarbeitungsregion

| Feld | Bedeutung |
|---|---|
| Weitere LLM-Konfigurationen | Zusätzliche Modelle, die je Einbettung wählbar sind: für Modellvergleiche oder ein eigenes Modell je Seite. Ein Modell mit anderem Embedding bekommt einen eigenen Index, der nach dem Speichern im Hintergrund entsteht. |
| Verarbeitungsregion | „Nur EU“ oder „Nur Deutschland“: Das Chat-Widget zeigt dann das Attest „KI-Verarbeitung nur in der EU“ bzw. „in Deutschland“, aber nur in Einbettungen, deren Sprachmodell, Suchindex und Stimme in dieser Region verarbeiten. |
Die Tabelle darunter zeigt je Zweck (Chat, Embeddings, Stimme, Spracherkennung) die genutzte Konfiguration und ihre Region. Erfüllt die Hauptkonfiguration die Region nicht, erscheint das Attest nur in Einbettungen mit einem passenden Modell. Erfüllt kein Modell die Region, setzt dAI Pro sie beim Speichern auf „Keine Einschränkung“ zurück und meldet das. Ein Link führt zum maschinenlesbaren Nachweis. Kapitel 20 vertieft das Thema.
Antwortverhalten

| Feld | Bedeutung |
|---|---|
| Haupt-Prompt | Wird jedem Gespräch vorangestellt: Rolle, Tonalität, Firmenkontext, No-Gos. Je Sprache ein Tab. |
| Dateien in der Quellenangabe verlinken | Datei-Dokumente wie PDFs erscheinen in der Quellenangabe mit Titel und werden über einen internen Endpunkt verlinkt; Pfad und Dateiname bleiben verborgen. Aus = generische Angabe „unsere Wissensdatenbank“. |
| Quellen-Links springen zur Fundstelle | Web-Quellen bekommen ein Text-Fragment angehängt: Unterstützende Browser springen beim Öffnen direkt zur zitierten Stelle. PDF-Quellen springen zur Seite. |
| Antwortmodus „Einfache Sprache“ anbieten | Zeigt im Chat einen Umschalter für Antworten in einfacher Sprache. Nur die Formulierung ändert sich, Inhalt und Quellen bleiben gleich. |
| Antwort-Bewertung | Daumen unter jeder Antwort. Bewertungen landen im Protokoll und in dessen Auswertung (Kapitel 16). |
| Themenfilter-Schwelle | Ab welcher Unähnlichkeit eine Frage als themenfremd gilt und höflich abgelehnt wird. Höher = toleranter. |
Kapitel 7 erklärt, wie diese Felder zusammen die Qualität der Antworten bestimmen.
CAG-Konfiguration

dAI Pro kennt zwei Wege zur Antwort. RAG sucht je Frage die passenden Abschnitte im Index. CAG gibt dem Sprachmodell den gesamten Bestand mit, was bei kleinen Sammlungen genauere Antworten liefert und durch den Zwischenspeicher des Anbieters günstig bleibt.
| Feld | Bedeutung |
|---|---|
| CAG/RAG-Klassifikator pro Frage | Ein kleines Modell entscheidet je Frage zwischen breit (CAG) und spezifisch (RAG). Aus = einfache Regel: Passt der Bestand ins Limit, CAG, sonst RAG. |
| Standard-Modus im Test-Chat | Auto, Klassisch (RAG) oder Spezialist (CAG) als Vorgabe des Umschalters. |
| Umschalter im Chat zeigen | Ob Besucher den Modus selbst wählen dürfen. Für Demo-Instanzen meist aus. |
| CAG-Token-Limit | Bis zu welcher Größe des Bestands CAG genutzt wird; darüber fällt dAI Pro auf RAG zurück. 0 = Standard des Anbieters. |
Zugriff und Besucherfunktionen

| Feld | Bedeutung |
|---|---|
| Erlaubte Websites | Eine Adresse je Zeile. Leer heißt: Jede Website darf den Chat einbetten. Sobald eine Adresse eingetragen ist, funktionieren nur noch diese. Gilt für Chat, Suche, Upload, Übergabe und MCP. |
| Datei oder Foto anhängen | Büroklammer im Chat: Bilder und PDFs bis 10 MB werden im Moment der Frage in Text umgewandelt und als Kontext genutzt, nichts wird gespeichert. |
| Identitäts-Geheimnis | Lässt Ihre Website dem Chat sagen, wer angemeldet ist, verifiziert über ein signiertes Token. Kapitel 13. |
| Antwort-Endpunkt für KI-Agenten (MCP) | Stellt den Chat der Sammlung als Endpunkt für KI-Agenten bereit. Kapitel 14. |
Mensch-Übergabe

Zeigt im Chat den Link „Mit einem Menschen sprechen“ und bietet die Übergabe an, wenn der Chat nicht helfen konnte. Anliegen und Verlauf gehen per E-Mail an die Empfänger; mit „Rückruf anbieten“ können Besucher Telefonnummer und Wunschzeit hinterlassen. Kapitel 12 beschreibt den Ablauf aus Sicht des Besuchers und des Teams.
Aktionen aus dem Chat

Rückruf, Ticket und Termin sind bestätigte Aktionen: Der Chat bereitet eine Karte mit allen Feldern vor, gesendet wird erst nach Bestätigung des Besuchers. Hier verbinden Sie CRM, Ticketsystem, Support-Postfach und Terminkalender. Kapitel 12 erklärt jede Anbindung.
Sprach-Chat

Schaltet den Mikrofon-Knopf frei, wählt Stimme und Spracherkennung und pflegt das Vokabular für Marken- und Produktnamen. Kapitel 11.
Häufige Fragen
Warum kann ich das Embedding-LLM nicht mehr ändern? Der Index ist auf die Vektor-Dimension dieses Modells festgelegt. Für ein anderes Embedding-Modell legen Sie eine neue Sammlung an oder tragen es unter „Weitere Sprachmodelle“ ein; dann entsteht ein zweiter Index.
Ich habe die Verarbeitungsregion gesetzt, nach dem Speichern steht sie auf „Keine Einschränkung“. Kein Sprachmodell der Sammlung verarbeitet in dieser Region. Wählen Sie eine Konfiguration mit passender Region (Kapitel 24) und setzen Sie die Region erneut.
Gelten die erlaubten Websites auch für die Suche? Ja, für alle Endpunkte der Sammlung.
Siehe auch
- Kapitel 7 · Gute Antworten
- Kapitel 12 · Mensch-Übergabe und Aktionen
- Kapitel 20 · Verarbeitungsregion und Souveränität
- Kapitel 24 · Sprachmodelle konfigurieren