Gepflegtes Wissen
Gepflegtes Wissen stellt die einfachste Möglichkeit dar, Inhalte im AI Hub bereitzustellen. Es eignet sich besonders für kleinere Themenbereiche oder wenn das Quellsystem keine Schnittstellen besitzt.
Gepflegtes Wissen ist in Sammlungen (Content Lists) organisiert, die jeweils mehrere Datensätze (Content Items) enthalten.
Pflegen Sie Inhalte hier nur dann, wenn sie in keinem bereits angebundenen System liegen können. Gehört ein Inhalt fachlich in ein Quellsystem, dann pflegen Sie ihn dort und binden Sie dieses System als Verknüpftes Wissen an — so bleibt der Inhalt sowohl im Quellsystem als auch über den Agent auffindbar.
Andernfalls entsteht eine zweite Kopie, die niemand als Kopie erkennt: Wird das Original aktualisiert, antwortet der Agent weiterhin mit dem alten Stand, ohne dass es auffällt.
Sammlungen
Eine Sammlung fasst thematisch zusammengehörige Datensätze zusammen und definiert, wie deren Inhalte für die Verarbeitung durch das KI-Modell aufgeteilt werden.
Sammlung erstellen
Beim Erstellen einer Sammlung werden folgende Felder konfiguriert:
- Titel: Eindeutiger Name der Sammlung. Erlaubt sind Buchstaben, Zahlen, Leerzeichen, Bindestriche und Unterstriche.
- Quellensichtbarkeit: Legt fest, ob diese Quelle standardmäßig als Referenz im Chat angezeigt wird. Auch wenn die Quelle verborgen ist, wird sie weiterhin für die Antwortgenerierung verwendet.
Chunking
Beim Erstellen einer Sammlung wird festgelegt, wie die Inhalte für die Verarbeitung durch das KI-Modell in kleinere Abschnitte (Chunks) aufgeteilt werden. Die Chunking-Einstellungen beeinflussen direkt die Qualität der Antworten.
Eine ausführliche Erklärung aller Einstellungen, Methoden und empfohlene Konfigurationen nach Anwendungsfall finden Sie unter Chunking.
Chunking-Einstellungen können nach dem Erstellen einer Sammlung nicht mehr geändert werden. Wählen Sie die Einstellungen daher sorgfältig.
Datensätze
Jede Sammlung enthält Datensätze, die entweder manuell als Text erstellt oder als Datei hochgeladen werden können.
Datensatz erstellen
Ein Datensatz kann auf zwei Arten erstellt werden:
Text-Datensatz: Inhalte werden über einen Rich-Text-Editor direkt eingegeben oder eingefügt.
Bei Inhalten, die Sie ohnehin neu formulieren müssen — etwa Kommunikationsrichtlinien oder eine FAQ-Sammlung —, muss der erste Entwurf nicht von Hand entstehen. Lassen Sie ihn von einer KI vorschlagen und prüfen und schärfen Sie ihn anschließend fachlich. Das spart den Kaltstart — die inhaltliche Verantwortung für den veröffentlichten Text bleibt bei Ihnen.
Datei-Datensatz: Ein Dokument wird hochgeladen und der Text wird automatisch serverseitig extrahiert. Unterstützte Dateiformate:
| Kategorie | Formate |
|---|---|
| Dokumente | PDF, DOCX, DOC, TXT, EPUB |
| Tabellen | XLS, XLSX, CSV |
| Präsentationen | PPT, PPTX |
| Web | HTML |
| Daten | JSON, ZIP |
| Audio | MP3, WAV |
Die maximale Dateigröße beträgt 50 MB pro Datei.
Wird ein sichtbarer Datei-Datensatz im Chat als Quelle verwendet, erscheint er in der Quellenliste als anklickbarer Download-Link, dessen Beschriftung der Quellentitel ist. Reine Text-Datensätze werden weiterhin als interne Quelle ohne Link angezeigt.
Metadaten pro Datensatz
Für jeden Datensatz können zusätzliche Metadaten angegeben werden:
- Quellentitel: Name der Quelle (wird bei Datei-Upload automatisch mit dem Dateinamen befüllt).
- Quellendatum: Veröffentlichungs- oder Erstellungsdatum der Quelle.
- Quellensichtbarkeit: Kann pro Datensatz überschrieben werden. Erbt standardmäßig die Einstellung der Sammlung.
Mehrere Dateien hochladen
Über die Option „Mehrere Datensätze aus Dateien hinzufügen" können mehrere Dokumente gleichzeitig hochgeladen werden. Dabei können ein gemeinsames Quellendatum und eine gemeinsame Sichtbarkeitseinstellung für alle Dateien festgelegt werden.
Import
Für beide CSV-Importe gilt dasselbe Vorgehen: Der Import-Dialog verlinkt eine Beispieldatei — laden Sie diese herunter, ersetzen Sie die Beispielzeilen durch Ihre Inhalte und lassen Sie die Kopfzeile unverändert. Speichern Sie die Datei anschließend als CSV mit UTF-8-Kodierung, damit Umlaute und Sonderzeichen korrekt übernommen werden.
Die Spaltennamen in der Kopfzeile müssen exakt den unten angegebenen englischen Bezeichnungen entsprechen (Groß- und Kleinschreibung ist unerheblich, zusätzliche Leerzeichen sind es nicht). Zeilen mit abweichenden Spaltennamen werden ohne Rückfrage übersprungen — im Extremfall meldet der Import einen Erfolg, ohne dass ein einziger Eintrag angelegt wurde.
CSV-Import für Sammlungen
Neue Sammlungen können per CSV-Datei erstellt werden.
- Trennzeichen: Semikolon (
;) - Maximale Dateigröße: 15 MB
- Maximale Einträge: 1.000
- Erforderliche Spalten:
Title,Description
Title;Description
HR-Richtlinien;Mitarbeiterhandbuch und Richtlinien
Produktdokumentation;Technische Produktdokumentation
CSV-Import für Datensätze
Datensätze können per CSV-Datei zu einer bestehenden Sammlung hinzugefügt werden.
- Trennzeichen: Semikolon (
;) - Maximale Dateigröße: 15 MB
- Maximale Einträge: 1.000
- Erforderliche Spalten:
Text
Text
Kapitel 1: Einführung in unsere Produkte
Kapitel 2: Installation und Einrichtung
Häufig gestellte Fragen und Antworten
Website-Import
Inhalte können direkt von einer Website importiert werden. Der Import nutzt den externen Dienst Firecrawl und erfordert einen konfigurierten API-Schlüssel in den Einstellungen.
- Ziel-Sammlung: Die Sammlung, in die importiert werden soll.
- Website-URL: Vollständige URL (muss mit
http://oderhttps://beginnen). - Modus:
- Einzelne Seite: Nur die angegebene URL wird importiert.
- Gesamte Website: Alle Seiten der Domain werden gecrawlt und importiert.
Für jeden importierten Inhalt wird automatisch ein Datensatz mit extrahiertem Text, Quellentitel und aktuellem Datum erstellt.