Gepflegtes Wissen
Gepflegtes Wissen stellt die einfachste Möglichkeit dar, Inhalte im AI Hub bereitzustellen. Es eignet sich besonders für kleinere Themenbereiche oder wenn das Quellsystem keine Schnittstellen besitzt.
Gepflegtes Wissen ist in Sammlungen (Content Lists) organisiert, die jeweils mehrere Datensätze (Content Items) enthalten.
Sammlungen
Eine Sammlung fasst thematisch zusammengehörige Datensätze zusammen und definiert, wie deren Inhalte für die Verarbeitung durch das KI-Modell aufgeteilt werden.
Sammlung erstellen
Beim Erstellen einer Sammlung werden folgende Felder konfiguriert:
- Titel: Eindeutiger Name der Sammlung. Erlaubt sind Buchstaben, Zahlen, Leerzeichen, Bindestriche und Unterstriche.
- Quellensichtbarkeit: Legt fest, ob diese Quelle standardmäßig als Referenz im Chat angezeigt wird. Auch wenn die Quelle verborgen ist, wird sie weiterhin für die Antwortgenerierung verwendet.
Chunking
Beim Erstellen einer Sammlung wird festgelegt, wie die Inhalte für die Verarbeitung durch das KI-Modell in kleinere Abschnitte (Chunks) aufgeteilt werden. Die Chunking-Einstellungen beeinflussen direkt die Qualität der Antworten.
Eine ausführliche Erklärung aller Einstellungen, Methoden und empfohlene Konfigurationen nach Anwendungsfall finden Sie unter Chunking.
Chunking-Einstellungen können nach dem Erstellen einer Sammlung nicht mehr geändert werden. Wählen Sie die Einstellungen daher sorgfältig.
Datensätze
Jede Sammlung enthält Datensätze, die entweder manuell als Text erstellt oder als Datei hochgeladen werden können.
Datensatz erstellen
Ein Datensatz kann auf zwei Arten erstellt werden:
Text-Datensatz: Inhalte werden über einen Rich-Text-Editor direkt eingegeben oder eingefügt.
Datei-Datensatz: Ein Dokument wird hochgeladen und der Text wird automatisch serverseitig extrahiert. Unterstützte Dateiformate:
| Kategorie | Formate |
|---|---|
| Dokumente | PDF, DOCX, DOC, TXT, EPUB |
| Tabellen | XLS, XLSX, CSV |
| Präsentationen | PPT, PPTX |
| Web | HTML |
| Daten | JSON, ZIP |
| Audio | MP3, WAV |
Die maximale Dateigröße beträgt 50 MB pro Datei.
Metadaten pro Datensatz
Für jeden Datensatz können zusätzliche Metadaten angegeben werden:
- Quellentitel: Name der Quelle (wird bei Datei-Upload automatisch mit dem Dateinamen befüllt).
- Quellendatum: Veröffentlichungs- oder Erstellungsdatum der Quelle.
- Quellensichtbarkeit: Kann pro Datensatz überschrieben werden. Erbt standardmäßig die Einstellung der Sammlung.
Mehrere Dateien hochladen
Über die Option „Mehrere Datensätze aus Dateien hinzufügen" können mehrere Dokumente gleichzeitig hochgeladen werden. Dabei können ein gemeinsames Quellendatum und eine gemeinsame Sichtbarkeitseinstellung für alle Dateien festgelegt werden.
Import
CSV-Import für Sammlungen
Neue Sammlungen können per CSV-Datei erstellt werden.
- Trennzeichen: Semikolon (
;) - Maximale Dateigröße: 15 MB
- Maximale Einträge: 1.000
- Erforderliche Spalten:
Title,Description
Title;Description
HR-Richtlinien;Mitarbeiterhandbuch und Richtlinien
Produktdokumentation;Technische Produktdokumentation
CSV-Import für Datensätze
Datensätze können per CSV-Datei zu einer bestehenden Sammlung hinzugefügt werden.
- Trennzeichen: Semikolon (
;) - Maximale Dateigröße: 15 MB
- Maximale Einträge: 1.000
- Erforderliche Spalten:
Text
Text
Kapitel 1: Einführung in unsere Produkte
Kapitel 2: Installation und Einrichtung
Häufig gestellte Fragen und Antworten
Website-Import
Inhalte können direkt von einer Website importiert werden. Der Import nutzt den externen Dienst Firecrawl und erfordert einen konfigurierten API-Schlüssel in den Einstellungen.
- Ziel-Sammlung: Die Sammlung, in die importiert werden soll.
- Website-URL: Vollständige URL (muss mit
http://oderhttps://beginnen). - Modus:
- Einzelne Seite: Nur die angegebene URL wird importiert.
- Gesamte Website: Alle Seiten der Domain werden gecrawlt und importiert.
Für jeden importierten Inhalt wird automatisch ein Datensatz mit extrahiertem Text, Quellentitel und aktuellem Datum erstellt.