Zum Hauptinhalt springen

Gepflegtes Wissen

Gepflegtes Wissen stellt die einfachste Möglichkeit dar, Inhalte im AI Hub bereitzustellen. Es eignet sich besonders für kleinere Themenbereiche oder wenn das Quellsystem keine Schnittstellen besitzt.

Gepflegtes Wissen ist in Sammlungen (Content Lists) organisiert, die jeweils mehrere Datensätze (Content Items) enthalten.

Sammlungen

Eine Sammlung fasst thematisch zusammengehörige Datensätze zusammen und definiert, wie deren Inhalte für die Verarbeitung durch das KI-Modell aufgeteilt werden.

Sammlung erstellen

Beim Erstellen einer Sammlung werden folgende Felder konfiguriert:

  • Titel: Eindeutiger Name der Sammlung. Erlaubt sind Buchstaben, Zahlen, Leerzeichen, Bindestriche und Unterstriche.
  • Quellensichtbarkeit: Legt fest, ob diese Quelle standardmäßig als Referenz im Chat angezeigt wird. Auch wenn die Quelle verborgen ist, wird sie weiterhin für die Antwortgenerierung verwendet.

Chunking

Beim Erstellen einer Sammlung wird festgelegt, wie die Inhalte für die Verarbeitung durch das KI-Modell in kleinere Abschnitte (Chunks) aufgeteilt werden. Die Chunking-Einstellungen beeinflussen direkt die Qualität der Antworten.

Eine ausführliche Erklärung aller Einstellungen, Methoden und empfohlene Konfigurationen nach Anwendungsfall finden Sie unter Chunking.

warnung

Chunking-Einstellungen können nach dem Erstellen einer Sammlung nicht mehr geändert werden. Wählen Sie die Einstellungen daher sorgfältig.

Datensätze

Jede Sammlung enthält Datensätze, die entweder manuell als Text erstellt oder als Datei hochgeladen werden können.

Datensatz erstellen

Ein Datensatz kann auf zwei Arten erstellt werden:

Text-Datensatz: Inhalte werden über einen Rich-Text-Editor direkt eingegeben oder eingefügt.

Datei-Datensatz: Ein Dokument wird hochgeladen und der Text wird automatisch serverseitig extrahiert. Unterstützte Dateiformate:

KategorieFormate
DokumentePDF, DOCX, DOC, TXT, EPUB
TabellenXLS, XLSX, CSV
PräsentationenPPT, PPTX
WebHTML
DatenJSON, ZIP
AudioMP3, WAV

Die maximale Dateigröße beträgt 50 MB pro Datei.

Metadaten pro Datensatz

Für jeden Datensatz können zusätzliche Metadaten angegeben werden:

  • Quellentitel: Name der Quelle (wird bei Datei-Upload automatisch mit dem Dateinamen befüllt).
  • Quellendatum: Veröffentlichungs- oder Erstellungsdatum der Quelle.
  • Quellensichtbarkeit: Kann pro Datensatz überschrieben werden. Erbt standardmäßig die Einstellung der Sammlung.

Mehrere Dateien hochladen

Über die Option „Mehrere Datensätze aus Dateien hinzufügen" können mehrere Dokumente gleichzeitig hochgeladen werden. Dabei können ein gemeinsames Quellendatum und eine gemeinsame Sichtbarkeitseinstellung für alle Dateien festgelegt werden.

Import

CSV-Import für Sammlungen

Neue Sammlungen können per CSV-Datei erstellt werden.

  • Trennzeichen: Semikolon (;)
  • Maximale Dateigröße: 15 MB
  • Maximale Einträge: 1.000
  • Erforderliche Spalten: Title, Description
Title;Description
HR-Richtlinien;Mitarbeiterhandbuch und Richtlinien
Produktdokumentation;Technische Produktdokumentation

CSV-Import für Datensätze

Datensätze können per CSV-Datei zu einer bestehenden Sammlung hinzugefügt werden.

  • Trennzeichen: Semikolon (;)
  • Maximale Dateigröße: 15 MB
  • Maximale Einträge: 1.000
  • Erforderliche Spalten: Text
Text
Kapitel 1: Einführung in unsere Produkte
Kapitel 2: Installation und Einrichtung
Häufig gestellte Fragen und Antworten

Website-Import

Inhalte können direkt von einer Website importiert werden. Der Import nutzt den externen Dienst Firecrawl und erfordert einen konfigurierten API-Schlüssel in den Einstellungen.

  • Ziel-Sammlung: Die Sammlung, in die importiert werden soll.
  • Website-URL: Vollständige URL (muss mit http:// oder https:// beginnen).
  • Modus:
    • Einzelne Seite: Nur die angegebene URL wird importiert.
    • Gesamte Website: Alle Seiten der Domain werden gecrawlt und importiert.

Für jeden importierten Inhalt wird automatisch ein Datensatz mit extrahiertem Text, Quellentitel und aktuellem Datum erstellt.