Verknüpftes Wissen
Der AI Hub bietet die Möglichkeit, Wissen aus externen Systemen zu integrieren und automatisch synchron zu halten. Im Gegensatz zu Gepflegtem Wissen, bei dem Inhalte manuell gepflegt werden, werden hier Inhalte automatisch aus externen Quellen abgerufen und periodisch aktualisiert.
Verfügbare Integrationen
Folgende native Integrationen stehen zur Verfügung:
- Webseiten — Einzelne Seiten, bestimmte Pfade oder gesamte Websites crawlen
- Atlassian Jira & Confluence — Spaces und Projekte synchronisieren
- GitHub — Repository-Inhalte synchronisieren
Zusätzlich gibt es die Möglichkeit, mittels Data Push API Wissen aus beliebigen externen Quellen in den AI Hub zu laden.
Einrichtung
Beim Erstellen einer verknüpften Wissensquelle werden folgende gemeinsame Felder konfiguriert:
- Titel: Eindeutiger Name der Quelle. Erlaubt sind Buchstaben, Zahlen, Leerzeichen, Bindestriche und Unterstriche.
- Typ: Die Art der Integration (Webseite, Confluence, GitHub, Jira oder Data Push). Der Typ kann nach dem Erstellen nicht mehr geändert werden.
- Quellensichtbarkeit: Legt fest, ob diese Quelle als Referenz im Chat angezeigt wird. Auch wenn die Quelle verborgen ist, wird sie weiterhin für die Antwortgenerierung verwendet. Wird eine bestehende Quelle verborgen, wirkt das sofort. Das Wiedereinblenden kann bei großen Sammlungen einige Minuten dauern, weil die bereits gespeicherten Inhalte im Hintergrund aktualisiert werden.
Je nach Typ werden zusätzliche, integrationsspezifische Felder angezeigt (URL, Zugangsdaten, Filtermöglichkeiten etc.) — siehe die jeweiligen Unterseiten.
Synchronisationsfrequenz
Für jede Quelle (außer Data Push) kann die Häufigkeit der automatischen Synchronisation individuell konfiguriert werden:
| Frequenz | Beschreibung |
|---|---|
| Täglich | Synchronisation einmal pro Tag |
| Wöchentlich | Synchronisation einmal pro Woche (montags) |
| Monatlich | Synchronisation einmal pro Monat (am Ersten) |
| Manuell | Keine automatische Synchronisation — nur bei manueller Auslösung |
Die Data Push API verwendet keine geplante Synchronisation, da Daten aktiv an den AI Hub übermittelt werden.
Synchronisationsstatus
Jede verknüpfte Wissensquelle (außer Data Push) zeigt ihren aktuellen Synchronisationsstatus an:
| Status | Beschreibung |
|---|---|
| Wartet auf Auslösung | Die Synchronisation wurde noch nicht gestartet oder wartet auf den nächsten geplanten Zeitpunkt |
| Laufend | Die Synchronisation wird gerade ausgeführt |
| Abgeschlossen | Die letzte Synchronisation wurde erfolgreich abgeschlossen |
| Fehler | Die letzte Synchronisation ist fehlgeschlagen — Details werden in der Fehlermeldung angezeigt |
Manuelle Synchronisation
Über die Schaltfläche Sync Content in der Eintragsansicht kann eine Synchronisation jederzeit manuell ausgelöst werden. Während der Synchronisation wird der Fortschritt automatisch alle 5 Sekunden aktualisiert.
Der Status Abgeschlossen sagt nur, dass der letzte Lauf technisch erfolgreich war — nicht, wann das war. Prüfen Sie daher die Spalte Aktualisiert am, bevor Sie sich auf den Inhalt einer Quelle verlassen. Sie ist sowohl in der Übersicht der Quellen als auch bei den einzelnen Einträgen vorhanden.
Liegt das Datum weit zurück, obwohl sich im Quellsystem etwas geändert hat, ist die Frequenz zu niedrig gewählt, steht sie auf Manuell, oder die Änderung wurde durch die Filterkriterien der Quelle nicht erfasst. Löst der Agent in einem solchen Fall falsche Antworten aus, liegt die Ursache nicht am Agent, sondern an einer veralteten Wissensquelle.
Chunking
Auch verknüpftes Wissen wird beim Erstellen in Chunks aufgeteilt. Die Einstellungen und Optionen sind identisch mit denen von Gepflegtem Wissen — eine ausführliche Erklärung aller Methoden, Einstellungen und empfohlene Konfigurationen nach Anwendungsfall finden Sie unter Chunking.
Chunking-Einstellungen können nach dem Erstellen einer Quelle nicht mehr geändert werden.
Einträge
Nach einer erfolgreichen Synchronisation werden die importierten Inhalte als einzelne Einträge angezeigt. Jeder Eintrag enthält:
- Titel: Name des synchronisierten Inhalts
- Datensatz: Der extrahierte Text des Inhalts
- Metadaten: Integrationsspezifische Informationen (z. B. Typ, letzte Synchronisation, bei Confluence zusätzlich der Ablageort der Seite)
- Quelle: Link zur Originalquelle im externen System
- Chunks: Anzahl der erzeugten Embedding-Chunks
- Externe ID: Die ID des Inhalts im Quellsystem