Webseiten
Die Webseiten-Integration ermöglicht es, Inhalte von externen Websites automatisch zu importieren und als Wissensquelle für Agents bereitzustellen. So kann ein Agent z. B. Fragen zu Ihren Produktseiten, Support-Artikeln oder öffentlichen Dokumentationen beantworten — ohne dass die Inhalte manuell gepflegt werden müssen.
Voraussetzungen
Für das Crawlen von Webseiten wird der externe Dienst Firecrawl verwendet. Dafür wird ein Firecrawl-API-Schlüssel benötigt, der in den Einstellungen hinterlegt werden muss.
Konfiguration
- Website-URL: Die vollständige URL der Website, die importiert werden soll. Muss mit
http://oderhttps://beginnen. - Modus: Bestimmt den Umfang des Imports (siehe unten).
Modus
| Modus | Beschreibung | Geeignet für |
|---|---|---|
| Einzelne Seite | Nur die angegebene URL wird importiert | Einzelne Artikel oder Landingpages |
| Bestimmte Pfade | Alle Seiten unter dem angegebenen Pfad werden gecrawlt | Bestimmte Bereiche einer Website (z. B. /docs/ oder /blog/) |
| Gesamte Website | Alle Seiten der Domain werden gecrawlt (folgt internen Links) | Komplette Websites oder Wissensdatenbanken |
Beim Erstellen einer Webseiten-Quelle muss bestätigt werden, dass alle geltenden Gesetze und die Nutzungsbedingungen der jeweiligen Website eingehalten werden.
Die Synchronisationsfrequenz und weitere gemeinsame Einstellungen (Chunking, Quellensichtbarkeit) werden unter Verknüpftes Wissen beschrieben.