Zum Hauptinhalt springen

Webseiten

Die Webseiten-Integration ermöglicht es, Inhalte von externen Websites automatisch zu importieren und als Wissensquelle für Agents bereitzustellen. So kann ein Agent z. B. Fragen zu Ihren Produktseiten, Support-Artikeln oder öffentlichen Dokumentationen beantworten — ohne dass die Inhalte manuell gepflegt werden müssen.

Voraussetzungen

Für das Crawlen von Webseiten wird der externe Dienst Firecrawl verwendet. Dafür wird ein Firecrawl-API-Schlüssel benötigt, der in den Einstellungen hinterlegt werden muss.

Konfiguration

  • Website-URL: Die vollständige URL der Website, die importiert werden soll. Muss mit http:// oder https:// beginnen.
  • Modus: Bestimmt den Umfang des Imports (siehe unten).

Modus

ModusBeschreibungGeeignet für
Einzelne SeiteNur die angegebene URL wird importiertEinzelne Artikel oder Landingpages
Bestimmte PfadeAlle Seiten unter dem angegebenen Pfad werden gecrawltBestimmte Bereiche einer Website (z. B. /docs/ oder /blog/)
Gesamte WebsiteAlle Seiten der Domain werden gecrawlt (folgt internen Links)Komplette Websites oder Wissensdatenbanken
warnung

Beim Erstellen einer Webseiten-Quelle muss bestätigt werden, dass alle geltenden Gesetze und die Nutzungsbedingungen der jeweiligen Website eingehalten werden.

tipp

Die Synchronisationsfrequenz und weitere gemeinsame Einstellungen (Chunking, Quellensichtbarkeit) werden unter Verknüpftes Wissen beschrieben.