Auf Ihrer Website trainieren
Crawling, Seitenlimits und Antworten aktuell halten
Wie das Crawling funktioniert
Chatixy beginnt bei der von Ihnen angegebenen URL und folgt internen Links bis zur Seitenlimitierung Ihres Plans, wobei der sichtbare Textinhalt jeder Seite indexiert wird. Seiten hinter Logins, Bezahlschranken oder robots.txt-Sperren werden übersprungen.
Es gelten zwei Begrenzungen. Das Seitenlimit pro Website beschränkt einen einzelnen Crawl (Starter 150, Pro 2.500, Business 10.000 Seiten). Darüber hinaus gibt es ein tägliches Crawl-Kontingent, das die indexierten Seiten über *alle* Ihre Websites an einem Tag begrenzt (Starter 150, Pro 12.500, Business 50.000 Seiten) und um 00:00 UTC zurückgesetzt wird. Wenn ein Crawl abgelehnt wird, weil das tägliche Kontingent aufgebraucht ist, informiert Sie der Wissens-Tab darüber und Sie können ihn nach dem Zurücksetzen erneut ausführen.
Der Crawl ist in der Regel in wenigen Minuten für typische Marketing-Websites abgeschlossen; sehr große Websites werden im Hintergrund verarbeitet und Ihr Support-Agent verbessert sich, während Seiten hinzugefügt werden.
Seiten ausschließen
Sie können Pfade ausschließen, von denen der Agent niemals lernen soll - Karriereseiten, Rechtsarchive, interne Tools.
- Fügen Sie Pfadmuster wie
/blog/archive/*in den Wissenseinstellungen des Projekts hinzu - Ausgeschlossene Seiten werden beim nächsten Crawling aus dem Index entfernt
robots.txt-Disallow-Regeln werden immer respektiert
Antworten aktuell halten
Sie können jederzeit einen manuellen Re-Crawl über den Wissens-Tab auslösen - nützlich direkt nachdem Sie neue Dokumente veröffentlicht oder Preise geändert haben. Ein Re-Crawl ist 14 Tage nach Abschluss des letzten wieder verfügbar.
Sie können auch geplante Re-Crawls pro Website aktivieren und das Intervall selbst wählen - alle 14, 30 oder 90 Tage. Diese Optionen stehen in jedem Plan zur Verfügung.
Tipps
- Lösen Sie nach größeren Website-Updates ein manuelles erneutes Crawling aus, damit der Agent niemals veraltete Inhalte zitiert.
Wichtig
- Wenn Sie eine Seite von Ihrer Website entfernen, verschwindet sie nicht sofort aus dem Index - sie wird beim nächsten Crawling entfernt, oder Sie löschen die Quelle manuell.