Træn på dit website
Gennemsøgning, sidegrænser og at holde svarene friske
Sådan fungerer gennemsøgning
Chatixy starter ved den URL, du angiver, og følger interne links op til din plans sideloft, hvor den indekserer den synlige tekst på hver side. Sider bag logins, betalingsmure eller robots.txt-blokeringer springes over.
Der gælder to begrænsninger. Sideloftet pr. site sætter en grænse for en enkelt crawl (Starter 150, Pro 2.500, Business 10.000 sider). Derudover er der en daglig crawl-kvote, der begrænser antallet af sider indekseret på *alle* dine websites på en dag (Starter 150, Pro 12.500, Business 50.000 sider) og nulstilles kl. 00:00 UTC. Hvis en crawl afvises, fordi den daglige kvote er opbrugt, vil vidensfanen informere dig, og du kan køre den igen efter nulstillingen.
Crawlen afsluttes normalt på få minutter for typiske marketingsites; meget store sites behandles i baggrunden, og din supportagent forbedres, efterhånden som sider tilføjes.
Udelukkelse af sider
Du kan udelukke stier, som du aldrig vil have supportagenten til at lære fra - jobsider, juridiske arkiver, interne værktøjer.
- Tilføj stimønstre som
/blog/archive/*i projektets vidensindstillinger - Udelukkede sider fjernes fra indekset ved næste gennemsøgning
- disallow-regler i
robots.txtrespekteres altid
At holde svarene friske
Du kan til enhver tid udløse en manuel gen-crawl fra vidensfanen - nyttigt lige efter, du har offentliggjort nye dokumenter eller ændret priser. En gen-crawl er tilgængelig igen 14 dage efter, den sidste blev afsluttet.
Du kan også aktivere planlagte gen-crawls pr. website og selv vælge frekvensen - hver 14., 30. eller 90. dag. De samme muligheder er tilgængelige på alle planer.
Tips
- Sæt en manuel gennemsøgning i gang efter store opdateringer af dit website, så supportagenten aldrig gengiver forældet indhold.
Vigtigt
- Når du fjerner en side fra dit website, forsvinder den ikke med det samme fra indekset - den forsvinder ved næste gennemsøgning, eller du kan slette kilden manuelt.