Een webcrawler instellen om externe inhoud te indexeren

Benodigde licentie

Abonnement Suite Growth of hoger, Guide Professional of hoger
Toegang Admin

De crawler indexeert elke site waar je hem op richt, en dat maakt hem het algemene antwoord voor inhoud zonder directe koppeling.

Er een instellen

  1. Open de zoekinstellingen in Knowledge.
  2. Voeg een webcrawler toe en geef hem het startadres.
  3. Voeg URL-filters toe om te bepalen wat hij meeneemt.
  4. Stel de taal van de inhoud in.
  5. Laat hem lopen en kijk daarna wat hij vond.

De filters zijn het hele werk

Zonder filters neemt een crawler alles mee wat hij kan bereiken: je marketingpagina's, je vacaturepagina, oude campagnesites. Dat komt dan allemaal in de zoekresultaten van het helpcenter.

Beperk hem tot het deel met documentatie, en controleer het resultaat in plaats van het aan te nemen.

Stel de taal in

Een crawler die Engelse inhoud als Nederlands indexeert, levert resultaten op die bij de verkeerde lezers verschijnen. Heeft een site meerdere talen, dan betekent dat meestal een crawler per taal met eigen filters.

Hij ziet alleen openbare pagina's

Alles achter een aanmelding is voor hem onzichtbaar. Dat is een beperking en een waarborg tegelijk: hij kan niet per ongeluk iets particuliers indexeren.

Kijk hem na als de site verandert

Een crawler hangt aan de structuur van de site die hij leest. Een herontwerp dat adressen wijzigt laat hem niets indexeren of de verkeerde pagina's indexeren, en niets waarschuwt je.

Zie ook

Was dit artikel nuttig?

0

Kom je er niet uit?

Ons supportteam kijkt met je mee.

Opmerkingen

0 opmerkingen

Artikel is gesloten voor opmerkingen.