Een website doorzoeken

Laatst bijgewerkt op 29 sep. 2026

Definieer de startpunten, omvang en verwerkingslimieten voor het doorzoeken van een website.

De Knowledge Base Indexer begint met één of meer doel-URL's en volgt koppelingen volgens de instellingen die je definieert.Configureer eerst het doorzoeken en gebruik vervolgens Discovery Mode om het te testen zonder content te uploaden of Upload Mode om geïndexeerde content toe te voegen aan een Knowledge Base in Acrobat-verzameling.

Voordat u begint

  • Installeer de Knowledge Base Indexer.
  • Zorg ervoor dat de computer een internetverbinding heeft.
  • Geef één of meer HTTPS-URL's op om door te zoeken.

Een website-doorzoek configureren

Open de Knowledge Base Indexer.

Voer in Doel-URL's één of meer start-URL's in.

Voer elke URL in op een aparte regel. URL's moeten beginnen met https://.

Stel Diepte doorzoeken in.

Diepte doorzoeken bepaalt hoeveel Niveaus van koppelingen de Indexer volgt vanaf de start-URL's.

  • Een waarde van 1 verwerkt pagina's die direct zijn gekoppeld vanaf de start-URL's.
  • Hogere waarden volgen extra niveaus van koppelingen.

Stel Paginalimiet in.

De paginaslimiet beperkt het maximale aantal pagina's dat wordt verwerkt tijdens het doorzoeken.

  • Standaard: 5
  • Maximum: 5.000

Stel Aantal Secundaires in.

Workers regelen hoeveel crawlers pagina's parallel verwerken.

  • Standaard: 4
  • Aanbevolen voor de meeste systemen: 4–8, afhankelijk van het aantal processorkernen.

Voer een Authenticatie-URL in wanneer de Indexer moet authenticeren voordat beveiligde content wordt doorzocht.

Openbare websites vereisen deze waarde niet.

Hoe de doorzoek-Instellingen werken

Doel-URL's

Bepaalt waar het doorzoeken begint.

Voer één HTTPS-URL per regel in.

Doorzoekdiepte

Bepaalt hoeveel niveaus van koppelingen de Index volgt.

Een waarde van 1 volgt koppelingen direct vanaf de start-URL's.

Paginalimiet

Beperkt het maximum aantal pagina's dat wordt verwerkt.

Standaard: 5; maximum: 5.000.

Aantal Secundaire

Regelt hoeveel crawlers pagina's parallel verwerken.

Standaard: 4; aanbevolen: 4–8 voor de meeste systemen.

Authenticatie-URL

Biedt een URL die de indexer kan gebruiken voor authenticatie voordat beschermde content wordt doorzocht.

Optioneel voor openbare websites.

Best practices

  • Begin met een lage doorzoekdiepte en een kleine paginalimiet.
  • Richt je op een specifieke websitesectie in plaats van een heel domein.
  • Verhoog het aantal Secundaire alleen wanneer de computer voldoende bronnen heeft.
  • Test de geconfigureerde doorzoek in Ontdekkingsmodus voordat je content uploadt.

Handige weetjes

  • Alleen HTTPS-URL's worden ondersteund.
  • Lokale netwerkadressen zijn geblokkeerd als beveiligingsmaatregel.
  • Loopback-adressen en bepaalde beperkte IP-adressen worden ook afgewezen.
  • Ongeldige url's genereren fouten in de logboeken wanneer het doorzoeken wordt uitgevoerd.
  • Hogere doorzoekdieptes kunnen meer pagina's bevatten dan bedoeld.
  • Grote paginalimieten kunnen de verwerkingstijd verlengen.
  • Een hoger aantal workers kan de snelheid verbeteren, maar gebruikt meer systeembronnen.
  • Het configureren van het doorzoeken start niet het verwerken of uploaden van content.

Volgende stappen

  • Om het geconfigureerde doorzoeken te testen zonder content te uploaden, zie [websitecontent ontdekken].
  • Om het doorzoeken uit te voeren en geïndexeerde content te uploaden, zie [Upload website content to a collection].