Åpne Knowledge Base Indexer.
Definer startpunktene, omfanget og behandlingsgrensene for en nettstedsgennomgang.
Knowledge Base Indexer starter med én eller flere mål-URL-er og følger lenker i henhold til innstillingene du definerer.Konfigurer gjennomgangen først, og bruk deretter Discovery Mode til å teste den uten å laste opp innhold, eller Upload Mode til å legge til indeksert innhold i en Knowledge Base i Acrobat-samling.
Før du begynner
- Installer Knowledge Base Indexer.
- Kontroller at datamaskinen har en internettforbindelse.
- Identifiser én eller flere HTTPS-URL-er som skal gjennomsøkes.
Konfigurer en nettstedsgjennomsøking
I Target URLs skriver du inn én eller flere start-URL-er.
Skriv inn hver URL på en egen linje.URL-er må begynne med https://.
Angi Crawl Depth.
Gjennomsøkingsdybde bestemmer hvor mange nivåer av lenker Indexer følger fra start-URL-ene.
- En verdi på 1 behandler sider som er lenket direkte fra start-URL-ene.
- Høyere verdier følger ytterligere nivåer av lenker.
Angi Page Limit.
Sidegrense begrenser det maksimale antallet sider som behandles under gjennomsøkingen.
- Standard: 5
- Maksimum: 5 000
Angi Number of Workers.
Sekundære kontrollerer hvor mange gjennomgående behandler sider parallelt.
- Standard: 4
- Anbefalt for de fleste systemer: 4–8, avhengig av antall prosessorkjerner.
Skriv inn en Authentication URL når Indexer må autentisere før gjennomsøking av beskyttet innhold.
Offentlige nettsteder krever ikke denne verdien.
Slik fungerer gjennomsøkingsinnstillingene
Mål-URL-er |
Definerer hvor gjennomsøkingen begynner. |
Skriv inn én HTTPS-nettadresse per linje. |
Søkedybde |
Bestemmer hvor mange nivåer med lenker indeksereren følger. |
En verdi på 1 følger lenker direkte fra startnettadressene. |
Sidegrense |
Begrenser maksimalt antall sider som behandles. |
Standard: 5; maksimum: 5 000. |
Antall sekundære |
Kontrollerer hvor mange crawlere som behandler sider parallelt. |
Standard: 4; anbefalt: 4–8 for de fleste systemer. |
Autentiseringsnettadresse |
Gir en nettadresse indeksereren kan bruke til å autentisere før den søker i beskyttet innhold. |
Valgfritt for offentlige nettsteder. |
Mønsterpraksis
- Begynn med en grunn søkedybde og en liten sidegrense.
- Rett deg mot en spesifikk nettstedsseksjon i stedet for et helt domene.
- Øk antallet arbeidsprosesser bare når datamaskinen har tilstrekkelige ressurser.
- Test det konfigurerte crawlet i Discovery-modus før du laster opp innhold.
Ting du bør vite
- Bare HTTPS-nettadresser støttes.
- Lokale nettverksadresser blokkeres som et sikkerhetstiltak.
- Loopback-adresser og visse begrensede IP-adresser avvises også.
- Ugyldige nettadresser genererer feil i loggene når søket kjører.
- Høyere søkedybder kan inkludere flere sider enn tiltenkt.
- Store sidegrenser kan øke behandlingstiden.
- Høyere antall arbeidsprosesser kan forbedre hastigheten, men bruker mer systemressurser.
- Konfigurering av gjennomsøket starter ikke behandling eller opplasting av innhold.
Neste trinn
- For å teste det konfigurerte gjennomsøket uten å laste opp innhold, se [Oppdag nettstedinnhold].
- For å kjøre gjennomsøket og laste opp indeksert innhold, se [Last opp nettstedinnhold til en samling].