Åbn Knowledge Base Indexer.
Definer startpunkterne, omfanget og behandlingsgrænserne for en gennemsøgning af et websted.
Knowledge Base Indexer starter med en eller flere mål-URL'er og følger links i henhold til de indstillinger, du definerer.Konfigurer crawlet først, og brug derefter Discovery Mode til at teste det uden at uploade Indhold eller Upload Mode til at tilføje indekseret Indhold til en Knowledge Base i Acrobat-samling.
Inden du går i gang
- Installer Knowledge Base Indexer.
- Sørg for, at computeren har en internetforbindelse.
- Identificer en eller flere HTTPS-URL'er, der skal crawles.
Konfigurer en gennemsøgning af et websted
I Target URLs skal du indtaste en eller flere start-URL'er.
Indtast hver URL på en separat linje.URL'er skal begynde med https://.
Indstil Crawl Depth.
Crawl-dybden bestemmer, hvor mange niveauer af links Indexeren følger fra start-URL'erne.
- En værdi på 1 behandler sider, der er linket direkte fra start-URL'erne.
- Højere værdier følger yderligere niveauer af links.
Indstil Page Limit.
Sidegrænsen begrænser det maksimale antal sider, der behandles under crawlet.
- Standard: 5
- Maksimum: 5.000
Indstil Number of Workers.
Sekundære kontrollerer, hvor mange crawlere der behandler sider parallelt.
- Standard: 4
- Anbefalet til de fleste systemer: 4–8, afhængigt af antallet af processorkerner.
Indtast en Authentication URL, når Indexeren skal autentificere, før den crawler beskyttet Indhold.
Offentlige websteder kræver ikke denne værdi.
Sådan fungerer crawl-indstillingerne
Mål-URL-adresser |
Definerer, hvor crawlingen begynder. |
Indtast én HTTPS-URL pr. linje. |
Crawl-dybde |
Bestemmer, hvor mange niveauer af links indekseren følger. |
En værdi på 1 følger links direkte fra start-URL'erne. |
Sidegrænse |
Begrænser det maksimale antal sider, der behandles. |
Standard: 5; maksimum: 5.000. |
Antal sekundære |
Styrer, hvor mange crawlere behandler sider parallelt. |
Standard: 4; anbefalet: 4–8 for de fleste systemer. |
Godkendelses-URL |
Leverer en URL, som indekseren kan bruge til at godkende, før der crawles beskyttet indhold. |
Valgfrit for offentlige websteder. |
Bedste praksisser
- Begynd med en lav crawl-dybde og en lille sidegrænse.
- Ret dig mod en specifik webstedssektion i stedet for et helt domæne.
- Forøg kun antallet af arbejdere, når computeren har tilstrækkelige ressourcer.
- Test den konfigurerede crawl i Discovery Mode, før du uploader indhold.
Ting, man bør vide
- Kun HTTPS-URL'er understøttes.
- Lokale netværksadresser blokeres som sikkerhedsforanstaltning.
- Loopback-adresser og visse begrænsede IP-adresser afvises også.
- Ugyldige URL'er genererer fejl i logfilerne, når crawlingen kører.
- Højere crawl-dybder kan inkludere flere sider end tilsigtet.
- Store sidegrænser kan øge behandlingstiden.
- Et højere antal arbejdere kan forbedre hastigheden, men bruger flere systemressourcer.
- Konfiguration af crawl starter ikke behandling eller uploader Indhold.
Næste trin
- For at teste det konfigurerede crawl uden at uploade indhold, se [Opdag webstedets indhold].
- For at køre crawl og uploade indekseret indhold, se [Upload webstedets indhold til en samling].