Crawla webbplatsinnehåll, testa resultaten och lägg till indexerade sidor i en samling.
Knowledge Base Indexer är ett datorprogram för att crawla webbplatsinnehåll. Använd det med Knowledge Base i Acrobat för att granska innehållet som upptäckts under en crawlning eller ladda upp indexerade sidor till en samling.
Välj ett operationsläge
Indexern erbjuder två operationslägen:
| Läge | Använd det för att |
|---|---|
| Identifieringsläge | Crawla och bearbeta webbplatsinnehåll utan att ladda upp det till en samling. |
| Uppladdningsläge | Crawla webbplatsinnehåll och ladda upp de indexerade sidorna till en samling där du har skrivåtkomst. |
Discovery Mode är valt som standard.
Avmarkera Discovery Mode när du är redo att autentisera dig mot Knowledge Base, välja en målsamling och ladda upp innehåll.
Förstå huvudkontrollerna
Programmet innehåller kontroller för att konfigurera och köra en crawlning:
| Kontroll | Syfte |
|---|---|
| Mål-URL:er | Definierar var crawlningen börjar. |
| Crawldjup | Kontrollerar hur många Nivåer av länkar som indexern följer. |
| Sidgräns | Begränsar det maximala antalet sidor som bearbetas. |
| Antal sekundära | Kontrollerar hur många crawlers som bearbetar sidor parallellt. |
| Autentiserings-URL | Tillhandahåller en valfri URL för åtkomst till skyddat webbplatsinnehåll. |
| Discovery Mode | Växlar mellan Discovery Mode och Upload Mode. |
| Samlingsväljare | Identifierar den samling som tar emot indexerat innehåll i uppladdningsläge. |
| Loggar | Visar framsteg, upptäckta och bearbetade sidor, varningar, fel och slutförandestatus. |
| Start och Stopp | Startar eller stoppar crawlningen. |
| Utloggning | Ogiltigförklarar den aktuella Knowledge Base-sessionens token. |
Så fungerar indexeringsarbetsflödet
Ett typiskt indexeringsarbetsflöde inkluderar:
- Installera Knowledge Base Indexer-paketet som matchar din dator.
- Ange en eller flera HTTPS-start-URL:er.
- Konfigurera crawldjup, sidgräns och antal sekundära.
- Lägg till en autentiserings-URL när webbsidan innehåller skyddat Innehåll.
- Kör crawlningen i upptäckarläge för att granska dess omfattning och identifiera fel.
- Växla till uppladdningsläge, autentisera och välj en skrivbar samling.
- Kör crawlningen och övervaka loggarna tills bearbetningen är klar.
Bästa praxis
- Börja med ett grunt crawldjup och en liten sidgräns.
- Använd en start-URL för en specifik webbsidasektion istället för en hel domän.
- Testa en crawlning i upptäckarläge innan du laddar upp Innehåll.
- Granska varningar och fel i loggarna.
- Öka antalet arbetare endast när datorn har tillräckliga resurser.
- Undvik alltför frekvent genomsökning av samma webbsida inom en kort period.
Bra att veta
- Endast HTTPS-URL:er stöds.
- Lokala nätverksadresser, loopback-adresser och vissa begränsade IP-adresser blockeras.
- Ett Knowledge Base-konto krävs för uppladdningsläge men inte för upptäckarläge.
- Uppladdningsläge listar endast samlingar där du har skrivåtkomst.
- Högre crawldjup kan omfatta mer innehåll än avsett.
- Stora sidgränser kan öka bearbetningstiden.
- Högre antal sekundära kan förbättra hastigheten men använder mer systemresurser.
- Autentiseringstoken hanteras säkert och lagras inte permanent.