Esegui la scansione dei contenuti del sito web, testa i risultati e aggiungi le pagine indicizzate a una raccolta.
Knowledge Base Indexer è un'applicazione desktop per eseguire la scansione dei contenuti del sito web.Usalo con Knowledge Base in Acrobat per ispezionare i contenuti scoperti durante una scansione o caricare le pagine indicizzate in una raccolta.
Scegli una modalità operativa
L'Indexer offre due modalità operative:
| Modalità | Usalo per |
|---|---|
| Modalità Discovery | Esegui la scansione ed elabora i contenuti del sito web senza caricarli in una raccolta. |
| Modalità di caricamento | Esegui la scansione dei contenuti del sito web e carica le pagine indicizzate in una raccolta su cui hai accesso in scrittura. |
La Modalità Discovery è selezionata per impostazione predefinita.
Deseleziona Modalità Discovery quando sei pronto per autenticarti a knowledge base, selezionare una raccolta di destinazione e caricare i contenuti.
Comprendi i controlli principali
L'applicazione include controlli per configurare ed eseguire una scansione:
| Controllo | Scopo |
|---|---|
| URL di destinazione | Definisce il punto di inizio della scansione. |
| Profondità di scansione | Controlla quanti livelli di collegamenti segue l'Indexer. |
| Limite di pagine | Limita il numero massimo di pagine elaborate. |
| Numero di secondari | Controlla quanti crawler elaborano le pagine in parallelo. |
| URL di autenticazione | Fornisce un URL opzionale per accedere ai contenuti protetti del sito web. |
| Modalità di individuazione | Passa dalla modalità di individuazione alla modalità di caricamento. |
| selettore della raccolta | Identifica la raccolta che riceve il contenuto indicizzato in modalità caricamento. |
| Registri | Visualizza l'avanzamento, le pagine rilevate ed elaborate, le avvertenze, gli errori e lo stato del completamento. |
| Avvia e Arresta | Avvia o arresta la scansione. |
| Logout | Invalida il token di sessione corrente di Knowledge Base. |
Come funziona il flusso di lavoro di indicizzazione
Un tipico flusso di lavoro di indicizzazione include:
- Installa il pacchetto Knowledge Base Indexer che corrisponde al tuo computer.
- Inserisci uno o più URL di partenza HTTPS.
- Configura la profondità di scansione, il limite di pagina e il numero di processi secondari.
- Aggiungi un URL di autenticazione quando il sito web contiene contenuto protetto.
- Esegui la scansione in modalità rilevamento per ispezionarne l'ambito e identificare gli errori.
- Passa alla modalità di caricamento, autenticati e seleziona una raccolta modificabile.
- Esegui la scansione e monitora i log finché l'elaborazione non è completata.
Best practice
- Inizia con una profondità di scansione superficiale e un limite di pagina ridotto.
- Usa un URL di partenza per una sezione specifica del sito web anziché per un intero dominio.
- Testa una scansione in modalità rilevamento prima di caricare il contenuto.
- Rivedi le avvertenze e gli errori nei log.
- Aumenta il numero di worker solo quando il computer ha risorse sufficienti.
- Evita scansioni eccessive dello stesso sito web in un breve periodo.
Aspetti da considerare
- Sono supportati solo URL HTTPS.
- Gli indirizzi di rete locali, gli indirizzi di loopback e alcuni indirizzi IP riservati sono bloccati.
- È necessario un account Knowledge Base per la modalità caricamento ma non per la modalità rilevamento.
- La modalità caricamento elenca solo le raccolte per le quali hai accesso in scrittura.
- Profondità di scansione maggiori possono includere più contenuto del previsto.
- Limiti di pagina elevati possono aumentare i tempi di elaborazione.
- Un numero maggiore di worker può migliorare la velocità ma utilizza più risorse di sistema.
- I token di autenticazione vengono gestiti in modo sicuro e non sono archiviati in modo permanente.