Panoramica dell'indicizzatore web

Ultimo aggiornamento il 29 set 2026

Esegui la scansione dei contenuti del sito web, testa i risultati e aggiungi le pagine indicizzate a una raccolta.

Knowledge Base Indexer è un'applicazione desktop per eseguire la scansione dei contenuti del sito web.Usalo con Knowledge Base in Acrobat per ispezionare i contenuti scoperti durante una scansione o caricare le pagine indicizzate in una raccolta.

Scegli una modalità operativa

L'Indexer offre due modalità operative:

Modalità Usalo per
Modalità Discovery Esegui la scansione ed elabora i contenuti del sito web senza caricarli in una raccolta.
Modalità di caricamento Esegui la scansione dei contenuti del sito web e carica le pagine indicizzate in una raccolta su cui hai accesso in scrittura.

La Modalità Discovery è selezionata per impostazione predefinita.

Deseleziona Modalità Discovery quando sei pronto per autenticarti a knowledge base, selezionare una raccolta di destinazione e caricare i contenuti.

Comprendi i controlli principali

L'applicazione include controlli per configurare ed eseguire una scansione:

Controllo Scopo
URL di destinazione Definisce il punto di inizio della scansione.
Profondità di scansione Controlla quanti livelli di collegamenti segue l'Indexer.
Limite di pagine Limita il numero massimo di pagine elaborate.
Numero di secondari Controlla quanti crawler elaborano le pagine in parallelo.
URL di autenticazione Fornisce un URL opzionale per accedere ai contenuti protetti del sito web.
Modalità di individuazione Passa dalla modalità di individuazione alla modalità di caricamento.
selettore della raccolta Identifica la raccolta che riceve il contenuto indicizzato in modalità caricamento.
Registri Visualizza l'avanzamento, le pagine rilevate ed elaborate, le avvertenze, gli errori e lo stato del completamento.
Avvia e Arresta Avvia o arresta la scansione.
Logout Invalida il token di sessione corrente di Knowledge Base.

Come funziona il flusso di lavoro di indicizzazione

Un tipico flusso di lavoro di indicizzazione include:

  1. Installa il pacchetto Knowledge Base Indexer che corrisponde al tuo computer.
  2. Inserisci uno o più URL di partenza HTTPS.
  3. Configura la profondità di scansione, il limite di pagina e il numero di processi secondari.
  4. Aggiungi un URL di autenticazione quando il sito web contiene contenuto protetto.
  5. Esegui la scansione in modalità rilevamento per ispezionarne l'ambito e identificare gli errori.
  6. Passa alla modalità di caricamento, autenticati e seleziona una raccolta modificabile.
  7. Esegui la scansione e monitora i log finché l'elaborazione non è completata.

Best practice

  • Inizia con una profondità di scansione superficiale e un limite di pagina ridotto.
  • Usa un URL di partenza per una sezione specifica del sito web anziché per un intero dominio.
  • Testa una scansione in modalità rilevamento prima di caricare il contenuto.
  • Rivedi le avvertenze e gli errori nei log.
  • Aumenta il numero di worker solo quando il computer ha risorse sufficienti.
  • Evita scansioni eccessive dello stesso sito web in un breve periodo.

Aspetti da considerare

  • Sono supportati solo URL HTTPS.
  • Gli indirizzi di rete locali, gli indirizzi di loopback e alcuni indirizzi IP riservati sono bloccati.
  • È necessario un account Knowledge Base per la modalità caricamento ma non per la modalità rilevamento.
  • La modalità caricamento elenca solo le raccolte per le quali hai accesso in scrittura.
  • Profondità di scansione maggiori possono includere più contenuto del previsto.
  • Limiti di pagina elevati possono aumentare i tempi di elaborazione.
  • Un numero maggiore di worker può migliorare la velocità ma utilizza più risorse di sistema.
  • I token di autenticazione vengono gestiti in modo sicuro e non sono archiviati in modo permanente.