Termine del glossario
PDF ricercabile
Un PDF ricercabile contiene testo che il software può trovare, selezionare, copiare o indicizzare, di solito grazie a un livello leggibile dalla macchina aggiunto all'immagine visibile della pagina.
PDF ricercabile e PDF di sole immagini
Due PDF possono apparire identici e comportarsi in modo molto diverso. Nel primo il software accede al testo: la ricerca funziona, le parole si possono selezionare e copiare e il contenuto può essere indicizzato. Il secondo conserva l'aspetto della pagina, ma si comporta come un'immagine piatta. Ricerca, selezione, copia e gran parte delle funzioni di accessibilità non funzionano.
La distinzione conta perché molti documenti contengono soltanto immagini senza che chi li crea o riceve se ne accorga. Scansioni, pagine fotografate e alcune esportazioni di screenshot generano questo tipo di PDF, a meno che non venga aggiunto un livello di testo.
Dove si usano i PDF ricercabili
Servono quando bisogna trovare, citare o riutilizzare il testo di documenti acquisiti:
- Archivi e registri — permettono di recuperare documenti per parola chiave, non soltanto per nome o data del file.
- Ambito legale e conformità — tribunali ed enti regolatori richiedono spesso documenti ricercabili per analisi e revisione.
- Ricerca — consente di cercare in raccolte di articoli, report o documenti storici acquisiti.
- Accessibilità — i lettori di schermo dipendono dal livello di testo per leggere ad alta voce il contenuto.
- Esportazione di screenshot — produce PDF di schermate che possono essere cercate e citate in seguito.
Come un PDF diventa ricercabile
Esistono due percorsi. Se il documento nasce in digitale, per esempio da un programma di videoscrittura o un browser, il testo è di solito già incorporato e la ricerca funziona subito.
Se nasce da un'immagine, come scansione, fotografia o screenshot, serve l'OCR. Il riconoscimento individua le parole nell'immagine e inserisce dietro di essa un livello di testo. L'aspetto non cambia, ma il contenuto diventa leggibile dal software.
Per questo alcuni strumenti eseguono l'OCR durante l'esportazione degli screenshot e producono subito un PDF ricercabile.
Errori comuni
- Dare per scontato che ogni PDF sia ricercabile. Un documento può apparire leggibile pur contenendo soltanto immagini. Prova a selezionare o cercare il testo.
- Pensare che il testo riconosciuto sia sempre perfetto. Il livello dipende dall'OCR, che può sbagliare con immagini scadenti, font insoliti o layout complessi. La ricerca resta utile, ma la precisione influisce sui risultati di ricerca e copia.
- Considerare "PDF ricercabile" un formato. Non è un formato separato, ma una proprietà. Qualsiasi PDF può contenere testo oppure soltanto immagini.
- Archiviare senza verificare. Un documento acquisito e salvato come immagine può diventare difficile da trovare. Esegui l'OCR prima dell'archiviazione per mantenere reperibile il contenuto.
Domande frequenti
Tutti i PDF sono ricercabili?
No. Un PDF può essere perfettamente leggibile sullo schermo e contenere soltanto immagini; in quel caso non puoi cercare né selezionare il testo.
Un PDF ricercabile deve nascere da un documento digitale?
No. L'OCR può aggiungere testo riconosciuto anche a documenti acquisiti o basati su immagini.
Come verifico se un PDF è ricercabile?
Premi Cmd/Ctrl+F e cerca una parola visibile sulla pagina. Se non viene evidenziato nulla, probabilmente il PDF contiene soltanto immagini e richiede l'OCR.
Posso rendere ricercabile un PDF esistente?
Sì. Gli strumenti OCR possono aggiungere un livello di testo dopo la creazione, senza cambiare l'aspetto visivo del documento.
Rendere ricercabile un PDF ne cambia l'aspetto?
No. Il livello di testo viene inserito dietro l'immagine della pagina. Il documento appare identico, ma il software può trovare, selezionare e copiare le parole.