Guida
Shotomatic Team
6 min di lettura

Perché non riesco a selezionare il testo nel PDF del mio libro digitale?

Il PDF può contenere immagini di pagine, non avere un livello di testo, usare un OCR impreciso o limitare la copia. Individua il caso prima di scegliere la soluzione.

Studente prova la selezione del testo in un PDF di un libro salvato

Un PDF può sembrare un normale libro di testo e non contenere testo selezionabile. Potrebbe essere una raccolta di immagini, un PDF immagine con livello OCR, un file con codifica dei font insolita o un documento le cui autorizzazioni limitano la copia.

Risposta breve: prova ricerca e selezione e controlla i permessi del documento. Usa l'OCR soltanto per pagine che sei autorizzato a elaborare. Se la copia è limitata, chiedi un file approvato invece di aggirare la restrizione.

Individua il tipo di PDF

Risultato della provaTipo probabile
Le parole si selezionano e si copiano correttamentePDF con testo nativo
La ricerca funziona, ma la copia contiene erroriPDF immagine con OCR o codifica errata
L'intera pagina si seleziona come un solo oggettoPDF composto soltanto da immagini
La selezione è bloccata e i permessi sono limitatiPDF protetto
Alcune pagine funzionano e altre noDocumento misto

Prova più pagine. Copertine e appendici scansionate possono essere immagini in un PDF altrimenti basato sul testo.

Prova ricerca e selezione sul Mac

Apri il file in Anteprima o in un lettore PDF affidabile.

  1. In Anteprima, scegli Tools > Text Selection. Uno strumento rettangolo o di annotazione può far sembrare indisponibile il testo selezionabile.
  2. Premi Comando-F e cerca una parola particolare visibile nella pagina.
  3. Trascina il puntatore su una frase.
  4. Copiala in una nota temporanea di testo semplice.
  5. Confronta ogni carattere con la frase visibile.
  6. Ripeti su una pagina con tabella, nota ed equazione.
  7. Se la selezione è ancora disabilitata, scegli Tools > Show Inspector, apri Encryption Inspector e controlla se il PDF richiede una password o limita la copia.

Elimina il testo temporaneo quando contiene materiale concesso in licenza che non devi conservare.

La guida di Apple per la risoluzione dei problemi in Anteprima documenta sia Text Selection sia Encryption Inspector. Se il file è tuo e ti è stata fornita la password, inseriscila nella normale richiesta. Non tentare di rimuovere un permesso che non sei autorizzato a cambiare.

PDF composto soltanto da immagini

Un PDF di questo tipo è un contenitore di immagini delle pagine, comune nelle scansioni e nei documenti creati da screenshot. Può conservare bene il layout, ma il computer vede pixel anziché parole.

Se hai creato o possiedi la fonte, oppure hai il permesso di elaborarla, l'OCR può aggiungere un livello di testo invisibile. Diventano così possibili la ricerca e una copia approssimativa, mentre l'immagine resta visibile.

In una versione recente di Anteprima:

  1. Scegli File > Duplicate per mantenere intatto l'originale.
  2. Con il duplicato aperto, scegli File > Export.
  3. Seleziona Embed Text.
  4. Salva il nuovo PDF e riaprilo.
  5. Ripeti la prova di ricerca e copia.

La guida Embed Text di Apple indica che l'opzione compare soltanto quando Anteprima non ha già riconosciuto del testo. Se manca, il PDF potrebbe contenere un livello testuale: controlla OCR errato, codifica o permessi invece di applicarne un altro.

La guida al PDF da screenshot rispetto al PDF del browser spiega perché il testo nativo generato dal browser funziona in genere meglio dell'OCR.

Il testo OCR è presente ma impreciso

L'OCR interpreta la pagina visiva e tenta di riconoscere i caratteri. Gli errori comuni riguardano:

  • O e 0;
  • l, I e 1;
  • rn e m;
  • apici e pedici;
  • ordine di lettura su più colonne;
  • parole divise a fine riga;
  • legature e font decorativi;
  • equazioni e notazione chimica.

Usa l'OCR per ritrovare una pagina, non come fonte indiscussa per una citazione. Verifica citazioni, formule, nomi e numeri confrontandoli con l'immagine.

Testo nativo con codifica insolita

Alcuni PDF mostrano correttamente i caratteri tramite font incorporati, ma li copiano in ordine sbagliato o come simboli diversi. Anche la ricerca può funzionare in modo discontinuo.

Prova un altro lettore PDF conforme agli standard. Se il file ufficiale è difettoso, segnalalo al fornitore indicando pagina e un breve esempio non sensibile. L'editore può rigenerare il livello di testo con più precisione rispetto a una seconda elaborazione OCR.

La copia è limitata

Un PDF protetto può consentire la lettura e limitare copia, stampa o modifica. Non usare OCR, screenshot, rimozione della password o altri convertitori per aggirare la restrizione.

Piuttosto:

  • usa le funzioni per note o citazioni del lettore;
  • copia soltanto nei limiti ufficiali;
  • richiedi una copia accessibile o per la ricerca;
  • chiedi alla biblioteca un'alternativa senza DRM;
  • segnala all'editore un problema di accessibilità.

Quando chiedi assistenza, indica titolo esatto, ISBN, pagina, lettore e tecnologia assistiva.

I PDF misti vanno controllati pagina per pagina

Un libro può unire capitoli con testo nativo ad appendici scansionate o figure basate su immagini. Una ricerca riuscita non dimostra che ogni pagina sia ricercabile.

Prova:

  • pagine introduttive;
  • una normale pagina di testo;
  • una pagina ricca di figure;
  • l'indice analitico;
  • le appendici;
  • ogni sezione importante per il compito.

Se l'OCR è consentito, elaboralo soltanto sulle pagine che ne hanno bisogno e conserva il file originale come riferimento visivo.

Un output migliore per i salvataggi futuri

Usa un PDF o EPUB ufficiale quando disponibile. Per le pagine consentite, usa il comando di stampa ufficiale del lettore. Un PDF del browser può conservare testo nativo se la vista di stampa è completa.

Vuoi creare un PDF ricercabile da immagini di pagine consentite? Shotomatic mantiene in ordine la sequenza acquisita e aggiunge un livello OCR ricercabile quando esporta il PDF. Se hai già le immagini, uniscile gratuitamente in un PDF nel browser. La pagina visibile resta il riferimento, perché l'OCR può contenere errori.

Domande frequenti

Come capisco se un PDF contiene soltanto immagini?

Se l'intera pagina si comporta come un'immagine e la ricerca non trova parole visibili, probabilmente manca un livello di testo.

L'OCR sarà perfettamente preciso?

No. Controlla equazioni, tabelle, note, nomi e numeri confrontandoli con la pagina visibile.

Perché riesco a cercare ma non a copiare testo corretto?

Errori OCR, codifica dei font, ordine di lettura o permessi del documento possono causare questo risultato.

Posso rimuovere una limitazione alla copia?

Questa guida non spiega come aggirare le restrizioni. Chiedi un file autorizzato oppure usa gli strumenti consentiti dal lettore ufficiale.

Articoli correlati

Altri articoli

Stai lavorando con pagine che puoi salvare?

Shotomatic mantiene in ordine le acquisizioni consentite, ti permette di controllarle ed esporta un PDF ricercabile sul Mac. Non aggira i limiti del visualizzatore o di stampa.

Perché non riesco a selezionare il testo nel PDF del mio libro digitale? | Blog | Shotomatic