OCR PDF
Aggiungi un livello di testo invisibile a un PDF scansionato per poterci cercare e copiarne il testo, senza cambiare l’aspetto di nessuna pagina.
oppure trascinalo qui · fino a 50 MB, gratis
File più grandi? Con Pro converti file fino a 500 MBOltre i limiti gratuiti: potrai sbloccare il download da 1,99 €.
Elaborazione in corso…
Il tuo file è pronto
Gratis · Senza registrazione · Senza filigrana · I tuoi file non lasciano mai il dispositivo
OCR PDF in 3 passaggi
- Seleziona il PDF scansionato o trascinalo nel riquadro.
- Scegli la lingua del testo (e una seconda se il documento ne mescola due), poi clicca su Avvia OCR.
- Scarica il PDF ricercabile, oppure tutto il testo riconosciuto in un file TXT.
Come l’OCR trasforma una scansione in un PDF ricercabile
Una pagina scansionata è solo una foto del foglio: non puoi cercarci dentro, selezionare una frase o copiare un importo. L’OCR (riconoscimento ottico dei caratteri) legge le lettere in quell’immagine e le aggiunge alla pagina come livello di testo invisibile, posizionato esattamente sopra ogni parola. La pagina resta identica, ma ora Ctrl+F trova le parole, puoi evidenziare e copiare il testo in Acrobat, Anteprima, Chrome o Edge, e Windows, macOS, Google Drive o il tuo archivio documentale possono indicizzare il file.
Il testo viene riconosciuto sul tuo dispositivo da Tesseract, un motore OCR open source. Ogni pagina viene letta fino a 300 DPI; le pagine che contengono già testo restano come sono e quelle scansionate di lato o capovolte vengono girate nel verso giusto. Funziona meglio con testo stampato e nitido, come lettere, fatture, contratti, libri e moduli. Scrittura a mano, caratteri molto piccoli, pagine sbiadite e foto scattate di sbieco danno più errori, e le tabelle escono come testo, non come celle. La prima volta che usi una lingua, il suo modello di lettura (da 1 a 3 MB) viene scaricato da questo sito e conservato nel browser.
Domande frequenti
Il mio PDF cambia aspetto dopo l’OCR?
No. Le pagine, le immagini e i disegni originali non vengono modificati né ricompressi. L’OCR aggiunge solo un livello di testo invisibile sopra ogni pagina, quindi il file ha lo stesso aspetto e cresce di pochi kilobyte per pagina. Le pagine scansionate di lato vengono raddrizzate per leggerle meglio.
Quali lingue sa leggere?
Ventiquattro: italiano, inglese, spagnolo, francese, tedesco, portoghese, olandese, polacco, turco, indonesiano, vietnamita, giapponese, cinese semplificato e tradizionale, coreano, russo, ucraino, arabo, hindi, catalano, ceco, greco, rumeno e svedese. Puoi sceglierne due insieme per documenti che mescolano lingue, come italiano e inglese.
Quanto è preciso il riconoscimento del testo?
Con una scansione pulita di testo stampato quasi ogni parola è corretta: nei nostri test su scansioni d’ufficio a 200 DPI è stato letto bene oltre il 98 per cento dei caratteri. Scrittura a mano, caratteri minuscoli o decorativi, scansioni sfocate e sfondi colorati abbassano la precisione, quindi controlla nomi e numeri importanti.
Quanto tempo ci vuole?
Pochi secondi per pagina su un computer recente e circa il doppio su uno smartphone, più un breve download del modello della lingua la prima volta. Una scansione di 20 pagine richiede di solito da uno a tre minuti. Tieni aperta la scheda mentre lavora; le pagine che hanno già testo vengono saltate.
Posso avere il testo in un file TXT?
Sì. Accanto al PDF ricercabile puoi scaricare tutto il testo riconosciuto in un file TXT, pagina per pagina, pronto da incollare in Word, Google Documenti o un’email. Per foto e screenshot usa il nostro strumento Immagine in testo, che funziona allo stesso modo.
Il mio PDF viene caricato su un server?
No. Le pagine le legge un motore OCR che funziona dentro il tuo browser, sul tuo dispositivo, quindi contratti, referti medici e documenti d’identità non ci vengono mai inviati né salvati da nessuna parte. Da questo sito si scaricano solo, una volta, il motore OCR e il modello della lingua, che restano nel browser.