OCR per PDF
Questa sessione OCR non è più disponibile
Scegli un PDF scansionato
Solo PDF · 20 MB · 40 pagine
oppure trascina qui un PDF
Usa questo strumento quando un PDF contiene immagini di pagine scansionate invece di testo selezionabile. Il browser riproduce le pagine, esegue il riconoscimento ottico dei caratteri (OCR) e mostra il testo semplice riconosciuto, che puoi controllare, copiare o salvare come file .txt. Il PDF originale rimane sul tuo dispositivo. Lo strumento non crea un PDF ricercabile e non conserva l’impaginazione; inoltre, il risultato dell’OCR può contenere errori.
Come estrarre il testo da un PDF scansionato
-
1
Scegli la lingua del documento
Seleziona la lingua principale del testo stampato. La scelta determina il modello OCR utilizzato dal browser.
-
2
Apri il PDF
Scegli un PDF di massimo 20 MB e 40 pagine. Il file originale rimane nel browser e non viene inviato al nostro server.
-
3
Attendi il riconoscimento
Il browser riproduce ogni pagina e la legge con il modello OCR scelto. Prima di iniziare potrebbe essere necessario scaricare i file del modello.
-
4
Controlla il risultato
Confronta nomi, numeri e passaggi importanti con le pagine originali. L’OCR è un aiuto, non una trascrizione affidabile per usi critici.
-
5
Copia o scarica il testo
La copia e il download locale del TXT mantengono il risultato nel browser. Solo la creazione facoltativa di una pagina di download carica il file di testo derivato su un link protetto.
Cosa produce questo strumento
Il risultato è testo semplice, preceduto da un indicatore per ogni pagina riconosciuta. Lo strumento non:
- aggiunge al PDF un livello di testo invisibile
- ricrea colonne, tabelle, moduli o la tipografia originale
- conserva la disposizione visiva della pagina
- traduce il documento
- verifica che il testo riconosciuto sia corretto
Se ti serve un PDF che mantenga le pagine scansionate e aggiunga testo ricercabile sullo sfondo, usa un’applicazione dedicata ai PDF ricercabili o un programma OCR desktop.
Documenti che funzionano meglio
L’OCR è pensato per il testo stampato. Una scansione dritta e nitida, con un contrasto leggibile, è più facile da riconoscere rispetto a una foto sfocata, un fax sbiadito o una pagina danneggiata. Caratteri decorativi, scrittura a mano, notazione matematica, colonne molto ravvicinate e tabelle complesse possono produrre testo impreciso o disordinato.
Lo strumento accetta PDF fino a 20 MB e 40 pagine. Il riconoscimento avviene una pagina alla volta e può richiedere molta memoria, soprattutto per pagine grandi o ad alta risoluzione. Se il browser esaurisce la memoria, dividi il PDF in file più piccoli ed elaborali separatamente.
Lingue OCR supportate
Puoi scegliere inglese, spagnolo, francese, tedesco, italiano, portoghese, olandese, russo, giapponese, cinese semplificato, coreano o arabo.
Scegli la lingua principale prima di aprire il file. Una pagina che mescola lingue o sistemi di scrittura potrebbe richiedere passaggi separati; il risultato può comunque confondere caratteri simili.
Controlla il testo riconosciuto
Confronta sempre il risultato con il PDF originale prima di usarlo. Presta particolare attenzione a:
- nomi, indirizzi e numeri di identificazione
- date, importi, separatori decimali e segni meno
- istruzioni legali, mediche, finanziarie o di sicurezza
- interruzioni di pagina e ordine di lettura nei documenti a più colonne
Non considerare il risultato dell’OCR una copia autorevole di un documento importante.
Gestione dei file e download
Il PDF originale viene letto localmente nel browser. Non viene inserito nell’URL del percorso né inviato al nostro server. Il browser può scaricare dal fornitore configurato le librerie per la visualizzazione dei PDF e l’OCR, oltre al modello linguistico scelto.
La copia mantiene il testo riconosciuto nel browser e lo scrive negli appunti. Scarica TXT localmente crea e salva il file .txt senza caricarlo. Solo scegliendo Crea una pagina di download il TXT derivato viene caricato per generare un link protetto, dove può essere conservato fino a 7 giorni. Il download locale rimane disponibile se il caricamento facoltativo non riesce.
Domande frequenti
No. Il PDF originale rimane nel browser mentre le pagine vengono riprodotte e riconosciute. Il browser può scaricare le librerie necessarie e il modello linguistico selezionato. Anche il download locale non carica il testo; solo la pagina di download facoltativa carica il TXT derivato.
No. Il risultato è testo semplice raggruppato per pagina. Lo strumento non modifica il PDF originale, non aggiunge un livello di testo invisibile e non ne conserva l’impaginazione.
Devi confrontarlo con le pagine originali. L’OCR può confondere caratteri, omettere testo e cambiare l’ordine di lettura. Controlla ogni dettaglio prima di usare il risultato per attività legali, mediche, finanziarie, di sicurezza o comunque critiche.
È progettato per il testo stampato. Scrittura a mano, equazioni e caratteri decorativi possono essere poco affidabili. Può riconoscere i caratteri di una tabella, ma nel testo semplice non conserva la struttura di righe e colonne.
Inglese, spagnolo, francese, tedesco, italiano, portoghese, olandese, russo, giapponese, cinese semplificato, coreano e arabo. Seleziona la lingua principale prima di aprire il PDF.
Il PDF può avere una dimensione massima di 20 MB e contenere fino a 40 pagine. Pagine grandi o molto dettagliate possono comunque superare la memoria disponibile nel browser; in tal caso, dividi il documento in file più piccoli.
Scarica TXT localmente crea il file .txt e lo salva direttamente sul dispositivo senza caricarlo. Se crei una pagina di download, viene caricato solo quel TXT derivato su un link protetto, dove può essere conservato fino a 7 giorni.
Strumenti correlati
Dividere PDF
Dividi un PDF in un file per pagina o in intervalli personalizzati come 1-3, 4-6, 8. Elabora nel browser e scarica un ZIP.
Convertitore da PDF a JPG
Converti le pagine PDF in immagini JPG con la risoluzione e la qualità che ti servono. Scarica una pagina o tutte le immagini in un file ZIP.
Convertitore da PDF a Word
Converti PDF in documenti Word completamente modificabili. Mantiene titoli, elenchi, immagini e tabelle. I PDF scansionati vengono elaborati automaticamente con OCR.
Unisci PDF e immagini
Combina PDF e immagini JPG o PNG in un solo PDF, riordina i file caricati e scarica il documento dal browser.
Convertitore da JPG a PDF
Unisci immagini JPG in un unico PDF con controlli per formato pagina, orientamento e margini, ideale per contratti, ricevute e portfolio.
Comprimi PDF
Comprimi file PDF nel browser ricreando le pagine come PDF più leggeri basati su JPEG.