Creatore di PDF ricercabili
Questa sessione OCR non è più disponibile
Scegli un PDF scansionato
Solo PDF · 10 MB
Solo PDF, fino a 10 MB e 10 pagine
Un PDF scansionato in realtà è solo una pila di immagini dentro un contenitore PDF, quindi non puoi evidenziare, copiare o cercare il testo. Questo strumento applica il riconoscimento ottico dei caratteri (OCR) a ogni pagina nel tuo browser e incorpora il risultato come livello di testo invisibile allineato alla pagina originale. L’aspetto della pagina resta invariato, mentre Ctrl+F e la selezione del testo possono usare le parole riconosciute. Il riconoscimento può commettere errori e il risultato non è un PDF accessibile con tag, quindi confronta il testo importante con la scansione.
Come applicare l'OCR a un PDF scansionato
-
1
Carica la scansione
Trascina un PDF scansionato (contratti, fatture, report archiviati). Il testo stampato funziona meglio; la scrittura a mano no.
-
2
Scegli la lingua
Scegli la lingua del documento (inglese, spagnolo, francese, tedesco, italiano, portoghese o olandese) così il motore OCR carica il modello di caratteri giusto.
-
3
Avvia il riconoscimento
Ogni pagina viene renderizzata ad alta risoluzione nel tuo browser e passata al motore OCR. I documenti lunghi possono richiedere alcuni minuti.
-
4
Livello di testo incorporato
Le parole riconosciute vengono posizionate come livello invisibile allineato alla pagina originale, così ogni pagina resta invariata.
-
5
Scarica il nuovo PDF
Ottieni un PDF che conserva le scansioni originali ed è ora ricercabile in qualsiasi lettore moderno.
Quando l’OCR funziona bene (e quando no)
La qualità dell’OCR dipende dalla scansione. Confronta sempre nomi, cifre e formulazioni legali importanti con la pagina originale.
| Input | Cosa aspettarsi |
|---|---|
| Scansione pulita di testo stampato | Spesso buoni risultati; rileggi i passaggi importanti. |
| Foto di una pagina stampata | Il risultato dipende da messa a fuoco, illuminazione e angolazione della pagina. |
| Libro vecchio o stampa a macchina sbiadita | Controlla con cura il testo riconosciuto. |
| Scrittura a mano o corsivo | Non supportata in modo affidabile. |
| Scontrini o stampa termica | Controlla con cura numeri e caratteri sbiaditi. |
| Forte trasparenza dal retro | I risultati possono essere incompleti o imprecisi. |
PDF ricercabile e PDF solo immagine
- PDF solo immagine: bitmap puri, senza testo. Ciò che il tuo scanner produce per impostazione predefinita.
- PDF ricercabile: bitmap più un livello di testo invisibile (ciò che genera questo strumento). Aspetto identico, Ctrl+F funziona.
- PDF/A: un sottoinsieme di PDF per l’archiviazione che incorpora i propri font e vieta le risorse esterne, spesso richiesto da tribunali e archivi. Questo strumento produce un normale PDF ricercabile, non un PDF/A certificato; converti e verifica con uno strumento PDF/A dedicato se il tuo flusso lo richiede.
Consigli per risultati migliori
- Inizia con circa 300 DPI. Spesso è un buon equilibrio tra dettagli leggibili e tempo di elaborazione. Una risoluzione più alta richiede più tempo e memoria.
- Raddrizza prima dell’OCR. La maggior parte degli scanner offre la rotazione automatica; anche una lieve inclinazione può ridurre la qualità del riconoscimento.
- Una lingua per esecuzione. Il motore riconosce una sola lingua alla volta, quindi scegli quella prevalente. Per un documento bilingue, eseguilo una volta per lingua e tieni il risultato migliore.
- Conserva sempre l’originale. L’OCR introduce piccoli errori; il livello invisibile è una comodità, non una prova.
Domande frequenti
Il contenuto originale della pagina viene conservato. Il testo riconosciuto viene aggiunto come livello invisibile allineato a esso, quindi l’aspetto della pagina dovrebbe restare invariato. Controlla il risultato se la fedeltà visiva esatta è importante.
Sette lingue in alfabeto latino: inglese, spagnolo, francese, tedesco, italiano, portoghese e olandese. Scegli quella che corrisponde al tuo documento. Alfabeti come il cirillico, l’arabo e il CJK (cinese, giapponese, coreano) non sono disponibili in questo strumento.
Non in modo affidabile. Questo strumento è pensato per il testo stampato. Il riconoscimento della scrittura a mano è una tecnologia diversa, quindi controlla o trascrivi separatamente il materiale manoscritto.
No. Il risultato è un normale PDF ricercabile: le immagini originali delle pagine più un livello di testo OCR invisibile. Non è un file PDF/A certificato per l’archiviazione. Se il tuo flusso richiede il PDF/A, converti e verifica il risultato con uno strumento PDF/A dedicato.
L’OCR viene eseguito interamente nel tuo browser, quindi il PDF sorgente non viene inviato a un server per il riconoscimento. Un normale download locale resta sul tuo dispositivo. Solo se scegli Crea una pagina di download il PDF ricercabile finale viene caricato sul nostro server; il PDF sorgente resta locale e il risultato caricato viene conservato fino a 7 giorni.
Strumenti correlati
Dividere PDF
Dividi un PDF in un file per pagina o in intervalli personalizzati come 1-3, 4-6, 8. Elabora nel browser e scarica un ZIP.
Convertitore da PDF a JPG
Converti le pagine PDF in immagini JPG con la risoluzione e la qualità che ti servono. Scarica una pagina o tutte le immagini in un file ZIP.
Convertitore da PDF a Word
Converti PDF in documenti Word completamente modificabili. Mantiene titoli, elenchi, immagini e tabelle. I PDF scansionati vengono elaborati automaticamente con OCR.
Comprimi PDF
Comprimi file PDF nel browser ricreando le pagine come PDF più leggeri basati su JPEG.
Unisci PDF e immagini
Combina PDF e immagini JPG o PNG in un solo PDF, riordina i file caricati e scarica il documento dal browser.
Convertitore da JPG a PDF
Unisci immagini JPG in un unico PDF con controlli per formato pagina, orientamento e margini, ideale per contratti, ricevute e portfolio.