Creatore di PDF ricercabili

Scegli un PDF scansionato

Solo PDF · 10 MB

Solo PDF, fino a 10 MB e 10 pagine

Un PDF scansionato in realtà è solo una pila di immagini dentro un contenitore PDF, quindi non puoi evidenziare, copiare o cercare il testo. Questo strumento applica il riconoscimento ottico dei caratteri (OCR) a ogni pagina nel tuo browser e incorpora il risultato come livello di testo invisibile allineato alla pagina originale. L’aspetto della pagina resta invariato, mentre Ctrl+F e la selezione del testo possono usare le parole riconosciute. Il riconoscimento può commettere errori e il risultato non è un PDF accessibile con tag, quindi confronta il testo importante con la scansione.

Come applicare l'OCR a un PDF scansionato

  1. 1

    Carica la scansione

    Trascina un PDF scansionato (contratti, fatture, report archiviati). Il testo stampato funziona meglio; la scrittura a mano no.

  2. 2

    Scegli la lingua

    Scegli la lingua del documento (inglese, spagnolo, francese, tedesco, italiano, portoghese o olandese) così il motore OCR carica il modello di caratteri giusto.

  3. 3

    Avvia il riconoscimento

    Ogni pagina viene renderizzata ad alta risoluzione nel tuo browser e passata al motore OCR. I documenti lunghi possono richiedere alcuni minuti.

  4. 4

    Livello di testo incorporato

    Le parole riconosciute vengono posizionate come livello invisibile allineato alla pagina originale, così ogni pagina resta invariata.

  5. 5

    Scarica il nuovo PDF

    Ottieni un PDF che conserva le scansioni originali ed è ora ricercabile in qualsiasi lettore moderno.

Quando l’OCR funziona bene (e quando no)

La qualità dell’OCR dipende dalla scansione. Confronta sempre nomi, cifre e formulazioni legali importanti con la pagina originale.

Input Cosa aspettarsi
Scansione pulita di testo stampato Spesso buoni risultati; rileggi i passaggi importanti.
Foto di una pagina stampata Il risultato dipende da messa a fuoco, illuminazione e angolazione della pagina.
Libro vecchio o stampa a macchina sbiadita Controlla con cura il testo riconosciuto.
Scrittura a mano o corsivo Non supportata in modo affidabile.
Scontrini o stampa termica Controlla con cura numeri e caratteri sbiaditi.
Forte trasparenza dal retro I risultati possono essere incompleti o imprecisi.

PDF ricercabile e PDF solo immagine

  • PDF solo immagine: bitmap puri, senza testo. Ciò che il tuo scanner produce per impostazione predefinita.
  • PDF ricercabile: bitmap più un livello di testo invisibile (ciò che genera questo strumento). Aspetto identico, Ctrl+F funziona.
  • PDF/A: un sottoinsieme di PDF per l’archiviazione che incorpora i propri font e vieta le risorse esterne, spesso richiesto da tribunali e archivi. Questo strumento produce un normale PDF ricercabile, non un PDF/A certificato; converti e verifica con uno strumento PDF/A dedicato se il tuo flusso lo richiede.

Consigli per risultati migliori

  • Inizia con circa 300 DPI. Spesso è un buon equilibrio tra dettagli leggibili e tempo di elaborazione. Una risoluzione più alta richiede più tempo e memoria.
  • Raddrizza prima dell’OCR. La maggior parte degli scanner offre la rotazione automatica; anche una lieve inclinazione può ridurre la qualità del riconoscimento.
  • Una lingua per esecuzione. Il motore riconosce una sola lingua alla volta, quindi scegli quella prevalente. Per un documento bilingue, eseguilo una volta per lingua e tieni il risultato migliore.
  • Conserva sempre l’originale. L’OCR introduce piccoli errori; il livello invisibile è una comodità, non una prova.

Domande frequenti

Il contenuto originale della pagina viene conservato. Il testo riconosciuto viene aggiunto come livello invisibile allineato a esso, quindi l’aspetto della pagina dovrebbe restare invariato. Controlla il risultato se la fedeltà visiva esatta è importante.

Sette lingue in alfabeto latino: inglese, spagnolo, francese, tedesco, italiano, portoghese e olandese. Scegli quella che corrisponde al tuo documento. Alfabeti come il cirillico, l’arabo e il CJK (cinese, giapponese, coreano) non sono disponibili in questo strumento.

Non in modo affidabile. Questo strumento è pensato per il testo stampato. Il riconoscimento della scrittura a mano è una tecnologia diversa, quindi controlla o trascrivi separatamente il materiale manoscritto.

No. Il risultato è un normale PDF ricercabile: le immagini originali delle pagine più un livello di testo OCR invisibile. Non è un file PDF/A certificato per l’archiviazione. Se il tuo flusso richiede il PDF/A, converti e verifica il risultato con uno strumento PDF/A dedicato.

L’OCR viene eseguito interamente nel tuo browser, quindi il PDF sorgente non viene inviato a un server per il riconoscimento. Un normale download locale resta sul tuo dispositivo. Solo se scegli Crea una pagina di download il PDF ricercabile finale viene caricato sul nostro server; il PDF sorgente resta locale e il risultato caricato viene conservato fino a 7 giorni.

Strumenti correlati