Confronta PDF

I PDF vengono letti solo in questo browser. Nel percorso a più passaggi scadono dopo 30 minuti e vengono rimossi mentre la pagina è aperta o alla successiva apertura dello strumento. Non compaiono nell’indirizzo e non vengono inviati al nostro server.

Confronta il testo estraibile di due versioni di un PDF senza caricare i documenti. Lo strumento legge ogni pagina con PDF.js, normalizza gli spazi ed evidenzia il testo presente solo nel file precedente o in quello revisionato.

Come confrontare due PDF

  1. 1

    Scegli il file precedente

    Seleziona il PDF A, fino a 25 MB e 200 pagine.

  2. 2

    Scegli la revisione

    Seleziona il PDF B. Nel percorso a più passaggi entrambi i file restano nello spazio privato del browser per non più di 30 minuti.

  3. 3

    Controlla le pagine modificate

    Il browser estrae il testo pagina per pagina e segna in rosso i passaggi rimossi e in blu quelli aggiunti.

Cosa rileva il confronto

Il risultato confronta il testo che PDF.js riesce a estrarre dagli stessi numeri di pagina. È utile per contratti, relazioni, bozze di stampa e manoscritti con modifiche al contenuto. Gli spazi vengono normalizzati prima del confronto, così i soli ritorni a capo producono meno rumore.

Cosa non rileva

Non è un confronto visivo o semantico. Non confronta caratteri tipografici, impaginazione, immagini, annotazioni, valori dei moduli, metadati o validità delle firme digitali. Un PDF acquisito da scanner può non avere testo estraibile se non include già un livello OCR. Se una versione contiene una nuova copertina, le pagine successive risultano disallineate.

Privacy e limiti

I file e il testo estratto restano nel browser e non vengono inviati al nostro server. Nel percorso a più passaggi il browser conserva localmente i due file per un massimo di 30 minuti. Puoi eliminarli prima usando il comando di pulizia. Ogni file è limitato a 25 MB, 200 pagine e 2.000.000 di caratteri estratti.

Domande frequenti

Solo se il documento contiene già un livello di testo OCR. Questo strumento non esegue OCR.

No. Significa solo che il testo estraibile coincide dopo la normalizzazione degli spazi. Gli elementi visivi e la struttura PDF possono comunque essere diversi.

No. PDF.js li legge localmente. Il percorso a più passaggi usa lo spazio privato del browser per un massimo di 30 minuti, non lo spazio del server.

Il PDF memorizza istruzioni di disegno posizionate, non paragrafi. Colonne, tabelle e moduli complessi possono quindi essere estratti in un ordine inatteso.

Strumenti correlati