Convertitore da PDF a testo

Prossimo: revisione

Il modo più rapido per tirare fuori le parole da un PDF. Questo strumento legge il livello di testo già presente nel PDF, pagina per pagina, e ti restituisce testo semplice che puoi copiare o salvare come file .txt. Tutto avviene nel tuo browser, quindi il documento non viene mai caricato online. Una cosa da sapere subito: legge il testo che è già nel file, perciò un documento scansionato o fotografato (un’immagine senza livello di testo) risulterà vuoto. In quei casi, usa invece uno strumento OCR.

Come estrarre il testo da un PDF

  1. 1

    Carica il PDF

    Trascinalo o clicca per selezionarlo. Il file resta sul tuo dispositivo e non viene mai inviato a un server.

  2. 2

    Estrai il testo

    Lo strumento legge il livello di testo di ogni pagina e le unisce, con un contrassegno prima di ogni pagina.

  3. 3

    Controlla il risultato

    Il testo estratto compare in un riquadro, una pagina dopo l'altra, pronto da rivedere.

  4. 4

    Copia o scarica

    Copialo negli appunti o salvalo come file .txt per riutilizzarlo altrove.

Cosa legge questo strumento e cosa non può leggere

Tipo di PDF Risultato
Esportato da Word, Google Docs, un browser o uno strumento di design Testo completo, pulito e integrale
Un PDF digitale con un vero livello di testo Testo estratto pagina per pagina
Una scansione o foto salvata come PDF (solo immagine) Vuoto o quasi: non c’è testo da leggere
Un PDF protetto da password Illeggibile finché non lo sblocchi prima

Niente OCR qui: lo strumento giusto per le scansioni

Questo estrattore non esegue l’OCR (riconoscimento ottico dei caratteri). Copia il testo già presente all’interno del PDF, non legge i pixel. Se il tuo file è una scansione e non ottieni nulla, passalo prima in uno strumento OCR, che trasforma l’immagine in un vero livello di testo che potrai poi estrarre.

Come è disposto il testo

Ogni pagina è separata da un contrassegno --- Page N ---, così vedi dove finisce una pagina e inizia la successiva. Il testo viene estratto nell’ordine in cui è memorizzato nel PDF. La maggior parte dei documenti si legge in modo naturale; alcuni con layout a più colonne insoliti possono intrecciare le colonne, perché lo strumento segue l’ordine memorizzato nel PDF invece di indovinare un percorso di lettura.

Usi comuni

  • Alimentare un modello di IA. I modelli linguistici accettano testo semplice, non PDF. Estrarlo prima rende tutto più veloce e prevedibile.
  • Citare e cercare. Copia un passaggio senza combattere con la selezione del visualizzatore PDF.
  • Riutilizzare contenuti. Sposta il testo in un documento, un'e-mail o una nota senza riscriverlo.

Domande frequenti

No. Legge il livello di testo incorporato, e una scansione è solo un’immagine senza livello di testo, quindi risulta vuota. Usa uno strumento OCR per i documenti scansionati o fotografati, poi estrai il testo.

No. L’estrazione avviene interamente nel tuo browser, sul tuo dispositivo. Il PDF non viene mai inviato a un server e non viene salvato nulla.

Alcuni PDF, soprattutto quelli a più colonne, memorizzano il testo in un ordine diverso da quello in cui lo leggi. Lo strumento segue l’ordine memorizzato nel PDF, perciò le colonne possono intrecciarsi. I documenti esportati dai word processor risultano quasi sempre corretti.

Non finché sono bloccati. Rimuovi prima la password con uno strumento di sblocco PDF, poi estrai il testo.

Strumenti correlati

Strumento disponibile in altre lingue