Convertitore da PDF a testo
Il modo più rapido per tirare fuori le parole da un PDF. Questo strumento legge il livello di testo già presente nel PDF, pagina per pagina, e ti restituisce testo semplice che puoi copiare o salvare come file .txt. Tutto avviene nel tuo browser, quindi il documento non viene mai caricato online. Una cosa da sapere subito: legge il testo che è già nel file, perciò un documento scansionato o fotografato (un’immagine senza livello di testo) risulterà vuoto. In quei casi, usa invece uno strumento OCR.
Come estrarre il testo da un PDF
-
1
Carica il PDF
Trascinalo o clicca per selezionarlo. Il file resta sul tuo dispositivo e non viene mai inviato a un server.
-
2
Estrai il testo
Lo strumento legge il livello di testo di ogni pagina e le unisce, con un contrassegno prima di ogni pagina.
-
3
Controlla il risultato
Il testo estratto compare in un riquadro, una pagina dopo l'altra, pronto da rivedere.
-
4
Copia o scarica
Copialo negli appunti o salvalo come file .txt per riutilizzarlo altrove.
Cosa legge questo strumento e cosa non può leggere
| Tipo di PDF | Risultato |
|---|---|
| Esportato da Word, Google Docs, un browser o uno strumento di design | Testo completo, pulito e integrale |
| Un PDF digitale con un vero livello di testo | Testo estratto pagina per pagina |
| Una scansione o foto salvata come PDF (solo immagine) | Vuoto o quasi: non c’è testo da leggere |
| Un PDF protetto da password | Illeggibile finché non lo sblocchi prima |
Niente OCR qui: lo strumento giusto per le scansioni
Questo estrattore non esegue l’OCR (riconoscimento ottico dei caratteri). Copia il testo già presente all’interno del PDF, non legge i pixel. Se il tuo file è una scansione e non ottieni nulla, passalo prima in uno strumento OCR, che trasforma l’immagine in un vero livello di testo che potrai poi estrarre.
Come è disposto il testo
Ogni pagina è separata da un contrassegno --- Page N ---, così vedi dove finisce una pagina e inizia la successiva. Il testo viene estratto nell’ordine in cui è memorizzato nel PDF. La maggior parte dei documenti si legge in modo naturale; alcuni con layout a più colonne insoliti possono intrecciare le colonne, perché lo strumento segue l’ordine memorizzato nel PDF invece di indovinare un percorso di lettura.
Usi comuni
- Alimentare un modello di IA. I modelli linguistici accettano testo semplice, non PDF. Estrarlo prima rende tutto più veloce e prevedibile.
- Citare e cercare. Copia un passaggio senza combattere con la selezione del visualizzatore PDF.
- Riutilizzare contenuti. Sposta il testo in un documento, un'e-mail o una nota senza riscriverlo.
Domande frequenti
No. Legge il livello di testo incorporato, e una scansione è solo un’immagine senza livello di testo, quindi risulta vuota. Usa uno strumento OCR per i documenti scansionati o fotografati, poi estrai il testo.
No. L’estrazione avviene interamente nel tuo browser, sul tuo dispositivo. Il PDF non viene mai inviato a un server e non viene salvato nulla.
Alcuni PDF, soprattutto quelli a più colonne, memorizzano il testo in un ordine diverso da quello in cui lo leggi. Lo strumento segue l’ordine memorizzato nel PDF, perciò le colonne possono intrecciarsi. I documenti esportati dai word processor risultano quasi sempre corretti.
Non finché sono bloccati. Rimuovi prima la password con uno strumento di sblocco PDF, poi estrai il testo.
Strumenti correlati
Riordina pagine PDF
Riordina, ometti o ripeti pagine con una sequenza esatta separata da virgole. Elaborazione nel browser fino a 20 MiB e 200 pagine.
Scansiona PDF
Trasforma foto di documenti JPEG, PNG o WebP in un PDF locale. Aggiungi fino a 25 immagini, scegli A4 verticale o Letter USA e non caricare file.
Oscurare un PDF
Copri le aree sensibili e crea nel browser un PDF appiattito nuovo. Ogni pagina di output è un’immagine JPEG, quindi testo, link, moduli, livelli e metadati del documento di origine non vengono trasferiti.
Creatore di PDF ricercabili
Trasforma un PDF scansionato in un documento ricercabile e selezionabile aggiungendo un livello di testo OCR invisibile. Tutto nel browser; 7 lingue in alfabeto latino.
OCR per PDF
Estrai testo semplice da scansioni di documenti stampati in PDF con l’OCR nel browser. Supporta 12 lingue, file fino a 20 MB e 40 pagine.
Estrai immagini da PDF
Estrai ogni immagine incorporata in un file PDF e scaricale singolarmente o come un unico ZIP, preservando la loro risoluzione originale.
Strumento disponibile in altre lingue
- Konverter PDF ke Teks [ID]
- Conversor de PDF para texto [PT]
- PDF-zu-Text-Konverter [DE]
- PDF テキスト変換ツール [JA]
- PDF 텍스트 변환기 [KO]
- ตัวแปลง PDF เป็นข้อความ [TH]
- محوّل PDF إلى نص [AR]
- Konwerter PDF na tekst [PL]
- PDF till text-konverterare [SV]
- Công cụ chuyển PDF sang văn bản [VI]
- Conversor de PDF a texto [ES]
- Convertisseur PDF en texte [FR]
- PDF-naar-tekst-converter [NL]
- PDF to Text Converter [EN]
- Конвертер PDF в текст [RU]
- PDF'den Metne Dönüştürücü [TR]
- PDF 转文本转换器 [ZH]