Convertitore da PDF a Excel

PDF a Excel

Il PDF, le tabelle estratte e i download restano in questo browser.

Ripristino della sessione privata del browser...

Scegli un PDF

PDF testuale, fino a 20 MiB e 150 pagine. Le scansioni richiedono prima l'OCR.

Rilevamento delle tabelle nel PDF...

Non è stata trovata alcuna tabella di testo regolare. Le scansioni richiedono l'OCR e i layout irregolari possono necessitare di correzioni manuali.

Trasforma le tabelle regolari di un PDF testuale in file di foglio di calcolo senza caricare il documento. Il convertitore usa la posizione del testo PDF selezionabile per rilevare le tabelle rettangolari, mantiene separate le tabelle probabili e ti permette di controllarle e selezionarle prima dell’esportazione. Scarica una cartella di lavoro XLSX con un foglio per ogni tabella selezionata, oppure salva ogni tabella come CSV o TSV. Le scansioni richiedono prima l’OCR e i layout irregolari possono comunque necessitare di correzioni manuali.

Come convertire una tabella PDF in Excel

  1. 1

    Scegli un PDF testuale

    Seleziona un vero PDF con dimensioni massime di 20 MiB e 150 pagine. Il testo deve essere selezionabile; una scansione composta solo da immagini richiede prima l'OCR.

  2. 2

    Controlla le tabelle rilevate

    Il rilevatore locale cerca almeno due righe con posizioni di colonna stabili. Seleziona solo le tabelle la cui anteprima corrisponde al documento originale.

  3. 3

    Scegli le opzioni CSV

    Per CSV o TSV, scegli virgola, punto e virgola o tabulazione, decidi se includere un BOM UTF-8 e lascia attiva la protezione dalle formule, a meno che la fonte sia affidabile.

  4. 4

    Scarica localmente

    Scarica una cartella di lavoro XLSX con le tabelle selezionate, oppure scarica ogni tabella selezionata in un file CSV o TSV separato.

Cosa può recuperare il rilevatore e cosa no

Le pagine PDF memorizzano testo posizionato, non celle di un foglio di calcolo. Questo convertitore raggruppa in righe il testo vicino, cerca posizioni di colonna ricorrenti, completa le celle mancanti e scarta i blocchi che non sembrano una tabella regolare. Durante la lettura delle posizioni tiene conto anche della rotazione e dell’area visibile della pagina.

Contenuto del PDF Risultato probabile Cosa controllare
Tabella semplice con almeno due colonne allineate In genere viene rilevata come tabella rettangolare Confronta intestazioni, ordine delle righe e celle vuote con il PDF
Più tabelle separate su una o più pagine Restano tabelle separate e selezionabili Scegli solo le tabelle da includere nella cartella di lavoro
Tabella da destra a sinistra con colonne regolari Mantiene l’ordine visivo da destra a sinistra Controlla nell’anteprima i numeri e le celle con scritture miste
Paragrafi, titoli ed elementi ricorrenti della pagina Di solito vengono esclusi perché non formano una tabella Verifica che non sia stato incluso alcun blocco estraneo
Celle unite, tabelle annidate o record su più righe Possono essere divisi, spostati o scartati Correggi manualmente il foglio o usa un estrattore specializzato
Scansione composta solo da immagini, scrittura a mano o ricevuta fotografata Nessun testo di tabella selezionabile da rilevare Esegui prima l’OCR, poi prova con il PDF reso ricercabile

Il rilevatore è volutamente prudente. È meglio non segnalare alcuna tabella che trasformare testo estraneo in un foglio di calcolo convincente ma errato. Confronta sempre i valori importanti con il PDF originale prima di eseguire calcoli, importazioni o riconciliazioni.

Formati di esportazione

XLSX crea un foglio per ogni tabella selezionata, fino a 200 fogli in un singolo download. Ogni valore estratto viene scritto come cella di testo. Il convertitore non interpreta numeri, date, formule, valute o formati contabili e non ricrea bordi, caratteri, celle unite o il design originale della pagina.

CSV e TSV scaricano separatamente ogni tabella selezionata. Sono disponibili i delimitatori virgola, punto e virgola e tabulazione. I campi che contengono un delimitatore, virgolette o un’interruzione di riga vengono racchiusi tra virgolette doppie, mentre i record usano terminatori di riga CRLF secondo le regole comuni descritte nella RFC 4180. Un BOM UTF-8 è attivo per impostazione predefinita per migliorare la compatibilità con i programmi di foglio di calcolo, ma il delimitatore corretto dipende comunque dall’applicazione e dalle impostazioni internazionali usate per l’importazione.

Sicurezza rispetto alle formule del foglio di calcolo

Un PDF può contenere testo che inizia con =, +, - o @. Alcuni programmi di foglio di calcolo possono interpretare quel testo come una formula quando aprono un file CSV. La protezione dalle formule è attiva per impostazione predefinita e aggiunge un prefisso alle celle CSV che sembrano formule, così è più probabile che rimangano testo. Vengono considerate anche le celle con spazi iniziali e le varianti a larghezza intera di quei caratteri.

Questa misura riduce il rischio, ma non costituisce una garanzia di sicurezza universale. La guida OWASP all’iniezione CSV segnala che il comportamento cambia tra i diversi programmi e che l’escaping può cambiare dopo aver salvato e riaperto un CSV. Lascia attiva la protezione per i PDF non affidabili, controlla le celle esportate e non abilitare macro né ignorare gli avvisi di sicurezza del foglio di calcolo. L’output XLSX scrive i valori estratti come celle di testo esplicite, non come formule.

Limiti e archiviazione privata nel browser

  • Un PDF alla volta, con dimensioni massime di 20 MiB e 150 pagine.
  • I PDF con troppi frammenti di testo, una quantità eccessiva di testo o troppi dati tabellari vengono rifiutati prima di poter sovraccaricare il browser.
  • L’anteprima mostra le prime 100 righe di ogni tabella rilevata; l’esportazione include tutte le righe rilevate entro i limiti di sicurezza.
  • Una cartella di lavoro può contenere fino a 200 fogli selezionati.
  • I PDF protetti da password e quelli crittografati non sono supportati. Sblocca una copia che sei autorizzato a usare prima della conversione.
  • Durante il flusso in tre passaggi, il PDF originale, le tabelle rilevate e le impostazioni vengono conservati privatamente in questo browser per 30 minuti. Vengono mantenuti al massimo tre lavori e 80 MiB di dati locali.
  • Nell’URL del flusso compare solo un identificatore casuale del lavoro. Il PDF, i valori estratti e i file scaricati non vengono inviati tramite i nostri server né caricati sul server dei risultati.
  • Selezionando Ricomincia il lavoro locale corrente viene eliminato. I record scaduti o non validi vengono rimossi al successivo controllo dell’archiviazione del browser da parte dello strumento.

Il PDF viene caricato dai suoi byte locali tramite PDF.js. Lo strumento scarica le proprie librerie come normali risorse web, ma non invia il PDF selezionato insieme a tali richieste.

Controllo accessibile

Il controllo di caricamento funziona con la tastiera, l’avanzamento e gli errori vengono annunciati alle tecnologie assistive e le tabelle rilevate utilizzano didascalie e intestazioni di colonna. L’anteprima permette lo scorrimento orizzontale sugli schermi piccoli e conserva la direzione rilevata per le tabelle da destra a sinistra. Queste funzioni aiutano a controllare l’estrazione, ma non sostituiscono il confronto con il documento originale quando la precisione è importante.

Domande frequenti

Il rilevatore richiede testo selezionabile disposto in almeno due righe con posizioni di colonna stabili. Una scansione, un layout di una sola riga, un modulo creato con elementi grafici o una tabella irregolare potrebbero non soddisfare questi criteri. Esegui l’OCR sulle pagine composte solo da immagini o usa uno strumento specializzato per i layout complessi.

No. Legge il testo già incorporato nel PDF. Se non riesci a selezionare o copiare il testo della tabella in un lettore PDF, crea prima un PDF ricercabile con l’OCR e poi prova la copia ottenuta.

Scegli XLSX quando vuoi tutte le tabelle selezionate in una sola cartella di lavoro, con un foglio per tabella. Scegli CSV per un file di testo di importazione ampiamente supportato. Scegli TSV, separato da tabulazioni, quando virgole o punti e virgola sono frequenti nei dati o quando la destinazione richiede specificamente le tabulazioni.

Il convertitore conserva i caratteri estratti anziché provare a interpretarne il significato. Un valore come 1,234.56 o 01/02/2026 può avere significati diversi in impostazioni internazionali differenti. Converti intenzionalmente la colonna nel tuo foglio di calcolo dopo averne controllato le convenzioni decimali e di data.

Quando è attiva, aggiunge un prefisso alle celle CSV che iniziano come formule, tra cui =, +, -, @ e le rispettive varianti a larghezza intera dopo eventuali spazi iniziali. Riduce l’esecuzione accidentale di formule, ma non può garantire un comportamento sicuro in ogni programma o dopo ogni nuovo salvataggio. Mantienila attiva per dati non affidabili e controlla il risultato.

No. Il PDF originale, le tabelle rilevate e i file XLSX, CSV o TSV restano nel tuo browser. Un lavoro del flusso viene conservato nell’archiviazione del browser per 30 minuti e nell’URL compare solo il suo identificatore casuale. Ricomincia elimina il lavoro locale corrente.

Sì. Lo strumento può rilevare tabelle regolari separate in tutto il PDF. Seleziona quelle che ti servono e scarica una cartella di lavoro XLSX con un massimo di 200 fogli, oppure scarica separatamente ogni tabella come CSV o TSV.

Non sempre. La rotazione della pagina viene considerata, ma etichette verticali, tabelle annidate, celle unite, record su più righe e layout decorativi possono comunque spostarsi o essere scartati. Usa l’anteprima, confronta i totali con il PDF e correggi il foglio prima di fare affidamento sui dati.

Strumenti correlati