Estrai immagini da PDF

Carica PDF

Carica un PDF e recupera ogni immagine incorporata alla sua risoluzione originale. L’estrattore percorre l’albero degli oggetti PDF, trova le voci /XObject /Image e le esporta tutte come PNG, niente screenshot, nessuna perdita di qualità dalla rasterizzazione dell’intera pagina. Funziona con scansioni, rapporti ricchi di foto, cataloghi di prodotti e brochure.

Come estrarre immagini da un PDF

  1. 1

    Carica il PDF

    Trascina un singolo file; i PDF protetti da password devono essere sbloccati prima.

  2. 2

    Scansiona l'albero degli oggetti

    L'estrattore enumera ogni immagine XObject su tutte le pagine.

  3. 3

    Anteprima dei risultati

    Vedi ogni immagine come una miniatura con il numero di pagina e le dimensioni.

  4. 4

    Scarica singolarmente o come ZIP

    Scarica un singolo asset o esporta tutto in un archivio, chiamato `image-p1-1.png`.

Come vivono le immagini all'interno di un PDF

Un PDF memorizza le immagini come risorse separate (/XObject streams) referenziate dal contenuto della pagina. L’estrattore legge ogni stream nella sua codifica nativa e ricostruisce il file che l’autore ha incorporato.

Formati che vedrai

Filtro PDF Cosa ricevi Fonte tipica
/DCTDecode PNG (da un JPEG) Foto, scatti di prodotto, scansioni
/FlateDecode + RGB PNG Loghi, grafici, screenshot UI
/JPXDecode PNG (da JPEG 2000) Scansioni archivistiche ad alta risoluzione
/CCITTFaxDecode PNG (da una scansione) Testo scansionato in bianco e nero
/JBIG2Decode PNG (convertito) Documenti scansionati compressi

L’estrattore fornisce sempre PNG: ricodifica i pixel grezzi nel tuo browser, quindi anche le fonti JPEG, JPEG 2000 e CCITT arrivano in PNG.

Cosa non recupererà

  • Illustrazioni vettoriali. I loghi disegnati con operatori di percorso PDF non sono immagini, vivono nel flusso di contenuto, non come XObjects. Usa uno strumento PDF-to-SVG per quelli.
  • Colori di sfondo e gradienti. Questi sono disegni a livello di pagina, non asset incorporati.
  • Testo reso come contorni. Appare come “grafica” ma non è un oggetto immagine.

Suggerimenti quando lavori con l’esportazione

  • Controlla le dimensioni. Una miniatura 300x300 sulla pagina potrebbe essere in realtà un originale 3000x3000 ridotto durante il rendering. Ottieni i pixel sorgente, non la dimensione di visualizzazione.
  • Rispetta la licenza. Essere in grado di estrarre un’immagine non concede diritti per riutilizzarla. Le immagini stock in un PDF rimangono immagini stock quando vengono estratte.
  • Documenti scansionati. Se ogni pagina produce un’immagine gigante con il testo incorporato, il PDF è una scansione. Esegui OCR sulle PNG esportate per recuperare il testo.

Domande frequenti

Le pagine PDF possono applicare una matrice di trasformazione a come un’immagine viene disegnata (capovolgi, ruota, inclina). L’estrattore restituisce il bitmap memorizzato, pixel grezzi. Se un editore ha memorizzato l’immagine capovolta e l’ha capovolta al momento del rendering, l’esportazione apparirà capovolta. Ruotalo di nuovo in qualsiasi editor di immagini.

Solo dopo averli sbloccati. Esegui il file attraverso uno strumento di sblocco PDF prima, fornendo la password del proprietario, e poi estrai.

Sì. Le immagini vengono aggiunte in ordine di pagina e ogni nome di file riporta il numero di pagina, per esempio image-p1-2.png, così sai da quale pagina proviene ogni immagine.

No. Il PDF sorgente viene aperto e letto interamente nel tuo browser e non viene mai inviato al server. Viene caricato solo il file ZIP con le immagini estratte per creare il risultato protetto dalla sessione; viene conservato fino a 7 giorni e poi eliminato.

Strumenti correlati

Strumento disponibile in altre lingue