Estrai Email dal Testo

Incolla un dump di messaggi, una colonna CSV, un thread di forum o un blocco di HTML, e l’estrattore estrae ogni indirizzo email che riesce a riconoscere. L’output è deduplicato e pronto per essere inserito nel tuo import CRM o in uno strumento di verifica dei rimbalzi. L’abbinamento copre il sottoinsieme reale dell’RFC 5322 (plus-addressing, punti nella parte locale, trattini nel dominio) senza i falsi positivi che producono le regex semplici a@b.

Come estrarre email dal testo

  1. 1

    Incolla la tua fonte

    Inserisci testo libero, log, una pagina HTML o un elenco di contatti esportato, qualsiasi cosa che contenga modelli `local@domain.tld`.

  2. 2

    Esegui l'estrattore

    La regex cerca indirizzi completi e ignora la punteggiatura che li circonda.

  3. 3

    Controlla il conteggio

    Ricevi il numero di indirizzi unici trovati più l'elenco completo.

  4. 4

    Copia la lista

    Copia negli appunti come un elenco separato da nuove righe, o incolla direttamente in una colonna di un foglio di calcolo.

Cosa conta come un'email valida

L’estrattore segue la forma pratica delle email piuttosto che la grammatica completa dell’RFC 5322, perché la grammatica completa consente indirizzi che nessun MTA moderno accetterà (locali quotati con spazi, commenti tra parentesi). Ecco cosa copre il matcher:

Elemento del modello Accettato Rifiutato
Parte locale a-z 0-9 . _ % + - spazi, stringhe quotate, parentesi angolari
Dominio a-z 0-9 . - punto finale, underscore nell’etichetta
TLD 2+ lettere ASCII TLD solo numerici

Dati grezzi comuni che gestisce

  • Indirizzi seguiti da . o , nelle frasi, la punteggiatura non viene catturata.
  • Email all’interno di mailto: hrefs, lo schema viene rimosso automaticamente.
  • Le entità HTML come @ non vengono decodificate, quindi un indirizzo scritto come info@example.com non viene rilevato.
  • Indirizzi avvolti in <parentesi angolari> dagli header email.

Cosa fare con l’output

  • Controllo di deliverability. Esegui l’elenco attraverso un servizio di verifica dei rimbalzi prima di importare, gli elenchi raccolti hanno spesso ~10% di indirizzi morti.
  • Consenso. Solo perché un indirizzo appare in un documento non significa che la persona abbia acconsentito a essere contattata. Controlla il GDPR o la legge locale prima di contattare.
  • Deduplica anche nella parte locale. john@gmail.com e j.ohn@gmail.com raggiungono la stessa casella di posta su Gmail; normalizza i punti se hai bisogno di identità veramente uniche.

Domande frequenti

No. L’estrattore mira a indirizzi reali e analizzabili. Risolvi prima le forme offuscate, oppure pre-elabora il testo per sostituire [at] con @ e [dot] con ..

No. L’abbinamento legge solo lettere latine di base, quindi müller@straße.de non viene rilevato. Converti l’indirizzo nella sua forma ASCII punycode, ad esempio user@xn--strae-oqa.de, prima di eseguire l’estrattore.

No, non c’è alcuna opzione per conservare i duplicati. L’output è deduplicato e conserva l’ordine della prima occorrenza. Se devi contare le menzioni, contale nel testo sorgente.

No. Il testo viene elaborato per la tua richiesta e non viene salvato in un database, non viene registrato e non viene aggiunto al link della pagina.

Strumenti correlati

Strumento disponibile in altre lingue