Rimuovi righe duplicate

Un export CSV con righe ripetute, un file di log con voci duplicate, un elenco di parole chiave costruito da tre fonti sovrapposte: ogni volta che il testo contiene righe identiche, questo rimuovi-duplicati le fonde e conserva la prima occorrenza nella posizione originale. Due modalità di corrispondenza, con o senza distinzione tra maiuscole e minuscole, taglio opzionale degli spazi e un conteggio delle righe rimosse.

Come rimuovere le righe duplicate

  1. 1

    Incolla il testo

    Incolla un elenco, un log, una colonna CSV o qualsiasi testo in cui ogni voce occupa la propria riga.

  2. 2

    Scegli le opzioni di corrispondenza

    "Sensibile a maiuscole e minuscole" conserva `Apple` e `apple` come righe separate; disattivandola vengono unite. "Taglia spazi" rimuove gli spazi iniziali e finali prima del confronto.

  3. 3

    Rimuovi i duplicati

    Clicca sul pulsante. La prima occorrenza di ogni riga viene conservata e le ripetizioni successive vengono eliminate.

  4. 4

    Controlla e copia

    Le statistiche mostrano righe originali, righe uniche e duplicati rimossi. Copia il testo ripulito quando ti sembra giusto.

Come funziona la corrispondenza

Opzione Comportamento
Sensibile a maiuscole e minuscole (predefinito) Apple e apple restano righe separate
Insensibile a maiuscole e minuscole Apple e apple contano come la stessa riga
Taglia spazi (predefinito) hello” e “hello ” sono trattate come la stessa riga

Viene conservata la prima occorrenza di ogni riga, quindi l’ordine originale del testo rimane intatto.

Casi d’uso comuni

  • Pulizia di file CSV. Incolla una singola colonna (nomi, e-mail, SKU) e rimuovi le ripetizioni prima di riunirla alle altre colonne.
  • Elenchi di URL. Consolida gli elenchi di URL raccolti dove la stessa pagina compare molte volte.
  • Ricerca di parole chiave. Unire gli export di parole chiave di più strumenti produce inevitabilmente duplicati.
  • Elenchi e-mail. Prima dell’import in un CRM, rimuovi i duplicati esatti per evitare errori “già esistente”.
  • Analisi dei log. Elimina le righe di avviso ripetute per vedere i problemi unici.

Cosa non fa lo strumento

  • Nessuna deduplicazione per colonna. Un CSV con email,name in cui l’e-mail si ripete ma il nome cambia conserva entrambe le righe, perché le righe complete sono diverse. Per deduplicare in base a una colonna, estraila prima, rimuovi i suoi duplicati e usala come chiave per filtrare il file originale.
  • Nessuna protezione delle intestazioni. Ogni riga viene trattata come dati, quindi una riga di intestazione ripetuta viene rimossa come qualsiasi altra.
  • Nessuna corrispondenza approssimativa. Le righe che differiscono per un refuso, spazi interni o punteggiatura non vengono unite.

Suggerimenti

  • Normalizza prima del confronto. Metti in minuscolo e rimuovi la punteggiatura circostante per far contare “Apple, “, “ apple “ e “Apple” come un’unica voce.
  • Conserva una copia del testo originale prima di pulizie importanti.
  • Controlla le statistiche. Se ti aspettavi il 10 per cento di duplicati e ne è stato rimosso l’80 per cento, c’è qualcosa di sbagliato nei dati di input.

Domande frequenti

La prima. L’ordine del testo originale viene preservato, quindi ogni riga unica resta nella sua posizione originale.

Non automaticamente. Ogni riga, intestazione inclusa, viene confrontata come le altre. Se una riga successiva è uguale all’intestazione, viene rimossa. Conserva l’intestazione separatamente se ti serve.

Questo rimuovi-duplicati è orientato alla corrispondenza esatta per la velocità. Per la corrispondenza approssimativa (refusi, maiuscole diverse, punteggiatura in più) usa uno strumento di deduplicazione dedicato con una soglia di somiglianza.

Sì. Il testo viene inviato al nostro server perché lo strumento possa elaborarlo, e il risultato viene mostrato nella pagina. Il testo non viene conservato in seguito.

Strumenti correlati

Strumento disponibile in altre lingue