Convertitore di codifica per file di testo

Quando un testo mostra café come café o naïve come naïve, i caratteri sono corretti: è la codifica a essere letta nel modo sbagliato. Incolla il testo, indica al convertitore con quale codifica leggerlo e con quale scriverlo, e lo ricodifica in modo pulito tra UTF-8, UTF-16, ISO-8859-1 (Latin-1), Windows-1252 e altre code page comuni. Copia il risultato corretto direttamente nel tuo editor, foglio di calcolo o database.

Come convertire la codifica di un testo

  1. 1

    Incolla il testo

    Qualsiasi testo che appare corrotto o che devi ricodificare per un altro programma.

  2. 2

    Controlla il rilevamento

    Un suggerimento indicativo mostra la codifica probabile sopra il campo.

  3. 3

    Scegli la codifica di origine

    Imposta «Da» in base a come vanno letti i byte: UTF-8, Windows-1252, ISO-8859-1, SJIS e altre.

  4. 4

    Scegli la codifica di destinazione

    UTF-8 è lo standard moderno; UTF-16, Big5 o GB2312 sono disponibili quando un programma specifico li richiede.

  5. 5

    Converti e copia

    Il testo viene ricodificato e con un clic copi il risultato negli appunti.

Da dove nascono i conflitti di codifica

Origine Codifica probabile
Excel «Salva come CSV» su Windows Windows-1252
Vecchia applicazione Windows Windows-1252
Vecchia utility Unix ISO-8859-1 (Latin-1)
Editor moderno macOS/Linux UTF-8
Testo giapponese su Windows Shift-JIS (SJIS)
Cinese semplificato su Windows GB2312
Cinese tradizionale (Taiwan/Hong Kong) Big5

I sintomi classici

  • café appare come café quando i byte UTF-8 vengono letti come Latin-1. Imposta «Da» su UTF-8 per reinterpretare i byte.
  • ñ diventa ñ per lo stesso motivo.
  • Un doppio mojibake come café significa che il testo è stato risalvato dopo la prima lettura errata, codificando una seconda volta l’interpretazione sbagliata.
  • Un  iniziale è un marcatore dell’ordine dei byte UTF-8 letto come tre caratteri Latin-1.

Una volta riconosciuto il sintomo, la strada è di solito chiara: leggi il testo per ciò che è davvero (Latin-1, Windows-1252 o quel che serve) e riscrivilo come UTF-8.

Marcatori dell’ordine dei byte (BOM)

Questo convertitore non aggiunge né rimuove un marcatore dell’ordine dei byte per scelta: il comportamento dipende dalla codifica di destinazione. L’output UTF-8 non ha BOM. L’output UTF-16 semplice inizia con un BOM ed è big-endian, mentre UTF-16BE e UTF-16LE scrivono i byte senza BOM. Scegli UTF-8 a meno che un programma specifico non richieda UTF-16.

Quando un carattere non ha corrispondenza

Alcuni byte non hanno significato nella codifica di origine scelta, e alcuni caratteri non possono essere rappresentati in quella di destinazione. In tal caso la conversione sostituisce con un marcatore invece di interrompersi. Ciò che conta di più è scegliere la codifica di origine giusta: una stringa di soli caratteri ASCII è valida in ogni codifica, quindi un conflitto in genere emerge solo con caratteri accentati o non latini.

Domande frequenti

Gli elenchi «Da» e «A» offrono entrambi UTF-8, UTF-16, UTF-16BE, UTF-16LE, ISO-8859-1, ISO-8859-15, Windows-1252, ASCII, EUC-JP, SJIS (Shift-JIS), GB2312 e Big5. Puoi convertire da una qualsiasi a qualsiasi altra.

Per il web, i database e quasi ogni flusso moderno, sì. Le eccezioni sono le vecchie app Windows che leggono solo Windows-1252, alcuni vecchi strumenti mainframe e certi software giapponesi che si aspettano Shift-JIS.

È una stima basata sullo schema dei byte, scelta tra UTF-8, UTF-16, ISO-8859-1, Windows-1252 e ASCII. Può sbagliare con testi brevi o di soli caratteri ASCII, quindi consideralo un suggerimento e imposta tu stesso la codifica «Da» quando lo sai.

Il testo viene inviato al nostro server per eseguire la conversione e non viene conservato dopo la restituzione della risposta. Per materiale riservato è preferibile un editor offline con convertitore di codifica integrato.

Strumenti correlati

Strumento disponibile in altre lingue