Cosa fa
Questo strumento mostra i byte che stanno dietro a un testo e trasforma i byte di nuovo in testo. Scrivi una parola e la vedi in binario (01001000 01101001), esadecimale (48 69), decimale (72 105) o ottale (110 151). Incolla una sequenza di byte da un dump di pacchetti, da un debugger o da un esercizio e rileggila come testo.
Tutte le conversioni passano per UTF-8, quindi funziona con ogni lingua e con le emoji, non solo con il semplice ASCII. Così è facile capire perché 你好 è lungo sei byte o perché un’emoji conta quattro byte in una colonna di database.
Come si usa
- Scegli Testo → byte per codificare o Byte → testo per decodificare.
- Scegli il formato numerico: binario, esadecimale, decimale o ottale.
- In codifica, scegli un separatore tra i byte (spazio, nessuno, virgola o a capo) e se le lettere esadecimali devono essere maiuscole.
- Scrivi o incolla l’input. Il risultato si aggiorna mentre scrivi e può essere copiato o scaricato.
Regole di decodifica
In decodifica lo strumento è tollerante sulla disposizione:
- I byte possono essere separati da spazi, virgole, punti e virgola o a capo, anche mescolati.
- I prefissi comuni vengono rimossi:
0x,\xe%per l’esadecimale,0bper il binario,0oo\per l’ottale. - Una lunga sequenza senza separatori viene divisa in byte a larghezza fissa: 8 cifre per il binario, 2 per l’esadecimale e 3 per ottale o decimale.
- Un valore superiore a 255 o una cifra che non appartiene al formato viene segnalato con la sua riga e colonna.
Esempio
Codificando Hi 你好 in binario si ottengono nove byte: due per Hi, uno per lo spazio e tre per ciascun carattere cinese. Lo stesso testo in esadecimale è 48 69 20 e4 bd a0 e5 a5 bd, esattamente ciò che vedresti in un editor esadecimale, o in un URL come %E4%BD%A0.
Quando è utile
Gli sviluppatori lo usano per verificare come il testo viene salvato su disco o inviato in rete, per confrontare la lunghezza delle stringhe in byte e in caratteri e per risolvere problemi di mojibake. Gli studenti lo usano per esercitarsi con binario ed esadecimale a mano e controllare le risposte.
Domande frequenti
› Quale codifica dei caratteri usa lo strumento?
UTF-8, la codifica del web. I caratteri ASCII occupano un byte ciascuno, le lettere accentate di solito due e i caratteri cinesi, giapponesi o coreani tre. Le emoji ne occupano quattro.
› Posso incollare byte con prefissi 0x o \x?
Sì. In decodifica vengono rimossi prefissi come 0x, \x e % per l'esadecimale, 0b per il binario e 0o per l'ottale, e spazi, virgole, punti e virgola e a capo funzionano tutti come separatori.
› Perché ricevo un errore che dice che i byte non sono UTF-8 valido?
Alcune sequenze di byte non possono comparire in un testo UTF-8, ad esempio un byte FF isolato o un carattere multibyte troncato. Verifica di aver copiato tutti i byte e di aver scelto il formato giusto.
› Il mio testo viene caricato?
No. Codifica e decodifica avvengono nel tuo browser.