Co robi to narzędzie
To narzędzie pokazuje bajty kryjące się za tekstem i zamienia bajty z powrotem na tekst. Wpisz słowo i zobacz je w postaci binarnej (01001000 01101001), szesnastkowej (48 69), dziesiętnej (72 105) lub ósemkowej (110 151). Wklej ciąg bajtów ze zrzutu pakietów, debuggera albo zadania domowego i znów odczytaj go jako tekst.
Cała konwersja przechodzi przez UTF-8, więc działa dla każdego języka i dla emoji, a nie tylko dla zwykłego ASCII. Dzięki temu łatwo zobaczyć, dlaczego 你好 ma sześć bajtów albo dlaczego emoji liczy się jako cztery bajty w kolumnie bazy danych.
Jak używać
- Wybierz Tekst → bajty, aby kodować, lub Bajty → tekst, aby dekodować.
- Wybierz format liczb: binarny, hex, dziesiętny lub ósemkowy.
- Przy kodowaniu wybierz separator między bajtami (spacja, brak, przecinek lub nowa linia) oraz to, czy litery w hex mają być wielkie.
- Wpisz lub wklej dane wejściowe. Wynik aktualizuje się w trakcie pisania i można go skopiować lub pobrać.
Zasady dekodowania
Przy dekodowaniu narzędzie jest wyrozumiałe co do układu:
- Bajty mogą być rozdzielone spacjami, przecinkami, średnikami lub złamaniami wierszy, w dowolnej kombinacji.
- Popularne prefiksy są usuwane:
0x,\xi%dla hex,0bdla systemu binarnego,0olub\dla ósemkowego. - Długi ciąg bez separatorów jest dzielony na bajty o stałej szerokości: 8 cyfr dla systemu binarnego, 2 dla hex i 3 dla ósemkowego lub dziesiętnego.
- Wartość powyżej 255 lub cyfra nienależąca do formatu jest zgłaszana wraz z linią i kolumną.
Przykład
Zakodowanie Hi 你好 binarnie daje dziewięć bajtów: dwa dla Hi, jeden dla spacji i po trzy dla każdego chińskiego znaku. Ten sam tekst w hex to 48 69 20 e4 bd a0 e5 a5 bd, czyli dokładnie to, co zobaczysz w edytorze szesnastkowym albo w URL-u jako %E4%BD%A0.
Kiedy się przydaje
Programiści używają go, aby sprawdzić, jak tekst jest zapisywany na dysku lub przesyłany przez sieć, porównać długość napisów w bajtach i znakach oraz debugować krzaki (mojibake). Uczniowie i studenci używają go, aby ćwiczyć ręczne przeliczanie na system binarny i szesnastkowy oraz sprawdzać odpowiedzi.
FAQ
› Jakiego kodowania znaków używa narzędzie?
UTF-8, kodowania sieci WWW. Znaki ASCII zajmują po jednym bajcie, litery z diakrytykami zwykle dwa, a znaki chińskie, japońskie lub koreańskie trzy. Emoji zajmują cztery.
› Czy mogę wkleić bajty z prefiksami 0x lub \x?
Tak. Przy dekodowaniu prefiksy takie jak 0x, \x i % dla hex, 0b dla systemu binarnego i 0o dla ósemkowego są usuwane, a jako separatory działają spacje, przecinki, średniki i złamania wierszy.
› Dlaczego dostaję błąd, że bajty nie są poprawnym UTF-8?
Niektóre sekwencje bajtów nie mogą wystąpić w tekście UTF-8, na przykład samotny bajt FF albo ucięty znak wielobajtowy. Sprawdź, czy skopiowałeś wszystkie bajty i wybrałeś właściwy format.
› Czy mój tekst jest wysyłany?
Nie. Kodowanie i dekodowanie działają w twojej przeglądarce.