Що робить цей інструмент
Цей інструмент показує байти, що стоять за текстом, і перетворює байти назад на текст. Введіть слово й побачте його у двійковому (01001000 01101001), шістнадцятковому (48 69), десятковому (72 105) або вісімковому (110 151) вигляді. Вставте рядок байтів із дампа пакетів, налагоджувача чи домашнього завдання — і знову прочитайте його як текст.
Усі перетворення проходять через UTF-8, тож інструмент працює з будь-якою мовою та з емодзі, а не лише з простим ASCII. Так легко побачити, чому 你好 має довжину шість байтів або чому емодзі займає чотири байти в стовпці бази даних.
Як користуватися
- Виберіть Текст → байти, щоб закодувати, або Байти → текст, щоб декодувати.
- Виберіть формат чисел: двійковий, hex, десятковий або вісімковий.
- Під час кодування виберіть розділювач між байтами (пробіл, немає, кома або новий рядок) і чи писати hex-літери великими.
- Введіть або вставте вхідні дані. Результат оновлюється під час набору, і його можна скопіювати чи зберегти.
Правила декодування
Під час декодування інструмент поблажливо ставиться до оформлення:
- Байти можна розділяти пробілами, комами, крапками з комою чи переносами рядків у будь-якому поєднанні.
- Поширені префікси прибираються:
0x,\xі%для hex,0bдля двійкового,0oабо\для вісімкового формату. - Довга послідовність без розділювачів розбивається на байти фіксованої ширини: 8 цифр для двійкового, 2 для hex і 3 для вісімкового чи десяткового формату.
- Про значення понад 255 або цифру, що не належить до формату, повідомляється з номером рядка й стовпця.
Приклад
Кодування Hi 你好 у двійковий вигляд дає дев’ять байтів: два для Hi, один для пробілу й по три для кожного китайського ієрогліфа. Той самий текст у hex — це 48 69 20 e4 bd a0 e5 a5 bd, саме те, що ви побачите в hex-редакторі або в URL як %E4%BD%A0.
Коли це допомагає
Розробники використовують інструмент, щоб перевірити, як текст зберігається на диску чи передається мережею, порівняти довжину рядків у байтах і символах та налагодити «кракозябри» (mojibake). Студенти — щоб тренуватися переводити в двійкову й шістнадцяткову системи вручну й перевіряти відповіді.
Часті запитання
› Яке кодування символів використовує інструмент?
UTF-8 — кодування вебу. Символи ASCII займають по одному байту, літери з діакритикою та кирилиця зазвичай по два, а китайські, японські чи корейські ієрогліфи — по три. Емодзі займають чотири.
› Чи можна вставляти байти з префіксами 0x або \x?
Так. Під час декодування префікси на кшталт 0x, \x і % для hex, 0b для двійкового та 0o для вісімкового формату прибираються, а пробіли, коми, крапки з комою й переноси рядків працюють як розділювачі.
› Чому я отримую помилку, що байти не є коректним UTF-8?
Деякі послідовності байтів не можуть траплятися в тексті UTF-8, наприклад окремий байт FF або обрізаний багатобайтовий символ. Перевірте, чи скопіювали ви всі байти й чи правильно вибрали формат.
› Чи вивантажується мій текст на сервер?
Ні. Кодування й декодування виконуються у вашому браузері.