DevToolPal
UK

Текст у двійковий код і hex

Перетворюйте текст на байти UTF-8 у двійковому, шістнадцятковому, десятковому чи вісімковому вигляді й декодуйте байти назад у текст.

Працює локально, нічого не завантажується на сервер

Параметри

Режим
Формат

Вхідні дані

0 симв. · 0 B

Результат

0 симв. · 0 B

Що робить цей інструмент

Цей інструмент показує байти, що стоять за текстом, і перетворює байти назад на текст. Введіть слово й побачте його у двійковому (01001000 01101001), шістнадцятковому (48 69), десятковому (72 105) або вісімковому (110 151) вигляді. Вставте рядок байтів із дампа пакетів, налагоджувача чи домашнього завдання — і знову прочитайте його як текст.

Усі перетворення проходять через UTF-8, тож інструмент працює з будь-якою мовою та з емодзі, а не лише з простим ASCII. Так легко побачити, чому 你好 має довжину шість байтів або чому емодзі займає чотири байти в стовпці бази даних.

Як користуватися

  1. Виберіть Текст → байти, щоб закодувати, або Байти → текст, щоб декодувати.
  2. Виберіть формат чисел: двійковий, hex, десятковий або вісімковий.
  3. Під час кодування виберіть розділювач між байтами (пробіл, немає, кома або новий рядок) і чи писати hex-літери великими.
  4. Введіть або вставте вхідні дані. Результат оновлюється під час набору, і його можна скопіювати чи зберегти.

Правила декодування

Під час декодування інструмент поблажливо ставиться до оформлення:

  • Байти можна розділяти пробілами, комами, крапками з комою чи переносами рядків у будь-якому поєднанні.
  • Поширені префікси прибираються: 0x, \x і % для hex, 0b для двійкового, 0o або \ для вісімкового формату.
  • Довга послідовність без розділювачів розбивається на байти фіксованої ширини: 8 цифр для двійкового, 2 для hex і 3 для вісімкового чи десяткового формату.
  • Про значення понад 255 або цифру, що не належить до формату, повідомляється з номером рядка й стовпця.

Приклад

Кодування Hi 你好 у двійковий вигляд дає дев’ять байтів: два для Hi, один для пробілу й по три для кожного китайського ієрогліфа. Той самий текст у hex — це 48 69 20 e4 bd a0 e5 a5 bd, саме те, що ви побачите в hex-редакторі або в URL як %E4%BD%A0.

Коли це допомагає

Розробники використовують інструмент, щоб перевірити, як текст зберігається на диску чи передається мережею, порівняти довжину рядків у байтах і символах та налагодити «кракозябри» (mojibake). Студенти — щоб тренуватися переводити в двійкову й шістнадцяткову системи вручну й перевіряти відповіді.

Часті запитання

› Яке кодування символів використовує інструмент?

UTF-8 — кодування вебу. Символи ASCII займають по одному байту, літери з діакритикою та кирилиця зазвичай по два, а китайські, японські чи корейські ієрогліфи — по три. Емодзі займають чотири.

› Чи можна вставляти байти з префіксами 0x або \x?

Так. Під час декодування префікси на кшталт 0x, \x і % для hex, 0b для двійкового та 0o для вісімкового формату прибираються, а пробіли, коми, крапки з комою й переноси рядків працюють як розділювачі.

› Чому я отримую помилку, що байти не є коректним UTF-8?

Деякі послідовності байтів не можуть траплятися в тексті UTF-8, наприклад окремий байт FF або обрізаний багатобайтовий символ. Перевірте, чи скопіювали ви всі байти й чи правильно вибрали формат.

› Чи вивантажується мій текст на сервер?

Ні. Кодування й декодування виконуються у вашому браузері.