Ce que fait l’outil
Cet outil montre les octets qui se cachent derrière un texte et retransforme des octets en texte. Tapez un mot et voyez-le en binaire (01001000 01101001), en hexadécimal (48 69), en décimal (72 105) ou en octal (110 151). Collez une suite d’octets issue d’une capture réseau, d’un débogueur ou d’un exercice et relisez-la sous forme de texte.
Toute la conversion passe par UTF-8 : elle fonctionne pour toutes les langues et pour les emoji, pas seulement pour l’ASCII pur. On voit ainsi facilement pourquoi 你好 fait six octets ou pourquoi un emoji compte pour quatre octets dans une colonne de base de données.
Mode d’emploi
- Choisissez Texte → octets pour encoder ou Octets → texte pour décoder.
- Choisissez le format des nombres : binaire, hex, décimal ou octal.
- À l’encodage, choisissez un séparateur entre les octets (espace, aucun, virgule ou saut de ligne), et si les lettres hexa sont en majuscules.
- Tapez ou collez votre entrée. Le résultat se met à jour pendant la saisie et peut être copié ou téléchargé.
Règles de décodage
Au décodage, l’outil est tolérant sur la mise en forme :
- Les octets peuvent être séparés par des espaces, virgules, points-virgules ou sauts de ligne, dans n’importe quel mélange.
- Les préfixes courants sont retirés :
0x,\xet%pour l’hexa,0bpour le binaire,0oou\pour l’octal. - Une longue suite sans séparateurs est découpée en octets de largeur fixe : 8 chiffres en binaire, 2 en hexa et 3 en octal ou décimal.
- Une valeur supérieure à 255 ou un chiffre qui n’appartient pas au format est signalé avec sa ligne et sa colonne.
Exemple
Encoder Hi 你好 en binaire donne neuf octets : deux pour Hi, un pour l’espace et trois pour chaque caractère chinois. Le même texte en hexa donne 48 69 20 e4 bd a0 e5 a5 bd, exactement ce que vous verriez dans un éditeur hexadécimal ou, dans une URL, sous la forme %E4%BD%A0.
Quand c’est utile
Les développeurs s’en servent pour vérifier comment un texte est stocké sur disque ou envoyé sur le réseau, comparer la longueur des chaînes en octets et en caractères, et déboguer des problèmes d’encodage (mojibake). Les étudiants s’en servent pour s’entraîner au binaire et à l’hexadécimal à la main et vérifier leurs réponses.
FAQ
› Quel encodage de caractères l'outil utilise-t-il ?
UTF-8, l'encodage du web. Les caractères ASCII occupent un octet chacun, les lettres accentuées généralement deux, et les caractères chinois, japonais ou coréens trois. Les emoji en occupent quatre.
› Puis-je coller des octets avec des préfixes 0x ou \x ?
Oui. Au décodage, les préfixes comme 0x, \x et % pour l'hexa, 0b pour le binaire et 0o pour l'octal sont retirés, et les espaces, virgules, points-virgules et sauts de ligne servent tous de séparateurs.
› Pourquoi ai-je une erreur indiquant que les octets ne sont pas du UTF-8 valide ?
Certaines séquences d'octets ne peuvent pas apparaître dans un texte UTF-8, par exemple un octet FF isolé ou un caractère multi-octets tronqué. Vérifiez que vous avez copié tous les octets et choisi le bon format.
› Mon texte est-il envoyé ?
Non. L'encodage et le décodage s'exécutent dans votre navigateur.