Langue : Français

tools / binary

binary/

Convertissez du texte en binaire (0 et 1) et inversement, 8 bits par octet. Jeu de caractères au choix (UTF-8, GBK, UTF-16 et d'autres).

Texte

Binaire

Questions fréquentes

Combien de bits fait un caractère chinois en binaire ?

Chaque octet s'écrit toujours sur 8 bits, la longueur dépend donc du jeu de caractères. En UTF-8, un caractère chinois courant occupe 3 octets, soit 24 bits : 中 donne 11100100 10111000 10101101. En GBK et GB2312, il occupe 2 octets, soit 16 bits : 中 donne 11010110 11010000. Les lettres sans accent et les chiffres occupent 1 octet ; A donne 01000001.

La conversion du binaire en texte indique que le nombre de bits n'est pas un multiple de 8. Que faire ?

Chaque groupe de 8 bits forme un octet, donc une fois les espaces blancs retirés, le nombre de bits doit être un multiple de 8. Sinon, l'erreur indique combien de bits ajouter ou retirer à la fin. Le plus souvent, des bits ont été perdus ou ajoutés lors de la copie. Certaines sources n'écrivent que les bits significatifs de chaque octet, par exemple A sous la forme 1000001 (7 bits) ; complétez d'abord ces valeurs par des zéros à gauche pour obtenir 8 bits, car cet outil ne le fait pas à votre place.

Le message indique qu'un caractère n'est ni 0 ni 1, ou ma saisie contient un préfixe 0b ou des virgules. Que faire ?

Seuls les 0 et 1 ASCII sont acceptés ; les espaces, les sauts de ligne et les tabulations sont ignorés. Un préfixe 0b, des virgules, des tirets et les 0 et 1 pleine largeur ne sont pas acceptés, et l'erreur indique la position du caractère. Supprimez-les ou remplacez-les dans un éditeur de texte, puis collez à nouveau.

La conversion du binaire en texte indique que les octets ne sont pas un texte valide, ou le résultat est illisible. Que faire ?

Cela signifie que ces bits n'ont pas été encodés avec le jeu de caractères actuel : essayez-en un autre. Pour du texte chinois, les plus courants sont UTF-8 et GBK. Cet outil n'affiche jamais en caractères illisibles des octets qu'il ne peut pas décoder. Seul ISO-8859-1 fait exception : chaque octet correspond à un caractère, il ne signale donc jamais d'erreur, mais le texte chinois devient des caractères illisibles. GBK et GB2312 sont tous deux décodés par le décodeur GB18030 intégré au navigateur, plus tolérant que ceux de Python ou de Java : choisir GB2312 permet donc aussi de décoder des caractères qui n'existent qu'en GBK. Si ces données n'ont jamais été du texte (image, archive), aucun jeu de caractères ne pourra les décoder.

Pourquoi saisir le nombre 10 ne donne-t-il pas 1010 ?

Cet outil convertit les octets d'un texte, pas des valeurs numériques. La saisie 10 est composée de deux caractères, « 1 » et « 0 », qui donnent en UTF-8 00110001 00110000. Pour transformer le nombre décimal 10 en nombre binaire 1010, il faut un convertisseur de bases numériques, que cet outil ne propose pas.

Quelle différence entre le séparateur « Espace » et « Aucun » ?

Avec « Espace », un espace sépare chaque octet ; avec « Aucun », les bits forment une seule chaîne continue. Les bits de chaque octet vont du poids fort au poids faible, le bit le plus à gauche est donc le bit de poids fort. Le décodage accepte les deux formes et n'exige pas que les espaces tombent sur les limites d'octets ; seul compte le nombre total de bits une fois les espaces blancs retirés.

Pourquoi les résultats en UTF-16 et UTF-32 sont-ils si longs ?

L'UTF-16 utilise au moins 2 octets par caractère et ajoute FE FF (11111110 11111111) au début, donc 中 donne 11111110 11111111 01001110 00101101. L'UTF-32 utilise exactement 4 octets par caractère, donc 中 donne 00000000 00000000 01001110 00101101. Les deux sont en big-endian.

Ce que je saisis est-il envoyé quelque part ?

Non. La conversion se fait dans votre navigateur, n'envoie aucune requête et ne conserve rien.