Idioma: Español

tools / binary

binary/

Convierte texto a binario (0 y 1) y al revés, con 8 bits por byte. Elige UTF-8, GBK, UTF-16 y más.

Texto

Binario

Preguntas frecuentes

¿Cuántos bits ocupa un carácter chino en binario?

Cada byte se escribe siempre con exactamente 8 bits, así que la longitud depende del juego de caracteres. En UTF-8, un carácter chino común ocupa 3 bytes, es decir, 24 bits: 中 es 11100100 10111000 10101101. En GBK y GB2312 ocupa 2 bytes, 16 bits: 中 es 11010110 11010000. Las letras A-Z sin tilde y los dígitos ocupan 1 byte; A es 01000001.

Al pasar de binario a texto sale que el número de bits no es múltiplo de 8. ¿Qué hago?

Cada 8 bits forman un byte, así que, una vez quitados los espacios en blanco, el número de bits debe ser múltiplo de 8; si no, el error te dice cuántos bits añadir o quitar al final. Lo más habitual es que se hayan perdido o sobrado algunos bits al copiar. Algunas fuentes escriben solo los bits significativos de cada byte, por ejemplo A como 1000001 (7 bits); en ese caso rellena antes con ceros a la izquierda hasta llegar a 8 bits, porque esta herramienta no lo hace por ti.

Sale «no es 0 ni 1», o mi texto lleva un prefijo 0b o comas. ¿Qué hago?

Solo se aceptan los 0 y 1 ASCII; los espacios, los saltos de línea y los tabuladores se ignoran. No se aceptan el prefijo 0b, las comas, los guiones ni los 0 y 1 de ancho completo, y el error indica la posición del carácter. Quítalos o sustitúyelos en un editor de texto y vuelve a pegar.

Al pasar de binario a texto sale que los bytes no son texto válido, o el resultado es ilegible. ¿Qué hago?

Significa que los bits no se codificaron con el juego de caracteres seleccionado, así que prueba con otro. Para texto en chino, los habituales son UTF-8 y GBK. Esta herramienta nunca muestra como basura los bytes que no puede decodificar. La única excepción es ISO-8859-1: cada byte corresponde a algún carácter, así que nunca da error, pero el texto chino se convierte en caracteres ilegibles. GBK y GB2312 se decodifican con el decodificador GB18030 del propio navegador, que es más permisivo que el de Python o Java, por lo que con GB2312 también se decodifican caracteres que solo existen en GBK. Si los datos nunca fueron texto (una imagen, un archivo comprimido), ningún juego de caracteres los decodificará.

¿Por qué al escribir el número 10 no obtengo 1010?

Esta herramienta convierte los bytes de un texto, no valores numéricos. Lo que escribes como 10 son dos caracteres, «1» y «0», que en UTF-8 son 00110001 00110000. Para convertir el número decimal 10 en el número binario 1010 hace falta un conversor de bases numéricas, y esta herramienta no puede hacerlo.

¿Qué diferencia hay entre separar con espacio y no usar separador?

Con «Espacio» hay un espacio entre bytes; con «Ninguno» los bits van seguidos formando una sola cadena. Los bits de cada byte van de mayor a menor, así que el bit de más a la izquierda es el más significativo. Al decodificar se aceptan ambas formas y no hace falta que los espacios coincidan con los límites de cada byte; solo importa el número total de bits una vez quitados los espacios en blanco.

¿Por qué los resultados en UTF-16 y UTF-32 son tan largos?

UTF-16 usa al menos 2 bytes por carácter y añade FE FF (11111110 11111111) al principio, así que 中 es 11111110 11111111 01001110 00101101. UTF-32 usa exactamente 4 bytes por carácter, así que 中 es 00000000 00000000 01001110 00101101. Ambos son big-endian.

¿Se sube lo que escribo?

No. La conversión se hace en tu navegador, no realiza ninguna solicitud de red y no guarda nada.