Codificadores y convertidores

Explorador de codificación de texto — inspector de bytes Unicode, UTF-8 y UTF-16

Explora como textos se codifican en UTF-8, UTF-16 y code points Unicode. Vea los bytes de cada carácter, de unps hexadecimais y estadísticas de codificación. Herramienta gratuita en línea que funciona completamente en el navegador.

Gratis Sin registro Se ejecuta en tu navegador

Espacio de trabajo de la herramienta

12
Caracteres
19
Bytes UTF-8
26
Bytes UTF-16
CharCode PointUTF-8UTF-16DecimalName
HU+00484800 4872ASCII printable
eU+00656500 65101ASCII printable
lU+006C6C00 6C108ASCII printable
lU+006C6C00 6C108ASCII printable
oU+006F6F00 6F111ASCII printable
,U+002C2C00 2C44ASCII printable
U+00202000 2032Space
U+4E16E4 B8 964E 1619990U+4E16
U+754CE7 95 8C75 4C30028U+754C
!U+00212100 2133ASCII printable
U+00202000 2032Space
🌍U+1F30DF0 9F 8C 8DD8 3C DF 0D127757U+1F30D

¿Qué es la codificación de texto?

La codificación de texto es el proceso de convertir caracteres en secuencias de bytes que las computadoras pueden almacenar y transmitir. El Unicode atribuye un code point exclusivo a cada carácter de todos los sistemas de escritura. UTF-8 y UTF-16 son los dos formatos de codificación más usados: UTF-8 utiliza de 1 a 4 bytes por carácter y predomina en la web, mientras que UTF-16 utiliza 2 o 4 bytes y es empleado internamente por JavaScript, Java y Windows. Esta herramienta permite inspeccionar exactamente como cada caractere del texto está representado en esas codificaciones, exhibindo code points, secuencias de bytes y un dump hexadecimal.

Cómo usar el explorador de codificación de texto

  1. 1Escriba o recoge el texto en el campo de entrada. La herramienta proporciona una muestra estándar con caracteres ASCII, CJK y emoticonos.
  2. 2Consulte la tabla de caracteres para ver el code point Unicode, los bytes UTF-8, los bytes UTF-16 y el valor decimal de cada carácter.
  3. 3Consulte las estadísticas resumidas el total de caracteres y las cantidades de bytes UTF-8 y UTF-16.
  4. 4Visita a pestaña Hex Dump para ver bytes UTF-8 brutos en un formato tradicional de hexdump similar a xxd.

Casos de uso comunes

Explorador de codificación de texto — inspector de bytes Unicode, UTF-8 y UTF-16

Inspeccione secuencias de bytes para diagnosticar mojibake, exhibición incorrecta de caracteres o incompatibilidades de codificación entre sistemas.

Explorador de codificación de texto — inspector de bytes Unicode, UTF-8 y UTF-16

Vea exactamente como caracteres CJK, emojadas y letras acentuadas se codifican en UTF-8 y UTF-16.

Explorador de codificación de texto — inspector de bytes Unicode, UTF-8 y UTF-16

Compara los tamaños en bytes de UTF-8 y UTF-16 para elegir la codificación más eficiente para sus datos.

Explorador de codificación de texto — inspector de bytes Unicode, UTF-8 y UTF-16

Una referencia práctica para estudiantes y desarrolladores aprender cómo la codificación de texto funciona en el nivel de bytes.

Preguntas frecuentes

¿Cuál es la diferencia entre UTF-8 y UTF-16?

UTF-8 codifica caracteres usando 1 a 4 bytes, y caracteres ASCII ocupan solo 1 byte. UTF-16 usa 2 bytes para la mayoría de los caracteres comunes y 4 bytes para caracteres adicionales, como algunos emoct. UTF-8 es más eficiente para textos predominantemente latinos, mientras que UTF-16 puede ser más compacto para textos con muchos caracteres CJK.

¿Por qué algunos caracteres aparecen con varios bytes?

Caracteres fuera del intervalo ASCII, con code points por encima de U+007F, exigen varios bytes en UTF-8. Por ejemplo, los caracteres chinos normalmente usan 3 bytes en UTF-8, mientras que los emotes con code points por encima de U+FFFF usan 4 bytes tanto en UTF-8 como en UTF-16, en este último caso como pares sustitutos.

¿Mi texto se envía a algún servidor?

No. Toda el análisis de codificación ocurre localmente en el navegador a través de la API JavaScript TextEncoder. Ningún dato se transmite a servidores.