Navegador de caracteres Unicode
Navegue por cada bloco de caracteres Unicode ou pesquise por nome, ponto de código ou texto colado. Veja o nome, a categoria, o script e o bloco de cada caractere e copie-o como UTF-8, UTF-16, uma entidade HTML ou um escape de CSS, JavaScript ou URL. Executado no seu navegador.
Leia-me
O que é um caractere Unicode?
O Unicode atribui a cada caractere de cada sistema de escrita um número, chamado ponto de código, escrito como U+ seguido de dígitos hexadecimais. A é U+0041, € é U+20AC e 😀 é U+1F600. Cada caractere também tem um nome oficial, como EURO SIGN, e pertence a um bloco: um intervalo de pontos de código que agrupa caracteres relacionados, como Basic Latin, Cyrillic ou Emoticons. O Unicode comporta 1.114.112 pontos de código, e mais de 150.000 deles estão atribuídos a caracteres.
Descrição da ferramenta
Esta ferramenta permite explorar todo o conjunto de caracteres Unicode, um bloco por vez, como em um mapa de caracteres. Escolha um bloco para listar seus caracteres em uma tabela ou pesquise por nome, ponto de código ou texto colado. Clique em um caractere para ver seus detalhes e copiá-lo ou copiar uma de suas codificações. Use-a para encontrar um símbolo que você não consegue digitar, identificar um caractere desconhecido ou consultar o código de escape para HTML, CSS ou JavaScript.
Recursos
- Explore todos os blocos Unicode, de Basic Latin às áreas de uso privado
- Pesquise por palavras no nome, como "seta para a esquerda" ou "rosto sorridente"
- Vá diretamente para um ponto de código escrito como
U+20AC,0x20AC,\u20AC,\u{1F600},€ou€ - Cole um texto para listar cada caractere contido nele, inclusive os invisíveis
- Exibe o nome, os aliases, o bloco, a categoria geral e o sistema de escrita de cada caractere
- Copie o caractere, seus bytes UTF-8, suas unidades de código UTF-16 e sua codificação de URL
- Copie a entidade HTML, incluindo a entidade nomeada quando houver, além dos escapes de CSS e JavaScript
Como funciona
Os nomes dos caracteres, blocos, categorias e sistemas de escrita vêm do Unicode Character Database, versão 18.0. Nomes que o Unicode deriva do ponto de código, como CJK UNIFIED IDEOGRAPH-4E00 e as sílabas Hangul, são formados da mesma maneira. Os caracteres de controle não têm nome próprio, então a ferramenta exibe seu alias, como LINE FEED. Os pontos de código sem um caractere recebem um rótulo, como <reserved-0378> ou <private-use-E000>. Os caracteres sem um glifo visível, como espaços e caracteres de controle, exibem sua abreviação, e as marcas de combinação são desenhadas sobre um círculo pontilhado. Tudo é executado no seu navegador.
Dicas
- Uma palavra de pesquisa corresponde ao início de uma palavra no nome, então "set" encontra todas as setas.
- Cole uma string que pareça incorreta para encontrar caracteres ocultos, como um espaço de largura zero (ZWSP) ou um espaço sem quebra (NBSP).
- Se um caractere aparecer como um quadrado vazio, as fontes do seu dispositivo não o incluem. O nome e os códigos ainda estão corretos.
- Em CSS, termine o escape com um espaço quando o próximo caractere for um dígito hexadecimal, como em
content: "\20AC 5".