Esploratore dei caratteri Unicode
Esplora ogni blocco di caratteri Unicode oppure cerca per nome, punto di codice o testo incollato. Visualizza il nome, la categoria, lo script e il blocco di ogni carattere e copialo come UTF-8, UTF-16, entità HTML oppure escape CSS, JavaScript o URL. Funziona nel browser.
Leggimi
Che cos'è un carattere Unicode?
Unicode assegna a ogni carattere di ogni sistema di scrittura un numero, chiamato punto di codice, scritto come U+ seguito da cifre esadecimali. A è U+0041, € è U+20AC e 😀 è U+1F600. Ogni carattere ha anche un nome ufficiale, ad esempio EURO SIGN, e appartiene a un blocco: un intervallo di punti di codice che raggruppa caratteri correlati, come Basic Latin, Cyrillic o Emoticons. Unicode può contenere 1.114.112 punti di codice e a più di 150.000 di essi sono assegnati dei caratteri.
Descrizione dello strumento
Questo strumento consente di esplorare l'intero insieme di caratteri Unicode, un blocco alla volta, come in una mappa dei caratteri. Scegli un blocco per elencarne i caratteri in una tabella oppure cerca per nome, punto di codice o testo incollato. Fai clic su un carattere per visualizzarne i dettagli e copiarlo oppure copiarne una delle codifiche. Usalo per trovare un simbolo che non riesci a digitare, identificare un carattere sconosciuto o recuperare il codice di escape per HTML, CSS o JavaScript.
Funzionalità
- Esplora ogni blocco Unicode, da Basic Latin alle aree a uso privato
- Cerca per parole contenute nel nome, come "arrow left" o "grinning face"
- Passa a un punto di codice scritto come
U+20AC,0x20AC,\u20AC,\u{1F600},€o€ - Incolla del testo per elencarne ogni carattere, inclusi quelli invisibili
- Mostra il nome, gli alias, il blocco, la categoria generale e lo script di ogni carattere
- Copia il carattere, i relativi byte UTF-8, le unità di codice UTF-16 e la codifica URL
- Copia l'entità HTML, inclusa l'entità denominata quando disponibile, oltre agli escape CSS e JavaScript
Come funziona
I nomi dei caratteri, i blocchi, le categorie e gli script provengono dall'Unicode Character Database, versione 18.0. I nomi che Unicode ricava dal punto di codice, come CJK UNIFIED IDEOGRAPH-4E00 e le sillabe Hangul, vengono costruiti nello stesso modo. I caratteri di controllo non hanno un nome proprio, quindi lo strumento mostra il relativo alias, come LINE FEED. Ai punti di codice senza un carattere viene assegnata un'etichetta, come <reserved-0378> o <private-use-E000>. I caratteri privi di un glifo visibile, come gli spazi e i caratteri di controllo, mostrano la relativa abbreviazione, mentre i segni combinabili vengono visualizzati su un cerchio tratteggiato. Tutto viene eseguito nel browser.
Suggerimenti
- Una parola di ricerca corrisponde all'inizio di una parola nel nome, quindi "arr" trova tutte le frecce.
- Incolla una stringa che appare errata per trovare caratteri nascosti, come uno spazio a larghezza zero (ZWSP) o uno spazio unificatore (NBSP).
- Se un carattere viene visualizzato come un riquadro vuoto, i font del dispositivo non lo includono. Il nome e i codici sono comunque corretti.
- In CSS, termina l'escape con uno spazio quando il carattere successivo è una cifra esadecimale, come in
content: "\20AC 5".