Explorateur de caractères Unicode
Parcourez chaque bloc de caractères Unicode ou effectuez une recherche par nom, point de code ou texte collé. Consultez le nom, la catégorie, le script et le bloc de chaque caractère, puis copiez-le au format UTF-8, UTF-16, en entité HTML ou sous forme d'échappement CSS, JavaScript ou URL. Fonctionne dans votre navigateur.
Documentation
Qu'est-ce qu'un caractère Unicode ?
Unicode attribue à chaque caractère de chaque système d’écriture un nombre, appelé point de code, écrit sous la forme U+ suivi de chiffres hexadécimaux. A correspond à U+0041, € à U+20AC et 😀 à U+1F600. Chaque caractère possède également un nom officiel, comme EURO SIGN, et appartient à un bloc : une plage de points de code regroupant des caractères apparentés, comme Basic Latin, Cyrillic ou Emoticons. Unicode peut contenir 1 114 112 points de code, dont plus de 150 000 sont attribués à des caractères.
Description de l'outil
Cet outil vous permet de parcourir l'ensemble des caractères Unicode, un bloc à la fois, comme dans une table de caractères. Sélectionnez un bloc pour afficher ses caractères dans un tableau, ou effectuez une recherche par nom, point de code ou texte collé. Cliquez sur un caractère pour afficher ses détails et le copier, ou copier l'un de ses encodages. Utilisez-le pour trouver un symbole que vous ne pouvez pas saisir, identifier un caractère inconnu ou rechercher le code d'échappement à utiliser dans votre HTML, CSS ou JavaScript.
Fonctionnalités
- Parcourir tous les blocs Unicode, de Basic Latin aux zones à usage privé
- Rechercher des mots dans le nom, comme « arrow left » ou « grinning face »
- Accéder directement à un point de code écrit sous la forme
U+20AC,0x20AC,\u20AC,\u{1F600},€ou€ - Coller du texte pour répertorier chacun de ses caractères, y compris les caractères invisibles
- Afficher le nom, les alias, le bloc, la catégorie générale et l'écriture de chaque caractère
- Copier le caractère, ses octets UTF-8, ses unités de code UTF-16 et son encodage d’URL
- Copier l'entité HTML, avec l'entité nommée lorsqu'elle existe, ainsi que les échappements CSS et JavaScript
Fonctionnement
Les noms de caractères, les blocs, les catégories et les écritures proviennent de la base de données des caractères Unicode, version 18.0. Les noms qu'Unicode dérive du point de code, comme CJK UNIFIED IDEOGRAPH-4E00 et les syllabes Hangul, sont construits de la même manière. Les caractères de contrôle n'ont pas de nom propre ; l'outil affiche donc leur alias, comme LINE FEED. Les points de code sans caractère reçoivent un libellé, comme <reserved-0378> ou <private-use-E000>. Les caractères sans glyphe visible, comme les espaces et les caractères de contrôle, affichent leur abréviation, et les signes combinatoires sont représentés sur un cercle en pointillés. Tout s'exécute dans votre navigateur.
Conseils
- Un mot recherché correspond au début d'un mot dans le nom ; ainsi, « arr » trouve toutes les flèches.
- Collez une chaîne qui semble incorrecte pour trouver les caractères masqués, comme une espace sans chasse (ZWSP) ou une espace insécable (NBSP).
- Si un caractère s'affiche sous la forme d'un carré vide, les polices de votre appareil ne l'incluent pas. Le nom et les codes restent corrects.
- En CSS, terminez l'échappement par une espace lorsque le caractère suivant est un chiffre hexadécimal, comme dans
content: "\20AC 5".