Qu’est-ce qu’Unicode ?
Unicode est la norme universelle de codage de caractères qui attribue un point de code unique à chaque caractère dans tous les systèmes d'écriture, symboles et emoji. Chaque caractère a un point de code (comme U+0041 pour 'A'), un nom, un bloc Unicode et une catégorie générale. Cet outil vous permet d'inspecter n'importe quel texte caractère par caractère ou de rechercher des caractères par leur point de code.
Comment utiliser cette recherche Unicode
- 1En mode Inspect Text, saisissez ou collez du texte pour afficher des informations détaillées sur chaque caractère.
- 2En mode Lookup by Code Point, entrez un point de code (U+1F600, 0x41 ou 65) pour rechercher le caractère.
- 3Cliquez sur n’importe quel glyphe de caractère pour le copier dans votre presse-papiers.
- 4Affichez les représentations d'octets UTF-8 et UTF-16, les entités HTML, le bloc Unicode et la catégorie.
Cas d'utilisation courants
Débogage des problèmes d'encodage
Inspectez le texte mystérieusement cassé pour identifier les mauvais points de code, les caractères invisibles ou les incohérences d'encodage.
Trouver des caractères spéciaux
Recherchez un point de code Unicode pour rechercher et copier le caractère correspondant (symboles, flèches, opérateurs mathématiques).
Comprendre l'encodage du texte
Découvrez comment les caractères sont codés dans les séquences d'octets UTF-8 et UTF-16.
Questions fréquentes
Qu’est-ce qu’un point de code Unicode ?
Un point de code est un numéro unique attribué à chaque caractère dans la norme Unicode, écrit sous la forme U+ suivi d'un nombre hexadécimal (e.g., U+0041 pour 'A'). La plage complète va de U+0000 à U+10FFFF.
Quelle est la différence entre UTF-8 et UTF-16 ?
UTF-8 utilise 1 à 4 octets par caractère (1 octet pour ASCII). UTF-16 utilise 2 ou 4 octets. UTF-8 est le codage dominant sur le Web ; UTF-16 est utilisé en interne par JavaScript et Windows.
Cet outil peut-il afficher les noms de caractères pour tous les caractères Unicode ?
Les caractères courants (latin, chiffres, ponctuation) indiquent leur nom Unicode officiel. Pour les caractères moins courants, le point de code est affiché. L'outil couvre tous les points de code valides de U+0000 à U+10FFFF.