341 outils gratuits, sans inscription ni installation, tout se passe dans votre navigateur.
341 outils gratuits, sans inscription ni installation, tout se passe dans votre navigateur.
Code point, UTF-8, HTML entity et plus
Chaque caractère a un numéro, son point de code, et plusieurs écritures selon le contexte : entité HTML, séquence d'octets UTF-8, notation hexadécimale. Cet outil les donne toutes pour un caractère, ou décompose un texte entier caractère par caractère. C'est ce qu'on ouvre devant un caractère qui s'affiche mal, une apostrophe qui n'est pas celle qu'on croit, ou une espace qui n'en est pas une. Chaque valeur se copie d'un clic, avec une confirmation visible. Tout est calculé dans le navigateur, sans table distante.
À désigner un caractère sans dépendre d'une police ni d'un encodage. C'est ce qu'on cite dans un rapport de bogue ou dans une documentation : dire « U+202F » lève toute ambiguïté, là où « une petite espace » n'en lève aucune.
Parce qu'Unicode admet des formes composées et décomposées : « é » peut être un caractère unique ou la lettre « e » suivie d'un accent combinant. Les deux s'affichent pareil et ne sont pas égales pour un programme. Cet outil montre la différence immédiatement, en nombre de caractères comme en octets.
Le point de code est le numéro du caractère, les octets sont sa représentation dans un fichier. U+20AC, l'euro, s'écrit sur trois octets en UTF-8. C'est la confusion la plus fréquente quand une chaîne semble deux fois trop longue.
Un résultat qui vous paraît faux, une valeur périmée, un cas qui manque ? Signalez-le à contact@topapps.fr