• [^] # Re: Trouver facilement le code UTF8 d'un caractère

    Posté par . En réponse au journal Écrire un texte dans des systèmes d’écriture différents. Évalué à 4 (+2/-0). Dernière modification le 20 mai 2026 à 09:35.

    Au fait, pour ceux qui utilisent ctrl-u+code, unum, petit utilitaire en CLI, est bien sympa pour trouver quel est le code utf8 d'un caractère par le nom ou par le caractère lui-même sans avoir à consulter les tables UTF8 ou faire une recherche web. Exemple :

    unum n=space | grep -i break
     0240 160 0xA0   "\x{A0}" NO-BREAK SPACE
     020057 8239 0x202F   " " NARROW NO-BREAK SPACE
     0177377 65279 0xFEFF  "" ZERO WIDTH NO-BREAK SPACE
    unum タ 
     Octal Decimal Hex HTML Character Unicode
     030277 12479 0x30BF タ "タ" KATAKANA LETTER TA
    unum 안녕하세요
     Octal Decimal Hex HTML Character Unicode
     0142510 50504 0xC548 안 "안" HANGUL SYLLABLE U+110B AN
     0130525 45397 0xB155 녕 "녕" HANGUL SYLLABLE NYEONG
     0152530 54616 0xD558 하 "하" HANGUL SYLLABLE HA
     0140470 49464 0xC138 세 "세" HANGUL SYLLABLE SE
     0143224 50836 0xC694 요 "요" HANGUL SYLLABLE U+110B YO

    Voir le site (ou exécuter unum sans argument) pour toutes les possibilités.