Caractères et octets sont deux nombres distincts
Le compte avec espaces inclut chaque caractère ; le compte sans espaces retire espaces, retours à la ligne et tabulations. Les formulaires et les devoirs qui imposent une limite précisent généralement l'un ou l'autre, et pour un même texte les deux chiffres diffèrent de dix à vingt pour cent.
Les octets mesurent la place du texte au stockage ou à l'envoi. En UTF-8, les lettres anglaises et les chiffres prennent un octet, les lettres accentuées comme é deux, la plupart des caractères chinois, japonais et coréens trois, et les emoji quatre. Les largeurs de colonne des bases de données et les limites des SMS se comptent souvent en octets.
Le nombre de mots se calcule sur les espaces. Cela convient aux langues qui séparent les mots par des espaces ; le chinois et le japonais ne le font pas, et pour eux le nombre de caractères est plus utile.
Atteindre exactement une limite de caractères
Les émojis et certains symboles ressemblent à un seul caractère mais sont composés en interne de plusieurs points de code. Cet outil compte ce que le lecteur voit comme un caractère, tandis que le système auquel vous soumettez peut compter autrement, alors gardez une marge plutôt que de viser exactement la limite.
Le texte collé traîne avec lui des espaces en début et en fin ainsi que des lignes vides. Copier depuis un traitement de texte laisse souvent des espaces en fin de ligne, alors si vous dépassez de quelques caractères, cherchez des blancs invisibles avant de réécrire quoi que ce soit.
Un retour à la ligne compte pour un caractère sur certains systèmes et deux sur d'autres. Windows l'enregistre sur deux, si bien qu'un texte à lignes courtes occupe plus d'octets que prévu. Cela importe quand la contrainte à respecter est exprimée en octets et non en caractères.