Zeichen und Bytes sind verschiedene Zahlen
Die Zählung mit Leerzeichen umfasst jedes Zeichen; die Zählung ohne Leerzeichen lässt Leerzeichen, Zeilenumbrüche und Tabulatoren weg. Bewerbungsformulare und Hausarbeiten mit Zeichenlimit geben meist die eine oder die andere vor, und beim selben Text unterscheiden sich die beiden Zahlen typischerweise um zehn bis zwanzig Prozent.
Bytes messen, wie viel Platz der Text beim Speichern oder Übertragen belegt. In UTF-8 belegen englische Buchstaben und Ziffern ein Byte, Buchstaben mit Akzent oder Umlaut wie é oder ü zwei, die meisten chinesischen, japanischen und koreanischen Zeichen drei und Emojis vier. Spaltenbreiten in Datenbanken und SMS-Limits werden meist in Bytes gezählt.
Die Wortzählung trennt an Leerräumen. Das passt zu Sprachen, die Wörter durch Leerzeichen trennen; Chinesisch und Japanisch tun das nicht, dort ist die Zeichenzahl die aussagekräftige Größe.
Ein Zeichenlimit genau treffen
Emojis und manche Symbole sehen wie ein einzelnes Zeichen aus, bestehen intern aber aus mehreren Codepunkten. Dieses Werkzeug zählt, was ein Leser als ein Zeichen wahrnimmt, das System, bei dem Sie einreichen, zählt aber womöglich anders – lassen Sie also etwas Spielraum, statt genau auf dem Limit zu landen.
Eingefügter Text bringt führende und nachgestellte Leerzeichen sowie Leerzeilen mit in die Zählung. Beim Kopieren aus einer Textverarbeitung bleiben häufig Leerzeichen am Zeilenende zurück – liegen Sie ein paar Zeichen über dem Limit, suchen Sie also nach unsichtbaren Leerräumen, bevor Sie etwas umschreiben.
Ein Zeilenumbruch ist auf manchen Systemen ein Zeichen, auf anderen zwei. Windows speichert ihn als zwei, ein Text mit vielen kurzen Zeilen belegt also mehr Bytes als erwartet. Das spielt eine Rolle, wenn Sie ein Byte-Limit statt eines Zeichenlimits einhalten müssen.