अक्षर और बाइट दो अलग संख्याएँ हैं
खाली जगह सहित गिनती हर अक्षर को गिनती है; खाली जगह रहित गिनती खाली जगह, नई पंक्तियाँ और टैब हटा देती है। सीमा तय करने वाले आवेदन पत्र और असाइनमेंट आमतौर पर इनमें से एक बताते हैं, और एक ही पाठ के लिए दोनों आँकड़े आमतौर पर दस से बीस प्रतिशत अलग होते हैं।
बाइट बताते हैं कि सहेजने या भेजने में लिखावट कितनी जगह लेती है। UTF-8 में अंग्रेज़ी अक्षर और अंक एक बाइट, é जैसे अक्षर दो, देवनागरी और ज़्यादातर चीनी, जापानी व कोरियाई अक्षर तीन और इमोजी चार बाइट लेते हैं। डेटाबेस के कॉलम और SMS की सीमा आमतौर पर बाइट में गिनी जाती है।
शब्द रिक्त स्थान से अलग करके गिने जाते हैं। यह उन भाषाओं पर ठीक बैठता है जो शब्दों के बीच जगह छोड़ती हैं; चीनी और जापानी ऐसा नहीं करतीं, इसलिए उनके लिए अक्षरों की गिनती ज़्यादा काम की है।
अक्षर सीमा पर ठीक-ठीक बैठना
इमोजी और कुछ चिह्न एक अक्षर जैसे दिखते हैं पर भीतर से कई कोड बिंदुओं से बने होते हैं। यह औजार वही गिनता है जिसे पाठक एक अक्षर मानता है, जबकि जिस तंत्र में आप भेज रहे हैं वह और तरीके से गिन सकता है, इसलिए सीमा पर ठीक-ठीक बैठने की जगह कुछ गुंजाइश छोड़ें।
चिपकाया हुआ पाठ शुरू और अंत की खाली जगहें तथा खाली पंक्तियाँ भी गिनती में ले आता है। वर्ड प्रोसेसर से नकल करने पर अक्सर पंक्तियों के अंत में खाली जगह छूट जाती है, इसलिए कुछ अक्षर ऊपर जा रहे हों तो कुछ भी दोबारा लिखने से पहले अदृश्य खाली जगह ढूँढ़ें।
नई पंक्ति कुछ तंत्रों में एक अक्षर है और कुछ में दो। विंडोज उसे दो के रूप में रखता है, इसलिए छोटी-छोटी पंक्तियों वाला पाठ उम्मीद से ज्यादा बाइट लेता है। यह तब मायने रखता है जब पूरी करनी वाली सीमा अक्षरों की नहीं, बाइट की हो।