Dans la langue sur laquelle nous travaillons, certains affixes et clitiques sont séparés de la racine par des traits d'union. Ce trait d'union est défini dans les paramètres de la langue comme une ponctuation intra-mot.
Or, dans le champ Morphologie, Paratext fait parfois de mauvaises prédictions car il ignore ces traits d'union. Par exemple, il prédit la morphologie de ‹khøuwa-te› comme /khøuwat-e/. Bien que ‹khøuwat› et ‹-e› existent tous deux comme morphèmes, ici, le trait d'union devrait clairement indiquer que la morphologie doit être ‹khøuwa› et ‹-te›, qui sont également déjà définis comme morphèmes.
Existe-t-il un paramètre quelque part que je pourrais ajuster pour que le prédicteur de morphologie de Paratext ne traite pas toute chaîne de caractères contenant un trait d'union comme un seul morphème ?
Si ce n'est pas le cas, je vais suggérer cette fonctionnalité.
Merci,
rfkvg
In the language we work some affixes and clitics are separated from the stem by hyphens. This hyphen is defined in the language settings as word-medial punctuation.
Now in the Morphology field Paratext sometimes makes wrong guesses because it ignores such hyphens. For example, it guesses the morphology of ‹khøuwa-te› as /khøuwat-e/. Both ‹khøuwat› and ‹-e› do exist as morphemes, but here it should be clear because of the hyphen that the morphology should be ‹khøuwa› and ‹-te›, which are also already defined as morphemes.
Is there a setting anywhere I could adjust so that the Paratext Morphology guesser will not treat any character string with a hyphen in it as one morpheme?
If not, I’m going to suggest such a feature.
Thanks,
rfkvg