Ceci est probablement plus de détails que vous ne voulez en avoir, mais voici mon point de vue sur les problèmes de normalisation de l'hébreu. Unicode a mis au point un ordre canonique des diacritiques qui n'était pas idéal sur le plan linguistique. Comme l'ordre des diacritiques entre les diacritiques non interactives peut être arbitraire, ils ont décidé de ne pas changer l'ordre lorsqu'on leur a demandé. Mais il y a certaines situations où l'ordre est important pour les diacritiques interactives en hébreu et cet ordre est perdu par la normalisation. Pour contourner cela, les gens utilisent le CGJ (U+034F) pour permettre un ordre différent des diacritiques. Cela devrait être considéré comme faisant partie de l'orthographe du mot.
Tandis que tout cela était débattu, les polices de caractères n'étaient souvent pas conçues pour gérer l'ordre canonique Unicode. Mais cela a été corrigé depuis longtemps et les polices peuvent gérer le texte ordonné canoniquement par Unicode sans problème.
Tout cela pour dire que je ne vois aucune raison pour laquelle les données ne devraient pas être stockées dans une forme normale Unicode (NFC, NFD que je pense identiques en hébreu), mais que si vous avez des données héritées (anciennes données Unicode), il faut faire attention à la normalisation. En particulier, vérifiez le mot pour Jérusalem (si ma mémoire floue me sert, à propos des mots qui contiennent des problèmes d'ordre des diacritiques) qui devrait contenir un CGJ (ou examiné attentivement avec une représentation visuelle devant vous).
Quant à l'exemple de Lorna, il ne devrait y avoir aucune difficulté avec ces deux diacritiques car ils sont non interactifs (l'un au-dessus, l'autre en dessous).
This is probably more detail than you want to have, but here is my take on the Hebrew normalization issues. Unicode came up with a canonical diacritic order which was not ideal linguistically. Since diacritic order between non-interacting diacritics can be arbitrary, they decided to not change the order when asked. But there are some situations where order is important for interacting diacritics in Hebrew and that order is lost by normalization. To get around this, people use the CGJ (U+034F) to allow for a different diacritic ordering. This should be considered part of the spelling of the word.
While all this was being thrashed out, fonts were often not designed to handle the Unicode canonical order. But that has long been fixed and fonts can handle Unicode canonically ordered text just fine.
All this to say that I see no reason why data shouldn’t be stored in either Unicode normal form (NFC, NFD which I think are identical in Hebrew), but that if you have some legacy data (old Unicode data) then care should be taken in the normalization. In particular check the word for Jerusalem (IIRC from my foggy memory about words that contain diacritic ordering issues) which should contain a CGJ (or looked at carefully with a visual representation in front of you).
As to Lorna’s example, there should be no difficulty with those two diacritics since they are non-interacting (one above one below).
Traduit automatiquement depuis English