Это, вероятно, больше деталей, чем вам хотелось бы знать, но вот мое мнение по вопросам нормализации иврита. Unicode разработал канонический порядок диакритических знаков, который был не идеален с лингвистической точки зрения. Поскольку порядок диакритических знаков между не взаимодействующими диакритическими знаками может быть произвольным, они решили не менять порядок, когда их об этом просили. Но есть некоторые ситуации, когда порядок важен для взаимодействующих диакритических знаков в иврите, и этот порядок теряется при нормализации. Чтобы обойти это, люди используют CGJ (U+034F), чтобы разрешить другой порядок диакритических знаков. Это следует рассматривать как часть написания слова.
Пока все это обсуждалось, шрифты часто не были спроектированы для обработки канонического порядка Unicode. Но это давно исправлено, и шрифты прекрасно справляются с текстом в каноническом порядке Unicode.
Все это к тому, что я не вижу причин, по которым данные не должны храниться в любой из нормальных форм Unicode (NFC, NFD, которые, я думаю, идентичны в иврите), но если у вас есть устаревшие данные (старые данные Unicode), то при нормализации следует проявлять осторожность. В частности, проверьте слово «Иерусалим» (по моему туманному воспоминанию о словах, содержащих проблемы с порядком диакритических знаков), которое должно содержать CGJ (или внимательно посмотрите на визуальное представление перед вами).
Что касается примера Лорны, с этими двумя диакритическими знаками не должно быть проблем, поскольку они не взаимодействуют (один сверху, один снизу).
This is probably more detail than you want to have, but here is my take on the Hebrew normalization issues. Unicode came up with a canonical diacritic order which was not ideal linguistically. Since diacritic order between non-interacting diacritics can be arbitrary, they decided to not change the order when asked. But there are some situations where order is important for interacting diacritics in Hebrew and that order is lost by normalization. To get around this, people use the CGJ (U+034F) to allow for a different diacritic ordering. This should be considered part of the spelling of the word.
While all this was being thrashed out, fonts were often not designed to handle the Unicode canonical order. But that has long been fixed and fonts can handle Unicode canonically ordered text just fine.
All this to say that I see no reason why data shouldn’t be stored in either Unicode normal form (NFC, NFD which I think are identical in Hebrew), but that if you have some legacy data (old Unicode data) then care should be taken in the normalization. In particular check the word for Jerusalem (IIRC from my foggy memory about words that contain diacritic ordering issues) which should contain a CGJ (or looked at carefully with a visual representation in front of you).
As to Lorna’s example, there should be no difficulty with those two diacritics since they are non-interacting (one above one below).