0 голосов
837 просмотров

Я пытаюсь доработать конвертер кодировок .tec, чтобы он был безопасен для многократного применения (round trip) при транслитерации с языка, пишущегося справа налево (RTL), на латиницу (LTR). (Это позволяет сравнивать результат с оригиналом, чтобы убедиться, что изменения орфографии в латинской записи не привели к изменениям в тексте.)

Главное препятствие здесь — RTL-знаки, которые появляются после двоеточий и дефисов в ссылках на стихи. Конечно, легко удалить RTL-знаки при переходе с RTL на LTR; но их вставка при обратном переходе требует более тщательной настройки. Я могу сделать это с помощью регулярного выражения, но я хотел бы автоматизировать этот процесс для тех, кто не знаком с RegexPal.

Есть ли какие-либо предложения, как это сделать?

Переведено машиной с языка English
Paratext от (175 очков) | 837 просмотров

3 Ответов

0 голосов
Лучший ответ

Мне странно, что остальная часть моего письма была удалена. Вот три вещи, которые стоит попробовать:

  1. Я не вижу разметки \ior…\ior* на вашем скриншоте. Попробуйте добавить ее вокруг ваших ссылок в исходном проекте. Вы должны использовать ее в любом случае для правильного форматирования.
  2. Попробуйте переключаться между различными видами отображения – со стандартного на неформатированный и обратно в вашем главном текстовом окне Paratext. Это может заставить Paratext добавить такие элементы.
  3. Возможно, это происходит потому, что конвертированный проект по дизайну не редактируется, и поэтому сам Paratext его не редактирует. Попробуйте создать вспомогательный проект и импортировать в него конвертированный текст, чтобы увидеть, произойдет ли изменение. Это, на самом деле, хорошая практика в любом случае, потому что часто есть ряд вещей, которые вы хотите сделать с проектом вручную перед публикацией, которые вы не можете сделать с исходным, не редактируемым конвертированным проектом.
Переведено машиной с языка English
от (1,3тыс. очков)

Спасибо еще раз, Shegnada.

  1. Paratext не позволяет мне вставить \ior в исходный проект. Я могу добавить его в транслитерированный проект, но тогда последовательность чисел отображается полностью LTR, а не смешанно.

  2. Я переключил все виды отображения, а также все три варианта в Project Advanced/Normalization (я не понимаю, что это такое, но это была настройка, которую я не узнал, поэтому подумал, что она может быть связана.)

  3. BHDyMT2L уже является редактируемым вспомогательным проектом.

Я попробовал еще несколько вещей:
a) Я попробовал перепечатать некоторые последовательности чисел, но это ничего не изменило
b) Я попробовал вручную добавить RTL-маркеры к определенным последовательностям чисел в BHDyMT2L, но они, похоже, не «прилипали»; панель сравнения по-прежнему показывала RTL на стороне BHD, и отсутствовала на стороне BHDyMT2L.
c) Я попробовал щелкнуть правой кнопкой мыши по различию и выбрать «revert change», но это тоже ничего не сделало

Наконец, я закрыл PT 9 и открыл PT 8 (который хотел выполнить обновление, что я разрешил) и открыл окно Compare, снова с BHDyMT2L слева и BHD справа. Теперь я видел много СЛОВ, подсвеченных как будто они различаются, но не мог увидеть никакой видимой разницы между ними, даже с включенным «show invisible characters». Но я выбрал одно из числовых различий, щелкнул по нему правой кнопкой мыши, выбрал «revert text» и, о чудо, ВСЕ числовые различия исчезли. Различия в словах не исчезли (если я не сделал правый щелчок-revert text по ним). но решил попробовать снова в PT 9. В этот раз я открыл панель Compare с BHD слева. Теперь единственными различиями, которые отображаются, являются реальные различия, которые я искал с самого начала, и ряд (похоже) случайных мест, где в BHD есть RTL-знаки ПОСЛЕ числа, и они не позволяют мне удалить их.

Так что: на данный момент, действительно кажется, что Paratext наконец решил вставлять RTL-знаки в ссылках вспомогательного проекта на основе транслитерации; но путь, которым он пришел к этому, все еще слишком странный, чтобы быть полезным…

-DVM

Переведено машиной с языка English

Я бы попросил о помощи через Give Feedback в меню Help. Извините.

Благословений,

Переведено машиной с языка English

Пожалуйста, объясните, что происходит, когда вы пытаетесь добавить разметку \ior. Становится ли разметка красной? Не отображаются ли ссылки неправильно каким-то другим образом? Возможно, вам просто нужно подстроить ваш стиль-лист.

Переведено машиной с языка English

Я попробовал снова, и в этот раз мне удалось вставить \ior. Они были красными, потому что следовали за \io1, что, как я вижу, теперь должно быть просто \io. Я изменил \io1 на \io и добавил \ior…\ior* вокруг ссылок во введении к книге MAT.

Это не сразу, казалось, изменило отображение ссылок, хотя сегодня RTL-маркеры, похоже, присутствовали. «Сравнение версий» двух проектов не показало различий, но при визуальном сравнении порядок чисел после двоеточия или дефиса в транслитерированном проекте все еще был обратным.

Я попробовал скопировать настройки Scripture Reference из исходного проекта, а затем выполнил «Copy Books» из обратно-транслитерированного проекта (BHDxMT2L) во вспомогательный проект BHDyMT2L). Теперь ссылки в обоих проектах отображаются правильно(!)

Но по какой-то причине транслитерированные проекты не любят наличие буквенного разделителя между диапазоном глав. Прилагаю скриншот, если вам интересно…

Переведено машиной с языка English
0 голосов

Здравствуйте, DVM,

Paratext автоматически вставляет эти символы. На самом деле, от них очень трудно избавиться, если вы не хотите их видеть. Вы проверили, что автоматическая вставка не работает? Ключевым моментом может быть обеспечение того, чтобы все ссылки были правильно помечены как ссылки с использованием \r \ior или \xt…\xt*. Я полагаю, что есть еще несколько вариантов, но эти — самые распространенные.

Благословений,

Переведено машиной с языка English
от (1,3тыс. очков)
снова показан

Здравствуйте, Shegnada,

Пожалуйста, посмотрите на прилагаемый скриншот: BHDxMT2L был создан путем запуска конвертера кодировок на транслитерации BHD, скорректированной вручную. Как вы можете видеть, есть различия (RTL-знаки) во всех числовых выражениях, содержащих двоеточия или дефисы, включая те, что следуют за \r и \fr.

Когда я тестировал это несколько месяцев назад (и, возможно, до перехода на PT 9?), я помню, что Paratext действительно вставлял RTL-знаки. Подумав, что это не будет проблемой, я продолжил и удалил RTL-знаки из транслитерации на латинице. Но теперь, когда я наконец дошел до этапа, когда мне нужно сравнение, Paratext, похоже, больше этого не делает. Возможно, есть способ отключить или включить эту вставку?

Переведено машиной с языка English

Уважаемый DVM,

Я не заметил никакого нового поведения в этом отношении в версии 9.1, хотя мы в прошлом запрашивали больше контроля над этими символами, и, возможно, они отреагировали. Вы можете проверить это, попробовав вручную добавить или удалить символы в проекте RTL, не являющемся конвертированным.

Но есть три вещи, которые вы можете проверить, прежде чем сообщать о проблеме через «Feedback» в меню Help.

Переведено машиной с языка English
0 голосов

Я не знаю, поможет ли это, но если вы используете RTL-знаки специально для ссылок на Писание (например: Иоанн 2:1), я обнаружил, что наиболее надежное решение — иметь пробел рядом с двоеточием. На английском это было бы «John 2: 1». Это упорядочивает номер главы и номер стиха в том порядке, который вы ожидаете, на основе направления окружающего текста. Некоторые арабские стилистические руководства рекомендуют это.

Переведено машиной с языка English
от (495 очков)

Спасибо за это предложение. Я полагаю, что было бы возможно добавить пробелы, хотя нам нужно исследовать приемлемость этого для читателей. Люди, похоже, довольны текущим форматом опубликованной версии, в которой нет пробела после двоеточия (или дефиса, который также влияет на направление чисел).

Переведено машиной с языка English

DVM,

Если добавление пробела решает вашу проблему, вам не нужно беспокоиться о выводе. Во многих форматах вывода вы можете сделать его очень, очень тонким пробелом, и никто его не заметит. Но я бы сказал, что очень важно, чтобы в Paratext все ваши ссылки проходили валидацию, чтобы они могли быть превращены в ссылки при онлайн-публикации. Я не могу ответить вам напрямую, но знаю кого-то, кто может проконсультировать вас по вашему маппингу и хорошо разбирается в вопросах RTL. Если вы напишете мне напрямую, я отвечу с их контактами.

Переведено машиной с языка English

Да, я боюсь, что добавление пробелов в формате ссылок может усложнить валидацию. Быстрый тест, который я только что провел, не обещал ничего хорошего: диалоговое окно Scripture References принимало комбинацию двоеточия и пробела как разделитель главы-стиха, но в тексте она помечается как недействительная.

Тем временем я провел некоторые эксперименты и смог найти воспроизводимый путь, чтобы заставить Paratext вставлять RTL-знаки: мне нужно настроить настройки Scripture Reference (что я сделал, скопировав из исходного проекта). Если я создам новый транслитерированный проект с латиницы на арабские цифры, Paratext не вставит RTL-знаки, пока я не выполню этот шаг. Так что, похоже, это ключевой момент. Я не знаю, почему это должно быть так, но было бы хорошо, чтобы это было задокументировано в меню справки.

Но предложение вставить пробел дало мне идею для транслитерации с арабского на латиницу. Я добавил строку в файл .tec, которая изменяет RTL-знак на zero_width_space (U+220B). Это заставляет ссылки в латинском тексте отображаться правильно. Кажется, это работает и в обратную сторону, но это не очень важно. Латинский текст в этом случае предназначен для чтения консультантом и не будет опубликован.

Так что, я думаю, у нас есть рабочее решение для обоих направлений транслитерации. Спасибо за все ваши комментарии!

Переведено машиной с языка English

«Диалоговое окно Scripture References принимало комбинацию двоеточия и пробела как разделитель главы-стиха, но в тексте она помечается как недействительная.»

Вы должны проверить ваши списки символов и пунктуации. Возможно, двоеточие или последовательность «двоеточие-пробел» помечены как недействительные там. У вас должна быть проблема только в том случае, если последовательность «двоеточие-пробел» незаконна в других типах текста.

Благословений,

Переведено машиной с языка English

Оказалось, что когда я заменил RTL на пробел в поиске и замене, он поставил пробел перед двоеточием. Когда я поменял их местами, ссылки отображаются как действительные.

Так что да, похоже, на данный момент использование пробела будет жизнеспособным вариантом.

Переведено машиной с языка English

Похожие вопросы

0 голосов
1 ответ 210 просмотров
We have a user who is doing a transliteration from one script in a language to another script in the same language. ... has the reference number of PTXS-17276 Thank you, MSEAIT/LT
MSEAIT_LT 478 задал вопрос авг 3, 2018
0 голосов
1 ответ 334 просмотров
В проекте, которому я оказываю техническую поддержку, по всему тексту разбросаны RTL-знаки там, где им не место. Проект ... , базовые проверки (Basic Checks) не выявляли RTL-знаки.
[Moderator]
Nathaniel Paulus
158
задал вопрос май 24, 2023
0 голосов
1 ответ 56 просмотров
В проекте Paratext с поддержкой RTL я не нашёл ни одной комбинации настроек ссылок на Писание, текста стихов и ... должен же быть способ, чтобы Paratext делал это правильно?
Denny Emser 115 задал вопрос 2 дней назад
0 голосов
3 ответов 328 просмотров
We just recently migrated a set of parallel Roman/Arabic script projects. Note that the parallel is manual , not a PT8 ... problem anyway. I'd appreciate any help you can give me.
jeffh 1,4тыс. задал вопрос авг 28, 2017
0 голосов
2 ответов 573 просмотров
In a right-to-left project, if I type a verse range in a footnote, e.g. 1-2 , Paratext inserts an invisible RTL marker ... make the Numbers check pass? (I'm using 7.6 for Linux.)
anon261123 180 задал вопрос окт 5, 2016
Welcome to Support Bible, where you can ask questions and receive answers from other members of the community.
I urge you, brothers and sisters, to watch out for those who cause divisions and put obstacles in your way that are contrary to the teaching you have learned. Keep away from them.
Romans 16:17
3,049 вопросов
6,007 ответов
5,672 комментариев
2,029 пользователей