0 голосов
597 просмотров

У нас есть проект с частичным сопоставлением Unicode. Пользователь использует пользовательский шрифт, который отображает не-Unicode-символы для обычных значений Unicode.

В теме справки «В тексте моего проекта используется „пользовательский“ шрифт. Как мне конвертировать его в Unicode?» рекомендуется применить файл сопоставления (у нас он есть) и импортировать существующие книги в новый проект.

Однако также необходимо сконвертировать заметки проекта, возможно, некоторые Библейские термины и, возможно, другие файлы. В теме справки, похоже, не описано, как обрабатывать эти файлы.

Есть ли способ убедиться, что все эти файлы будут правильно сконвертированы? Будет ли «Convert Project» применять сопоставление к новым файлам?

Спасибо,

james_post

Переведено машиной с языка English
Paratext от [Moderator]
(2,1тыс. очков)
| 597 просмотров

3 Ответов

0 голосов
Лучший ответ

«Convert Project» не позволяет использовать файл сопоставления. Рекомендация состоит в том, чтобы конвертировать текстовые файлы внутри Paratext с помощью «Найти и заменить», а затем вручную выполнить «Найти и заменить» в других файлах (в основном это файлы .xml в папке проекта).
Другой вариант — использовать инструмент, такой как CC, где вы создаете таблицу (карту) изменений, которые необходимо внести, и затем применяете ее к различным файлам, которые нужно исправить. Скорее всего, это будут большинство файлов .xml в папке проекта. Преимущество CC заключается в том, что вы точно знаете, какие изменения вносятся. Поскольку это все необычные символы, не должно быть проблем с случайным повреждением файла.
Прежде чем выполнять какую-либо конвертацию этих файлов, я бы убедился, что есть хорошая резервная копия проекта.

Переведено машиной с языка English
от (9,9тыс. очков)

Похоже, для этой задачи лучше всего подходит проект транслитерации с использованием конвертеров кодировок. Преимущество здесь в том, что вы фактически не изменяете свой исходный проект и можете экспериментировать, внося любое количество регулярных изменений в проект, пока не добьетесь идеальной конвертации. Как только вы отработаете конвертацию, вы можете скопировать текст проекта транслитерации обратно в базовый проект и удалить проект транслитерации.
Недостаток заключается в том, что есть небольшой порог входа для использования конвертеров кодировок. Было бы хорошо получить помощь от опытного человека, чтобы сделать этот процесс как можно менее болезненным…

Переведено машиной с языка English

К сожалению, я не думаю, что проект транслитерации делает что-то большее, чем просто текст.

Переведено машиной с языка English

Я согласен, он не изменяет никакие маркеры USFM и не затрагивает непубликуемый текст, такой как строки \id и замечания \rem. Но он может изменить весь публикуемый текст во всех книгах, включая периферийные элементы, а также текст в сносках, заголовках и т. д. Если именно этого ищет @james_post, то, я думаю, это хороший вариант.

Переведено машиной с языка English
0 голосов

Если проект является Unicode (в Paratext) и проблема заключается в том, что определенные символы не имеют правильных кодовых точек, то вы должны сможете выполнить базовую операцию «Найти и заменить», чтобы изменить символы. Я бы установил подходящий шрифт Unicode, а затем внес необходимые изменения. Это не должно быть конвертацией, так как проект уже является Unicode.

​Благословений,

Переведено машиной с языка English
от (9,9тыс. очков)

Я понимаю, откуда вы, но меня больше беспокоят вспомогательные файлы (а не основные файлы SFM). Хотя, я полагаю, мы могли бы также выполнить «Найти и заменить» и в них.

При этом я не уверен, в каких именно файлах нужно внести изменения…

Кроме того, если бы это было возможно через «Convert Project», это сохранило бы историю проекта. Но в данном случае это, возможно, невозможно.

Спасибо,

james_post

Переведено машиной с языка English
0 голосов

Я думаю, james_post хочет, чтобы изменения включали PT Notes, рендеринг Библейских терминов, записи в Wordlist (включая морфологию) и т. д.
Я думаю, что они в основном хранятся в файлах xml, которые можно редактировать напрямую, если у вас есть на это смелость. Но может ли кто-нибудь однозначно сказать, что произойдет с решениями и утверждениями, связанными с этими инструментами?

Переведено машиной с языка English
от (673 очков)

Тот же файл TechKit, который изменяет файлы sfm, можно также использовать для изменения XML-файлов управления, включая файлы Wordlist, Parallel passages и Biblical Terms, а также файлы Notes и другие файлы, которые вы можете захотеть обновить. Инструменты конвертера кодировок включают конвертер данных XML, который должен помочь. Таким образом, это технически осуществимо и позволит избежать необходимости повторять эти проверки целиком, хотя из-за конвертации могут возникнуть некоторые законные ошибки.
При этом это займет время, и потребуется человек, хорошо разбирающийся в инструменте и в том, какие файлы нужно изменить. Например:

  • Я бы экспортировал Wordlist в один XML-файл, выполнил бы конвертацию в нем и повторно импортировал его, а не работал с тремя файлами управления Wordlist (hyphenatedWord.txt, SpellingStatus.xml и WordAnalysis.xml).
  • Для заметок вы должны изменять только поля <SelectedText>, <ContextBefore> и <ContextAfter>, а не <Contents> (как я предполагаю)
  • Если у вас есть интерлинейные тексты, это будет еще один уровень сложности, в котором я не очень разбираюсь
Переведено машиной с языка English

Похожие вопросы

0 голосов
3 ответов 459 просмотров
У кого-нибудь ещё возникала такая проблема, и знаете ли вы решение? Я использую Paratext 9.3.103.7 и Keyman 16.0.138. ... , что это из-за того, что я только что включил Keyman.
bbrollier 245 задал вопрос фев 20, 2023
0 голосов
0 ответов 189 просмотров
This week I discovered that Alt-X does work for Unicode characters where the code is longer than 4 hex digits. The ... desired character when typing two periods: ..-->\ud804\udf
[Expert]
sewhite
3,3тыс.
задал вопрос авг 16, 2019
+1 голос
0 ответов 161 просмотров
Some Unicode characters have a code longer than 4 hex digits. For instance David Rowe was trying to help someone ... on that character gives the UTF16 coding equivalent for it.
[Expert]
sewhite
3,3тыс.
задал вопрос мар 18, 2019
0 голосов
1 ответ 265 просмотров
Hi all, I am working on migrating a user to Paratext 8 and noticed that their translation project is still in Western European ... , web, or Scripture app)? Thank you, SIL+LSS+PNG
SIL LSS PNG 411 задал вопрос дек 4, 2018
0 голосов
2 ответов 398 просмотров
We are working with a language that has long vowels which we can't write with Odia letters. There are some books printed ... type it neither we know the Unicode of it. please help
anon480013 162 задал вопрос окт 1, 2018
Welcome to Support Bible, where you can ask questions and receive answers from other members of the community.
How good and pleasant it is when God’s people live together in unity!
Psalm 133:1
3,048 вопросов
6,007 ответов
5,672 комментариев
2,028 пользователей