После того как я углубился в трудоёмкие и загромождающие текст требования по разметке Слов Иисуса с помощью \wj … \wj*, чтобы создать пользовательский инструмент Paratext для их применения к проекту Paratext (в соответствии с назначением персонажей в связанном проекте Glyssen), я начал мечтать о системе разметки, которая была бы более интуитивно понятной для переводчика.
Вот в чём моя претензия к системе разметки \wj … \wj*: она спроектирована для удобства программного обеспечения рендеринга, а не для удобства переводчика. Чтобы успешно применить эти метки, вы должны закрывать и открывать их заново при каждом номере стиха. И при каждом переносе абзаца. А затем вам нужно добавлять символ плюса (+) к каждой метке слова/символа внутри них, например +w …+w* и +nd …+nd*.
Больше всего меня удивляет то, что если вы хотите пройти проверку меток, вам даже нужно закрывать и открывать метки заново при каждой сноске!! Действительно ли это необходимо, или проверка меток генерирует все эти предупреждения зря?
Это заставило меня задуматься о том, что переводчику на самом деле нужен способ просто отметить, где говорящий начинает и прекращает говорить, не обращая внимания на парабиблейский контент или проблемы с форматированием. Это также важно для отслеживания говорящих при записи аудио с несколькими голосами, поскольку правки текста могут всё перепутать, и Glyssen придётся заново синхронизировать.
Поэтому я был рад познакомиться с функцией milestones (контрольных точек) в USFM3, которая предназначена именно для этой цели. Но теперь у меня возникло ещё больше вопросов…
Во-первых, заменит ли это разметку \wj? Если проект, использующий метки \qt-s …\qt-e, хочет издать «красные буквы», нужно ли будет дополнительно добавить разметку \wj? Это кажется таким избыточным и запутанным.
Во-вторых, можем ли мы предположить, что парабиблейские поля, такие как \s, \r и \f, подобно \x, являются внутренними исключениями для активной метки \qt-s? То есть вы могли бы поставить \qt-s |who=Jesus* в начале Нагорной проповеди и \qt-e* в конце, и всё было бы готово. Одна пара меток вместо 120 или более, в зависимости от абзацев и сносок, не говоря уже о том, что нет необходимости возиться с вложенностью терминов, размеченных по словарю. Кажется, что то, что компьютер может определить автоматически (чтобы вывести красные буквы), не должно загромождать текст избыточными метками.
В-третьих, каковы лучшие практики для атрибута «who»? Будут ли инструменты ожидать, что это будут английские имена/описания, такие как «Jesus» (Иисус) и «spies from Pharisees and Herodians» (шпионы от фарисеев и иродеев)? Должны ли это быть те же имена персонажей, которые используются в Glyssen?
В-четвёртых, в какой степени следует размечать эти места в контекстах, где нет необходимости в уточнении? В некоторых стихах Иисус — единственный персонаж, который мог бы говорить, тогда как в других говорит более одного человека, и уточнение действительно необходимо. Лучше ли не загромождать текст чрезмерной разметкой говорящих в таких случаях?
Хорошо, это все мои вопросы на данный момент.
Я также был бы заинтересован в тестировании моего инструмента разметки WordsOfJesus на более широком разнообразии проектов, которые выполнили назначение персонажей в проекте Glyssen. Если у вас есть такой проект, пожалуйста, дайте мне знать, если вы готовы поделиться со мной копией. -Спасибо!