0 голосов
819 просмотров

В нашей команде мы приступили к ревизии опубликованного перевода Нового Завета. Изначально мы были оптимистичны, надеясь, что процесс не займёт много времени и не потребует множества изменений. Однако сейчас мы обнаружили, что было изменено более 90% стихов.

Всю работу по ревизии мы вели вне Paratext. Причин для этого много, и я не буду на них останавливаться здесь. Тем не менее, поскольку мы приближаемся к финишу, нам нужно импортировать работу обратно в Paratext.

Наш текст структурирован очень просто: его можно представить как таблицу, где первый столбец содержит ссылку на стих (например: Марка 1:1), а второй столбец — содержание стиха в виде обычного текста. Здесь нет заголовков, маркеров абзацев, сносок или чего-либо подобного. Я хотел взять существующий USFM и обновить его новым текстом. Я разработал некоторый код для этого, в основном используя usfm-grammar. Я взял существующий USFM, преобразовал его в JSON, изменил JSON для обновления перевода, а затем преобразовал перевод обратно в USFM с помощью того же инструмента.

Однако я замечаю, что сохранение заголовков, абзацев и перекрёстных ссылок — задача непростая. Я потратил на это день-два (включая процесс принятия решения об этом подходе), и мне не хочется тратить много времени на программирование, если это не лучшее использование моего времени. Когда я импортировал результат обратно в Paratext, программа жаловалась на недействительный USFM. Похоже, что usfm-grammar может генерировать недействительный USFM.

Я посмотрел библиотеки для записи USFM. Я нашёл довольно много вариантов для разбора USFM и преобразования USFM в другие форматы, но usfm-grammar была единственной библиотекой, которую я нашёл, способной записывать USFM, преобразуя JSON в USFM.

Сейчас я рассматриваю два варианта:

  1. Продолжить разработку инструмента, который может объединять ревизии в виде обычного текста с существующим USFM.
  2. или… по сути начать новый проект в Paratext, импортируя обычный текст как USFM, не пытаясь объединить его с существующими заголовками и другой информацией в текущем переводе.

Я уже пробовал вариант 2. Как вы можете представить, было довольно легко сгенерировать вывод в таком виде:

\id MRK
\c 1
\p
\v 1 the first verse
\v 2 the second verse
\v 3 the third verse
\v 4 etc

Какой совет вы бы мне дали? В настоящее время я склоняюсь к варианту 2 и просто вручную добавлю обратно заголовки и перекрёстные ссылки. Заголовки всё равно потребуют ручной ревизии.

Переведено машиной с языка English
Paratext от (495 очков) | 819 просмотров

4 Ответов

0 голосов
Лучший ответ

В инструменте Compare versions (Сравнение версий) вы можете выбрать разные проекты слева и справа. Таким образом, вы можете сравнить свой основной проект с минимальным проектом (выбрав Current Version (Текущая версия) с обеих сторон). Затем вы можете щёлкнуть правой кнопкой мыши по различиям, чтобы ваш основной проект получил изменения из минимального проекта:

Переведено машиной с языка English
от [Expert]
(16,7тыс. очков)

Спасибо за скриншот. Теперь я понимаю, что, похоже, я сталкиваюсь с ошибкой в Paratext для Linux. Вот что я вижу:

Когда я открываю Paratext на Windows, я вижу эти панели инструментов.

Переведено машиной с языка English

Интересно! Я использую PT9, версия для Linux 9.0, 0.99. На панели инструментов я вижу два выпадающих списка проектов, как на скриншоте anon291708 (с Windows PT). Я могу выбрать другое имя проекта в любом из выпадающих списков, но отображаемый текст проекта не обновляется. Кнопки Version (Версия) обе активны. Так что, действительно, похоже, что есть ошибка в Linux.

Кстати — в моей установленной PT8 пункт меню Tools > Compare Texts открывает окно без выпадающих списков проектов, как на снимке, который «bit» сделал со своего экрана PT9; я предполагаю, что, возможно, моя версия PT9-Linux новее, чем у bit.

Так что в настоящее время я не могу сравнивать тексты двух разных проектов ни в PT8, ни в PT9. Раньше в PT было два пункта меню: Compare versions (Сравнение версий) в меню Project (Проект) и Compare texts (Сравнение текстов) в меню Tools (Инструменты). Я знаю, что была некоторая путаница с этими двумя инструментами, поэтому, возможно, они были объединены в один? Но функции обоих очень важны.

Переведено машиной с языка English
+1 голос

Вы можете попробовать комбинацию #1 и #2. В Paratext есть инструмент, который показывает различия между двумя текстами. Вы можете создать простой проект, а затем использовать этот инструмент, чтобы объединить изменения из простого проекта в основной проект. Это всё равно потребует много ручной работы, но, вероятно, это проще, чем разрабатывать инструмент для автоматического выполнения этой задачи.

Вы можете найти справку по этому инструменту, поискав «Как сравнить два разных проекта?» в справке внутри Paratext. Затем вы можете щёлкнуть правой кнопкой мыши по изменениям, чтобы принять или отменить их (например, чтобы вернуть заголовки и названия).

Переведено машиной с языка English
от [Expert]
(16,7тыс. очков)

снова показан

Спасибо. Я не знал, что можно сравнивать два проекта.

Я поискал «Как сравнить два разных проекта?» в справке внутри Paratext и нашёл этот результат:

  • «Как найти, где знаки препинания различаются в двух проектах?»

Если я ищу «различаются в двух проектах», я получаю больше результатов:

  • «Как найти, где кавычки различаются в двух проектах?»
  • «Как найти, где маркеры различаются в двух проектах?»
  • «Как найти, где знаки препинания различаются в двух проектах?»

Похоже, вы запускаете различные чек-листы и сравниваете их с другим проектом. Щёлкните по иконке «гамбургер» для проекта, затем разверните меню, затем щёлкните «Чек-листы» (Checklists) в разделе «Инструменты» (Tools), затем один из пунктов подменю. Кажется, это работает с этими чек-листами:

  • Verse text
  • Word or phrase
  • Section headings
  • Book titles
  • References
  • Footnotes
  • Markers
  • Quotation marks
  • Punctuation
  • Relatively long verses
  • Relatively short verses
  • Long sentences
  • Long paragraphs

Я записываю это для наблюдателей и на случай, если я вернусь к этому позже.

Теперь, когда я об этом знаю, я думаю, что выберу вариант #2 и буду использовать эти инструменты внутри Paratext, которые могут сравнивать два проекта. Это звучит проще, чем пытаться написать код для инструмента, объединяющего два перевода.

Переведено машиной с языка English

Я совсем не это имел в виду. Какую версию Paratext вы используете?

Я говорил об инструменте Compare Versions (Сравнение версий) (Tools > Compare Texts в PT8 - если не ошибаюсь, Project > Compare versions в PT9).

Переведено машиной с языка English

Я использую Paratext 9.0

Если я щёлкну по иконке «гамбургер» в окне проекта, я могу найти пункт меню с подписью «Compare versions» (Сравнение версий). Это открывает окно с двумя панелями, по одной в каждом столбце. Я могу нажимать кнопки на панели инструментов, которые выглядят как стрелки, чтобы перемещаться между изменениями. Мне это кажется так, что это позволяет просматривать исторические изменения в проекте (я думаю). Я не вижу, как этот инструмент позволяет сравнивать два проекта, так как он даже не спрашивает, какие два проекта я хочу сравнить.

Переведено машиной с языка English
+1 голос

Это очень смелое предположение, но ваше описание получения табличных данных в стандартном формате заставило меня подумать о SheetSwiper (https://software.sil.org/sheetswiper/). Предположим, вы экспортируете заголовки, маркеры абзацев и т. д. (расположенные в соответствующих столбцах) вместе с их ссылками, а затем сортируете это вместе с существующей информацией о стихах — сможете ли вы создать электронную таблицу, которая даст нужный вам результат? К сожалению, библейский текст не так иерархичен, как лексические данные, для которых предназначен SheetSwiper.

Переведено машиной с языка English
от (296 очков)

SheetSwiper

Спасибо за рекомендацию SheetSwiper. Я щёлкнул по ссылке и попытался найти репозиторий на GitHub, но похоже, что ссылка на этой странице сломана. Я думаю, этот инструмент преобразует электронную таблицу в USFM, что полезно, но не слишком сложно написать самому. Сложная часть — это объединение с существующим USFM.

Переведено машиной с языка English

Рад, что у вас есть путь вперёд без SheetSwiper. Похоже, исходный код недоступен, есть только загрузка .exe для Windows.

Переведено машиной с языка English
0 голосов

Какой совет вы бы мне дали? В настоящее время я склоняюсь к варианту 2 и просто вручную добавлю обратно заголовки и перекрёстные ссылки. Заголовки всё равно потребуют ручной ревизии.

Это действительно выглядит как более простой подход. Особенно учитывая, что заголовки всё равно потребуют ручной ревизии.

Но я задумываюсь, не могли бы вы сделать это просто как трансформацию, вы, кажется, близки к этому сейчас. Я бы попробовал понять, сколько времени занимает ручная работа с заголовками, и решить, не быстрее ли будет правильно настроить трансформацию.

Я понимаю, что вам не нужен round-trip (обратное преобразование), это просто импорт? Есть ли что-то в существующем USFM Paratext, что нужно сохранить, или текст, который вы импортируете, является текущей версией, которая может заменить то, что там есть?

Jonathan+Robie

Переведено машиной с языка English
от (448 очков)
снова показан

Изначально я надеялся сохранить заголовки, перекрёстные ссылки и тому подобное из существующего USFM Paratext. Но теперь я думаю, что проще перенести их вручную, по следующим причинам:

  • Скорее всего, мы всё равно будем вносить довольно много изменений в заголовки вручную
  • Всё, что ссылается на определённые части стихов, такое как перекрёстные ссылки, всё равно нужно проверять вручную
  • Я сэкономлю время на разработку кода для выполнения трансформаций, качество которых всё равно можно проверить только вручную
Переведено машиной с языка English

Похожие вопросы

0 голосов
0 ответов 185 просмотров
When importing Scripture from Paratext into Fieldworks, It is possible to have the back translation import along with the ... Paratext has to be linked to the vernacular project.
[Expert]
Jeff_Shrum
2,9тыс.
задал вопрос дек 2, 2016
+1 голос
3 ответов 435 просмотров
Exporting the Wordlist to HTML is a nice feature, except that for many users including me, working with HTML is ... that are currently marked as spelled correctly in PT? anon101508
anon101508 117 задал вопрос мар 11, 2019
0 голосов
4 ответов 607 просмотров
Continuing the discussion from Importing Back Translation along with Vernacular into Fieldworks: Importing Back Translation ... translation but obviously that didn't work either.
jbabt 115 задал вопрос янв 9, 2017
0 голосов
1 ответ 212 просмотров
According to my old notes, I get the cleanest text via copy and paste, with my View Setting set to unformatted . I ... best way to get clean text with valid markers out of PT8.
Tim 934 задал вопрос мар 8, 2019
0 голосов
2 ответов 368 просмотров
Brief background: our majority language project has had a bit of a rocky history. The four Gospels were printed in ... verses you've checked and are satisfied with, for example.
wdavidhj 1,4тыс. задал вопрос сен 26, 2016
Welcome to Support Bible, where you can ask questions and receive answers from other members of the community.
I appeal to you, brothers and sisters, in the name of our Lord Jesus Christ, that all of you agree with one another in what you say and that there be no divisions among you, but that you be perfectly united in mind and thought.
1 Corinthians 1:10
3,045 вопросов
6,005 ответов
5,671 комментариев
2,026 пользователей