+4 голосов
589 просмотров

Похоже, что в Paratext 8 есть проблема с миграцией интерлинеарных глосс, если вы используете Interlinearizer в версии 7 для глоссирования текста, используя греческий Новый Завет в качестве модельного текста. Пользователь попросил помощи в этой ситуации, и я заметил, что после миграции код языка в lexicon.xml и в файлах глосс для каждой книги был «el», тогда как код для греческого Нового Завета должен быть «grc». (В тестовом проекте я проглоссировал несколько слов на греческом, затем выполнил миграцию, и в этом мигрированном проекте код для греческого Нового Завета стал «lbj», код языка из Индии. Я сообщил об этой проблеме разработчикам).

Код языка используется в трех местах в данных интерлинеаризатора.

  1. В файле lexicon.xml, в поле «Gloss Language». Это поле встречается для каждого слова, которому присвоена глосса на этом языке.
  2. В имени подпапки и имени файла интерлинеаризатора для каждой книги. Например, «interlinearizer_el_MAT.xml» — это файл для глосс на языке «el» для Евангелия от Матфея.
  3. Внутри каждого файла для книги, в поле glossLanguage на второй строке файла.

Как я узнал, что «grc» — правильный код для греческого Нового Завета? Я проглоссировал одно слово в Paratext 8, используя греческий как модель, сохранил изменения, а затем посмотрел на файлы.

Таким образом, чтобы вручную преобразовать эти данные, я сделал следующее:
0) закройте Paratext, если он открыт

  1. выполните поиск и замену в lexicon.xml, заменив «el» на «grc», например:

    <Gloss Language="el">δέ</Gloss> 
    

    становится

    <Gloss Language="grc">δέ</Gloss>
    

Чтобы ограничить изменение только кодами, а не любыми строками «el» внутри более крупного слова, включите кавычки (прямые двойные кавычки) в строку поиска и в строку замены.

2a) переименуйте папку «Interlinear_el» внутри папки проекта в «Interlinear_grc». (Если вы создали тестовый файл с желаемым кодом, сначала удалите папку и ее файл).

2b) переименуйте файлы внутри этой папки с "Interlinear_el_[Bookcode].xml на "Interlinear_grc_[Bookcode].xml

  1. измените код Glosslanguage на второй строке каждого файла для книги на желаемый код. Например

     <InterlinearData ScrTextName="MP8" GlossLanguage="el" BookId="MAT">
    
     becomes
    
     <InterlinearData ScrTextName="MP8" GlossLanguage="grc" BookId="MAT">
    
  2. Запустите Paratext и посмотрите, сработало ли это.

При редактировании XML-файлов убедитесь, что вы не изменяете никакие коды < или > или </ или />, они подобны обратным слэшам в USFM. Если вы сделаете ошибку, Paratext может отклонить ваш отредактированный lexicon.xml и переименовать его в lexicon.xmlcorrupt, а затем начать создавать новый. Если вы сохраните копию вашего файла lexicon.xml в другом месте перед редактированием, вы сможете восстановить ее, если столкнетесь с этой проблемой и не сможете определить, что пошло не так в вашем отредактированном файле.

Переведено машиной с языка English
Paratext от [Expert]
(3,3тыс. очков)

снова показан | 589 просмотров

4 Ответов

0 голосов
Лучший ответ

Еще один пример: использование NIV84 в качестве модельного текста.
После миграции в проекте «en» в качестве кода языка. Но фактический код языка для NIV84 в Paratext 8 — «en-US». Поэтому вам нужно пройти через шаги, чтобы изменить «en» на «en-US» в лексиконе, в именах файлов для каждой книги и внутри файлов для каждой книги.

Переведено машиной с языка English
от [Expert]
(3,3тыс. очков)

Есть ли веская причина различать американские и англицизированные версии перевода, используя коды языка en-US и en-UK? Если нет, было бы хорошей идеей убрать различие в коде языка между текстами usNIV11 и ukNIV11, а также usNIV84? (У нас нет проекта ukNIV84.)

Переведено машиной с языка English

Я сомневаюсь, что важно различать американский и британский английский. У вас будет «favor» против «favour», «honor» против «honour», но я думаю, что этих слов недостаточно, чтобы оправдывать различение вариантов.

Переведено машиной с языка English

Я подозреваю, что различий может быть гораздо больше, чем просто несколько написаний. Я не очень хорошо знаю варианты NIV, но во версиях TEV/GNB для США и Великобритании есть многие различия в употреблении и идиоме.

JR

Переведено машиной с языка English
0 голосов

Может быть проще использовать другой модельный текст, который имеет тот же код языка, что и тот, который использовался в PT 7, если есть приемлемая альтернатива. Спасибо за советы по редактированию xml-файлов, sewhite, я пробовал это для пользователя, у которого была смена орфографии, но Paratext отклонил мой новый файл так, как вы описали.

Переведено машиной с языка English
от [Expert]
(2,9тыс. очков)

Обновление – у меня была та же проблема, что и у anon044949 с проектом изменения орфографии. Проблема заключалась в выполнении поиска и замены пяти гласных в языке, чтобы заменить их на другие символы. Оказалось, что в лексиконе было несколько глосс, выполненных в новой орфографии, сделанных после конвертации. Когда я конвертировал все старые записи, возникло несколько дубликатов. Два экземпляра одного и того же слова, каждое с разным ID смысла или ID глоссы. Paratext при загрузке этого файла в память протестовал и пометил файл лексикона как поврежденный. Таким образом, помимо изменения кодов < > и </ >, есть второй способ «повредить» лексикон – получить дубликаты слов. Но это была другая ситуация, чем изменение кодов языка; здесь потребовалось изменить слова и морфемы внутри файла лексикона, чтобы они соответствовали новой орфографии.

Переведено машиной с языка English
0 голосов

Вчера я столкнулся с ситуацией, когда в PT7 языком для RV60 был «Spanish», а в PT8 языком для RVR1960 является «spa». Я следовал инструкциям Стивена из более раннего поста, чтобы внести соответствующие изменения, но глоссы по-прежнему не отображались как одобренные (как они были в PT7).

Тим С. указал мне на то, что в PT8 есть определенные языки, которые отображают трехбуквенный код (в данном случае spa), но внутренне используют двухбуквенный код (в данном случае es) для сопоставления данных интерлинеара. Как только я внес соответствующие изменения и использовал «es», глоссы отобразились как одобренные.

Таким образом, если вы попробуете использовать язык модельного текста и это не сработает, вы можете попробовать соответствующий двухбуквенный код.

Таблица этих кодов можно найти по адресу: https://www.loc.gov/standards/iso639-2/php/code_list.php

Переведено машиной с языка English
от (9,9тыс. очков)
+1 голос

Этот процесс был необходим, чтобы повторно связать наш проект BT с Interlinearizer после обновления до PT9.2 (мы изначально установили код языка таким же, как в основном проекте, а не (en), и PT не мог его идентифицировать.
Единственный шаг, который я бы добавил, заключается в том, что в меню BT под «project settings» в PT вы можете переключить код языка даже после создания проекта (в стандартном проекте вы не можете этого сделать). У нас было несколько команд с проектами BT, которые были созданы с тем же кодом языка, что и их основной проект. Изменение кода на английский (eng) позволило нам выбрать наш проект BT в настройках Interlinearizer

(ПРИМЕЧАНИЕ: мы также выяснили, что вы не можете использовать «Create Glosses for ZZZ with no model text» и выбрать «output to», чтобы выбрать проект BT. Мы не используем модельный текст для наших BT, поэтому это казалось идеальным. Но он позволяет выбрать только Standard Project для вывода. Таким образом, опция создания обратной трансляции, используя проект BT КАК МОДЕЛЬ, была тем, что нам нужно. Теперь все работает отлично!!

Переведено машиной с языка English
от (161 очков)

Похожие вопросы

0 голосов
4 ответов 988 просмотров
I have just upgraded a project that had an extensively populated interlinearizer (lexicon.xml and associated interlinear ... and black colors in the interlinearizer. Any thoughts?
Milt_Jones 184 задал вопрос дек 21, 2018
0 голосов
1 ответ 263 просмотров
When we migrated our project to PT8, many glosses that had been deleted in the interlinear data returned. This is a ... but they are now back in the list of possible glosses.
anon084052 157 задал вопрос авг 12, 2017
0 голосов
2 ответов 418 просмотров
Any thoughts on why the interlinearizer is suddently generating unsual guesses with mixed upper/lower case red letters? Here is ... gloss: 2018-01-08_15-55-53.jpg872 606 100 KB
anon242106 110 задал вопрос янв 8, 2018
0 голосов
2 ответов 448 просмотров
A user sent me this, and I'm at a loss as to how to address it: We have just migrated the SCK team into ... the interlinear data for them. Thanks for any insight you can offer!
anon150053 286 задал вопрос июл 27, 2017
0 голосов
3 ответов 387 просмотров
Каков порядок предложенных глосс в инструменте интерлинеаризации? Другими словами, если вы нажимаете на глоссу и получаете ... по частотности, хотя это кажется наиболее логичным.
mnjames 1,9тыс. задал вопрос сен 11, 2018
Welcome to Support Bible, where you can ask questions and receive answers from other members of the community.
But if we walk in the light, as he is in the light, we have fellowship with one another, and the blood of Jesus, his Son, purifies us from all sin.
1 John 1:7
3,049 вопросов
6,007 ответов
5,673 комментариев
2,029 пользователей