+1 голос
466 просмотров

Лингвист из нашего региона интересуется, какой лучший способ использовать возможности морфологии в Paratext.
Она в основном использует эти функции для проверки орфографии, но также для подтверждения типа решений, принятых переводчиками. Я не думаю, что она использует морфологию для таких вещей, как библейские термины (Biblical Terms).

Пытаясь помочь ей, я сталкиваюсь с тем фактом, что я не очень хорошо понимаю, как Paratext использует морфологический разбор, и я не уверен в лучших практиках в этой области. Я уже посмотрел в справку Paratext и в некоторых постах на форуме.

Вот пример от лингвиста. В языке Mbugwe она размечает морфемы с поверхностной формой, но в языке Rangi они разбирают с базовой формой. Моя интуиция подсказывает, что лучше размечать базовые формы. Одна сложность заключается в том, что kee- также является другой морфемой в Mbugwe.

орфографическое слово: kokeelaana ‘тогда мы попрощались друг с другом’
лингвистическая морфология: /ko-ka-e-laan-a/ 1PL-NARR-RECP-say.goodbye-FV
морфология Paratext по-мбугве: ko-ke-e-laan-a
морфология Paratext по-ранги: ko-ka-e-laan-a

Я думаю, что её главный вопрос состоит в том, каковы лучшие практики для разметки морфем в Paratext, чтобы он мог делать обоснованные предположения о морфологии других слов (и, возможно, интерлинейные предположения)? Как он обрабатывает базовые морфемы, которые выглядят совсем иначе в поверхностных формах?

Переведено машиной с языка English
Paratext от (1,3тыс. очков)
снова показан | 466 просмотров

3 Ответов

+1 голос
Лучший ответ

У меня есть некоторые предложения по этой теме. Чтобы полностью использовать морфологию в Paratext, вам нужно включить опцию Matched based on stems. Вот небольшой фрагмент из файла справки:

Paratext позволит вам иметь более одной глоссы для морфемы, если эта опция включена. Это позволит вам обрабатывать омофонные морфемы,

Разбор в Paratext не обрабатывает базовые формы. Если вы попытаетесь научить его базовым формам, вы быстро запутаете его статистический алгоритм предсказания, и он будет выдавать бессмыслицу. Если вы хотите работать с базовыми формами, вам нужно использовать Fieldworks/Flex. К сожалению, в текущем состоянии взаимодействия Paratext и Flex, если один член команды связывает свой Paratext с Flex, то все члены команды должны сделать то же самое. Если один член команды этого не сделает, то он не сможет использовать интерлинеаризатор на своем компьютере.

Это видео немного устарело, но оно может дать вам некоторые идеи о том, что Paratext может делать с библейскими терминами и морфологией.

Переведено машиной с языка English
от [Expert]
(2,9тыс. очков)

снова показан

Спасибо, anon044949. Мы используем Match based on stems с тех пор, как до PT9. Моя проблема не в том, как делать интерлинеаризацию в PT; она в том, что PT теперь, похоже, делится своими существующими данными о морфологии и глоссах с FLEx — в обоих направлениях. Это определенно не то, чего мы хотим, потому что мы намеренно (и систематически) недоопределяли морфемные разбивки в PT, чтобы не перегружать PT, сделать его быстрее и предоставить глоссирование, которое более понятно переводческим консультантам, многие из которых не хотят лезть в текст с зашифрованными, лингвистического типа морфемными глоссами. Мы сейчас начинаем вводить наши старые тексты Toolbox в FLEx и анализировать их для лингвистической работы.

Так что теперь у меня, похоже, куча данных о морфологии и глоссах слов в стиле PT в FLEx (только недавние анализы из PT9, с тех пор как новые процедуры PT–FW стали активны). Я предполагал, что обмен FW–>PT был в одном направлении. Думаю, имеет смысл отправлять анализы PT в FW, но это было добавлено в PT9 без предупреждения о необходимости следить за непредвиденными последствиями. Я взаимодействовал со многими другими людьми, которые также «делают» интерлинеаризацию PT, как мы, — ориентируясь на переводческих консультантов, а не на лингвистов, поэтому я думаю, что будут другие, заинтересованные в этой теме.

Примечание для пользователей PT9: если у вас нет базы данных FLEx, связанной с вашим проектом Paratext, это не относится к вам на данный момент.

Поэтому было бы полезно, если бы кто-нибудь мог дать нам описание того, что именно происходит во время интерлинеаризации в PT9, с связанной базой данных FLEx. Например,

  • Применяются ли правила разбора, определенные в FLEx, в PT?

  • Возможно ли отключить отправку PT информации о разборе и глоссировании в FW?

  • Обновляется ли интерлинеар PT на лету, когда морфемные разбивки/глоссы FLEx были отредактированы?

  • Что происходит, когда я редактирую некоторые слова в стихе интерлинеара PT (но игнорирую слова, которые меня не интересуют сегодня), а затем повторно утверждаю стих? Отправляются ли старые морфемные разбивки/глоссы в FW в этом случае?
    Заранее спасибо за любые разъяснения.

Переведено машиной с языка English

KimB,

Я думаю, это должно быть другой тред о интеграции Paratext-Flex. Возможно, это будет замечено людьми, которые знают об этом больше, если это будет отдельный тред. Я попробую перепостить.

Переведено машиной с языка English

Вы правы, anon044949. Спасибо за перепост.

Переведено машиной с языка English
0 голосов

Связанный с этим вопрос: может кто-нибудь объяснить, что происходит между Paratext 9 и FLEx (9, возможно)?

В нашем проекте много интерлинеаризации PT, выполненной «грубо» на протяжении лет для пользы советников и консультантов, потому что мы знали, что «когда-нибудь» PT перейдет на использование интерлинеаризации в стиле FLEx, которая должна быть более точной и ориентированной на лингвистику. Наша база данных FLEx была связана с проектом PT несколько лет, но мы не пытались интерлинеаризовать Писание в FLEx. Я видел доказательства того, что PT9 теперь находит записи FLEx, что здорово.

Недавно мы работали над импортом и интерлинеаризацией небиблейских текстов в FLEx. На этой неделе, работая со многими записями аффиксов, мы видим что-то странное и тревожное: похоже, что морфемные разбивки и глоссы, которые мы создаем в Paratext, могут автоматически передаваться в FLEx. Возможно ли это, или происходит что-то другое? Я видел как минимум 150 лексических записей FLEx, созданных за последние пару лет, которые выглядят как наши морфемные разбивки и стиль глоссирования PT.

Это автоматическое вставление в FLEx нежелательно на данном этапе нашей проектной работы, но если это происходит, нам нужно об этом знать и изменить наши процедуры глоссирования в PT. (За это время мы в основном интерлинеаризовали отдельные стихи, чтобы заставить PT распознавать аффиксированные библейские термины (Biblical Terms), что может объяснить довольно неожиданно низкое количество этих записей FLEx.)

Может кто-нибудь прокомментировать, пожалуйста, или направить меня к существующему объяснению изменений в интерлинеаризации в PT9?

Большое спасибо за великое развитие как PT, так и FLEx и функции интеграции! Мы очень это ценим; нам просто нужно знать, как изменения влияют на наш рабочий процесс.

Переведено машиной с языка English
от (670 очков)
снова показан
0 голосов

Спасибо за обратную связь, anon044949.

Похоже, морфологический разбор в Paratext не делает действительно тех видов вещей, которые мы, возможно, представляли. Но знание этого достаточно на данный момент.
Еще раз спасибо.

Переведено машиной с языка English
от (1,3тыс. очков)

В моем использовании морфологии для проверки орфографии и подтверждения того, что обратный перевод адекватно отражал время/аспект и другие характеристики перевода, я использовал морфологический парсер в Fieldworks. Некоторые языки могут требовать использования фонологического парсера в Fieldworks. Один из таких случаев — когда тон несет большую грамматическую нагрузку.

Переведено машиной с языка English

Похожие вопросы

0 голосов
2 ответов 291 просмотров
В языке, с которым мы работаем, некоторые аффиксы и клитики отделены от корня дефисами. Этот дефис определён в ... Если нет, я собираюсь предложить такую функцию. Спасибо, rfkvg
Roland 245 задал вопрос дек 1, 2021
0 голосов
2 ответов 504 просмотров
В настоящее время я работаю со списком слов (Wordlist), и чтобы убедиться, что у меня актуальная версия, я только что ... этих пунктов, я буду рад услышать от вас. Спасибо rfkvg
Roland 245 задал вопрос ноя 30, 2021
0 голосов
2 ответов 496 просмотров
Я работаю над проектом, в котором уже есть список слов с морфологическими разборами. Можно ли загрузить его в ... слов. Буду благодарен за краткое объяснение механики работы.
Kent Spielmann 1,8тыс. задал вопрос мар 30, 2021
0 голосов
4 ответов 640 просмотров
Проект уже несколько недель безупречно работает в настройках, основанных на основах (stem-based). В языке образуется множество ... мать, а over - префикс, означающий μέγας.)
Tim 934 задал вопрос апр 24, 2019
0 голосов
2 ответов 392 просмотров
Today, from a real bit of text, I hit upon a new question: Do I need to give each morpheme on each wordlist- ... plural-nouns, and all those possible prefixes in PT8. Thank you.
Tim 934 задал вопрос апр 19, 2019
Welcome to Support Bible, where you can ask questions and receive answers from other members of the community.
Just as a body, though one, has many parts, but all its many parts form one body, so it is with Christ.
1 Corinthians 12:12
3,047 вопросов
6,007 ответов
5,672 комментариев
2,027 пользователей