В нашем проекте мы много работали над интерлинеаризацией в PT, целенаправленно стремясь помочь консультантам и советникам лучше понимать язык и снизить нагрузку на автоматический морфологический анализ в PT. Мы проводили гораздо более точную и лингвистически ориентированную интерлинеаризацию небиблейских данных в FLEx. Наша база данных FLEx была связана с проектом PT уже несколько лет, но мы не пытались интерлинеаризовать библейские тексты в FLEx. Я видел признаки того, что интерлинеаризатор PT9 теперь использует лексические записи FLEx, что отлично.
Недавно мы редактировали наши небиблейские интерлинеарные тексты в FLEx. На этой неделе, работая со множеством записей аффиксов, мы заметили нечто странное и тревожное: похоже, что неморфологические разбивки слов и глоссы, которые мы создаем в Paratext, автоматически отправляются в FLEx в качестве словоформ. Я предполагаю, что это часть процесса слияния интерлинеаризации PT и FLEx, но сейчас это не помогает нашим данным в FLEx!
На данном этапе нашей проектной работы такая автоматическая вставка в FLEx нежелательна, но если это новая намеренная функция, нас нужно проинформировать, чтобы мы могли изменить наши процедуры глоссирования в PT. К счастью, мы недавно не интерлинеаризовали много стихов в PT, но будет большой работой отсортировать неточные записи PT от наших словоформ и морфемных разбивок в FLEx.
Может ли кто-нибудь указать мне описание того, как именно PT9 и FLEx взаимодействуют во время интерлинеаризации?
Было бы очень полезно иметь возможность контролировать, какие данные передаются между PT и FLEx: возможно, можно было бы реализовать трехсторонний выбор настроек: PT <–> FLEx, PT –> FLEx и FLEx –> PT?
Большое спасибо за отличное развитие как PT, так и FLEx и за функции интеграции! Мы очень это ценим; нам просто нужно знать, как изменения влияют на наш рабочий процесс.
We have done a lot of PT interlinearization in our project, done expressly with the goal of helping advisors’ and consultants’ understand the language and to reduce the automatic parsing load for PT. We have done much more precise and linguistically oriented interlinearization on non-Scripture data in FLEx. We have had our FLEx database associated with the PT project for several years, but we have not attempted to interlinearize Scripture in FLEx. I have seen evidence that PT9 interlinearizer is now using FLEx lexical entries, which is great.
Recently we have been editing our non-Scripture interlinear texts in FLEx. This week while working with the many affix entries we see something weird and disturbing: It looks as though the Paratext non-linguistic morpheme breaks and glosses we create are being sent to FLEx automatically as wordforms. I assume this is part of the move toward merging PT and FLEx interlinearization, but it is not helpful for our FLEx data at this time!
This automatic insertion into FLEx is not desired at this point in our project work, but if it is a new intentional feature we need to be informed so we can modify our glossing procedures in PT. Fortunately we have not interlinearized many verses in PT recently, but it will be a big job to sort out the imprecise PT entries from our FLEx wordforms + morpheme breaks.
Can someone please point me to a description of how PT9 and FLEx specifically interact during interlinearization?
It might be very helpful to have control over which data is transferred between PT and FLEx: Could there be a 3-way settings choice between PT <–> FLEx , PT –> FLEx , and FLEx –> PT, perhaps?
Many thanks on the great development of both PT and FLEx and the integration features! We appreciate it very much; we just need to know how the changes are affecting our workflow.