+1 मत
466 व्यूज़

हमारे क्षेत्र के एक भाषाविद Paratext की रूपविद्या (morphology) सुविधाओं का उपयोग करने का सर्वोत्तम तरीका जानना चाहते हैं।
वे मुख्य रूप से इन सुविधाओं का उपयोग वर्तनी जाँच (spell checking) में सहायता के लिए करती हैं, लेकिन अनुवादकों द्वारा किए गए विकल्पों की प्रकृति की पुष्टि करने के लिए भी। मुझे नहीं लगता कि वे पवित्र शब्दों (Biblical terms) जैसे चीज़ों में सहायता के लिए रूपविद्या का उपयोग कर रही हैं।

उनकी सहायता करने की कोशिश में, मुझे यह तथ्य सामने आता है कि मुझे Paratext के रूपविद्या विश्लेषण (morphology parses) का उपयोग कैसे करता है, इस बारे में बहुत कुछ नहीं पता है, और मैं इस क्षेत्र में सर्वोत्तम प्रथा (best practice) के बारे में अनिश्चित हूँ। मैंने पहले ही Paratext Help और फोरम पर कुछ पोस्ट देख लिए हैं।

यहाँ भाषाविद का उदाहरण है। Mbugwe में, उन्होंने सतह रूप (surface form) के साथ प्रत्येक (morphemes) को चिह्नित किया है, लेकिन Rangi में वे मूल रूप (underlying form) के साथ विश्लेषण (parsing) कर रहे हैं। मेरा अनुमान है कि मूल रूपों को चिह्नित करना सबसे अच्छा होगा। एक मुश्किल यह है कि kee- भी Mbugwe में एक अलग प्रत्येक (morpheme) है।

लिप्यंतरण शब्द (orthographic word): kokeelaana ‘फिर हमने एक-दूसरे को अलविदा कहा’
भाषाई रूपविद्या (linguistic morphology): /ko-ka-e-laan-a/ 1PL-NARR-RECP-say.goodbye-FV
Paratext रूपविद्या Mbugwe के तरीके में: ko-ke-e-laan-a
Paratext रूपविद्या Rangi के तरीके में: ko-ka-e-laan-a

मुझे लगता है कि उनका मुख्य प्रश्न यह होगा कि Paratext में प्रत्येक (morphemes) को चिह्नित करने की सर्वोत्तम प्रथा क्या है, ताकि यह अन्य शब्दों की रूपविद्या के बारे में शिक्षित अनुमान (educated guesses) लगा सके (और संभवतः इंटरलिनियर अनुमान)? यह मूल प्रत्येक (underlying morphemes) को कैसे संभालता है जो सतह रूपों में काफी अलग दिखते हैं?

English से मशीन-अनुवादित
Paratext में द्वारा (1.3k अंक)
फिर से दिखाया गया | 466 व्यूज़

3 उत्तर

+1 मत
सर्वोत्तम उत्तर

मेरे पास इस विषय के बारे में कुछ सुझाव हैं। Paratext में रूपविद्या (morphology) का पूर्ण उपयोग करने के लिए, आपको Matched based on stems विकल्प चालू करना होगा। यहाँ हेल्प फ़ाइल से एक अंश है:

यदि यह विकल्प चालू है, तो Paratext आपको एक प्रत्येक (morpheme) के लिए एक से अधिक ग्लॉस (gloss) रखने की अनुमति देगा। इससे आपको समान ध्वनि वाले प्रत्येक (homophoras morphemes) को संभालने में सक्षम बनाएगा।

Paratext विश्लेषण (parsing) मूल रूपों (underlying forms) को संभालता नहीं है। यदि आप इसे मूल रूपों सिखाने की कोशिश करते हैं, तो आप जल्दी ही इसके सांख्यिकीय अनुमान एल्गोरिदम (statistical guessing algorithm) को भ्रमित कर देंगे और यह अर्थहीन परिणाम देगा। यदि आप मूल रूपों के साथ काम करना चाहते हैं, तो आपको Fieldworks/Flex का उपयोग करना होगा। दुर्भाग्यवश, Paratext और Flex के संचार की वर्तमान स्थिति में, यदि एक टीम सदस्य अपने Paratext को Flex से जोड़ता है, तो सभी टीम सदस्यों को ऐसा करना होगा। यदि एकल टीम सदस्य ऐसा नहीं करता है, तो वे अपने कंप्यूटर पर इंटरलिनियरर (interlinearizer) का उपयोग नहीं कर सकते।

यह वीडियो अब थोड़ा पुराना है, लेकिन यह आपको यह समझने में मदद कर सकता है कि Paratext पवित्र शब्दों (Biblical terms) और रूपविद्या (morphology) के साथ क्या कर सकता है।

English से मशीन-अनुवादित
द्वारा [Expert]
(2.9k अंक)

फिर से दिखाया गया

धन्यवाद, anon044949। हम PT9 से पहले से ही Match based on stems का उपयोग कर रहे हैं। मेरी समस्या PT में इंटरलिनियरेशन कैसे करना है, यह नहीं है; बल्कि यह है कि PT अब अपने मौजूदा रूपविद्या और ग्लॉस डेटा को FLEx के साथ साझा करने लगता है—दोनों दिशाओं में। जो निश्चित रूप से हमारी इच्छा नहीं है, क्योंकि हम जानबूझकर (और व्यवस्थित रूप से) PT में प्रत्येक विभाजन (morpheme breaks) को अधूरा (underspecifying) रख रहे हैं ताकि PT को धीमा न हो, इसे तेज़ बनाए रखें, और अनुवाद परामर्शदाताओं (translation consultants) के लिए अधिक समझने योग्य ग्लॉसिंग प्रदान करें, जिनमें से कई रहस्यमय, भाषाई पत्र-शैली के प्रत्येक ग्लॉसों से भरे पाठ में डूबना नहीं चाहते हैं। हम अब अपने पुराने Toolbox पाठों को FLEx में दर्ज करना और भाषाई कार्य के लिए उनका विश्लेषण करना शुरू कर रहे हैं।

तो अब मुझे FLEx में PT-शैली के शब्द रूपविद्या और ग्लॉस डेटा का एक समूह दिखाई देता है (केवल PT9 से हाल के विश्लेषण, नए PT–FW रूटीन सक्रिय होने के बाद।) मैंने माना था कि FW–>PT साझाकरण एक दिशा में था। मुझे लगता है कि PT विश्लेषणों को FW भेजना तर्कसंगत है, लेकिन इसे PT9 में चेतावनी के बिना जोड़ा गया था ताकि अप्रत्याशित परिणामों का ध्यान रखा जा सके। मैंने कई अन्य लोगों के साथ बातचीत की है जो हमारी तरह PT इंटरलिनियरेशन “करते” हैं—भाषाविदों के बजाय अनुवाद परामर्शदाताओं को लक्ष्य बनाते हुए, इसलिए मुझे लगता है कि इस विषय में रुचि रखने वाले अन्य लोग भी होंगे।

PT9 उपयोगकर्ताओं के लिए नोट: यदि आपके Paratext परियोजना से कोई FLEx डेटाबेस जुड़ा नहीं है, तो यह आपको इस समय लागू नहीं होगा।

तो यह सहायक होगा यदि कोई हमें यह विवरण दे सके कि PT9 में इंटरलिनियरेशन के दौरान, संबंधित FLEx डेटाबेस के साथ, ठीक-ठीक क्या होता है। उदाहरण के लिए,

  • क्या FLEx में परिभाषित विश्लेषण नियम (parsing rules) PT में लागू होते हैं?

  • क्या PT को FW को विश्लेषण और ग्लॉसिंग जानकारी भेजने से रोकना संभव है?

  • क्या PT इंटरलिनियर तब स्वतः अपडेट होता है जब FLEx प्रत्येक विभाजन/ग्लॉस संपादित किए जाते हैं?

  • जब मैं PT इंटरलिनियर श्लोक में कुछ शब्दों को संपादित करता हूँ (लेकिन उन शब्दों को अनदेखा करता हूँ जिनमें आज मेरी रुचि नहीं है), और फिर श्लोक को पुनः स्वीकृत करता हूँ, तो क्या होता है? क्या इस मामले में पुराने प्रत्येक विभाजन/ग्लॉस FW को भेजे जाते हैं?
    किसी भी अंतर्दृष्टि के लिए पहले से ही धन्यवाद।

English से मशीन-अनुवादित

KimB,

मुझे लगता है कि यह Paratext-Flex एकीकरण के बारे में एक अलग थ्रेड होना चाहिए। यदि यह एक अलग थ्रेड है, तो इसकी उन लोगों द्वारा ध्यान दी जा सकती है जो इस बारे में अधिक जानते हैं। मैं पुनः पोस्ट करने की कोशिश करूँगा।

English से मशीन-अनुवादित

आप सही हैं, anon044949। पुनः पोस्ट करने के लिए धन्यवाद।

English से मशीन-अनुवादित
0 वोट

इस प्रश्न से संबंधित: क्या कोई यह समझा सकता है कि Paratext 9 और FLEx (9, शायद) के बीच क्या हो रहा है, कृपया?

हमारे परियोजना में बहुत सारा PT इंटरलिनियरेशन (interlinearization) है, जो वर्षों से “कम-ज्यादा” किया गया है, सलाहकारों और परामर्शदाताओं के लाभ के लिए, क्योंकि हमें पता है कि “किसी दिन” PT FLEx-शैली के इंटरलिनियरेशन का उपयोग करने के लिए चला जाएगा, जो अधिक सटीक और भाषाई दृष्टिकोण वाला होना चाहिए। हमारे FLEx डेटाबेस को PT परियोजना से कई वर्षों से जोड़ा गया है, लेकिन हमने FLEx में पवित्र ग्रंथों (Scripture) का इंटरलिनियरेशन करने की कोशिश नहीं की है। मुझे साक्ष्य देखने को मिले हैं कि PT9 अब FLEx प्रविष्टियों को ढूँढ रहा है, जो बहुत अच्छा है।

हाल ही में हम FLEx में पवित्र ग्रंथों के अतिरिक्त पाठों (non-Scripture texts) को आयात करने और इंटरलिनियर करने की ओर काम कर रहे हैं। इस सप्ताह, जब हमने कई प्रत्यय (affix) प्रविष्टियों के साथ काम किया, तो हमें कुछ अजीब और चिंताजनक दिखा: ऐसा लगता है कि Paratext प्रत्येक (morpheme) विभाजन और ग्लॉस (glosses) जो हम बनाते हैं, वे स्वतः FLEx में स्थानांतरित हो रहे हैं। क्या यह संभव है, या कुछ और हो रहा है–मैंने पिछले कुछ वर्षों में कम से कम 150 FLEx शब्दकोश प्रविष्टियाँ देखी हैं जो हमारे PT प्रत्येक विभाजन और ग्लॉसिंग शैली जैसी लगती हैं।

हमारी परियोजना कार्य के इस चरण में FLEx में यह स्वतः प्रविष्टि अभी वांछित नहीं है, लेकिन यदि यह हो रहा है तो हमें इसकी जानकारी चाहिए और हमें PT में अपने ग्लॉसिंग प्रक्रियाओं को संशोधित करना होगा। (इस दौरान हमने मुख्य रूप से PT को प्रत्यय युक्त पवित्र शब्दों (Biblical Terms) को पहचानने के लिए व्यक्तिगत श्लोकों का इंटरलिनियरेशन किया है, जो इन FLEx प्रविष्टियों की अपेक्षाकृत कम संख्या का कारण हो सकता है।)

क्या कोई टिप्पणी कर सकता है, कृपया, या PT9 में इंटरलिनियरेशन में परिवर्तनों के मौजूदा विवरण की ओर मुझे निर्देशित कर सकता है?

PT और FLEx दोनों के महान विकास और एकीकरण सुविधाओं के लिए बहुत-बहुत धन्यवाद! हम इसकी बहुत सराहना करते हैं; हमें बस यह जानना है कि परिवर्तन हमारे कार्यप्रवाह (workflow) को कैसे प्रभावित कर रहे हैं।

English से मशीन-अनुवादित
द्वारा (670 अंक)
फिर से दिखाया गया
0 वोट

अपने प्रतिक्रिया के लिए धन्यवाद anon044949।

ऐसा लगता है कि Paratext रूपविद्या विश्लेषण (morphology parsing) वास्तव में उन चीज़ों को नहीं कर रहा है जिन्हें हमने शायद कल्पना की थी। लेकिन अभी के लिए यह जानना पर्याप्त है।
फिर से धन्यवाद।

English से मशीन-अनुवादित
द्वारा (1.3k अंक)

मेरे रूपविद्या (morphology) के उपयोग में, वर्तनी जाँच करने और यह पुष्टि करने के लिए कि बैक ट्रांसलेशन (back translation) ने अनुवाद के काल/अवस्था (tense/aspect) और अन्य विशेषताओं को पर्याप्त रूप से प्रतिबिंबित किया है, मैंने Fieldworks में रूपविद्या विश्लेषक (morphological parser) का उपयोग किया। कुछ भाषाओं के लिए Fieldworks में ध्वनिविज्ञान विश्लेषक (phonological parser) का उपयोग आवश्यक हो सकता है। एक ऐसा मामला तब होता है जब स्वर (tone) भारी व्याकरणिक भार (grammatical load) वहन करता है।

English से मशीन-अनुवादित

संबंधित प्रश्न

0 वोट
2 उत्तर 291 व्यूज़
हम जिस भाषा पर काम कर रहे हैं, उसमें कुछ उपसर्ग (affixes) और क्लिटिक्स (clitics) को मूल शब्द (stem) से अल्पविराम ... इसी प्रकार की सुविधा का सुझाव देने जा रहा हूँ। धन्यवाद, rfkvg
Roland 245 पूछा गया दिसंबर 1, 2021
0 वोट
2 उत्तर 504 व्यूज़
मैं वर्तमान में शब्दसूची (Wordlist) पर काम कर रहा हूँ, और यह सुनिश्चित करने के लिए कि मैं अपडेट हूँ, मैंने अभी ... कोई अंतर्दृष्टि है, तो मैं आपसे सुनना पसंद करूंगा। धन्यवाद rfkvg
Roland 245 पूछा गया नवंबर 30, 2021
Paratext में
0 वोट
2 उत्तर 496 व्यूज़
मैं एक ऐसे परियोजना पर काम कर रहा हूँ जिसमें पहले से ही वर्णन (morphological) विभाजनों के साथ एक शब्द सूची ... दिखता। यंत्रिकी (mechanics) पर एक छोटा सा ट्यूटोरियल सराहनीय होगा।
Kent Spielmann 1.8k पूछा गया मार्च 30, 2021
Paratext में
0 वोट
4 उत्तर 640 व्यूज़
कुछ हफ्तों से प्रोजेक्ट स्टेम-आधारित (stem-based) सेटअप पर ठीक से चल रहा है। यह भाषा कई संयुक्त शब्द (compound words) ... अर्थ माँ है और "over" प्रेफिक्स है जिसका अर्थ μέγας है।)
Tim 934 पूछा गया अप्रैल 24, 2019
Paratext में
0 वोट
2 उत्तर 392 व्यूज़
Today, from a real bit of text, I hit upon a new question: Do I need to give each morpheme on each wordlist- ... plural-nouns, and all those possible prefixes in PT8. Thank you.
Tim 934 पूछा गया अप्रैल 19, 2019
Paratext में
Welcome to Support Bible, where you can ask questions and receive answers from other members of the community.
But if we walk in the light, as he is in the light, we have fellowship with one another, and the blood of Jesus, his Son, purifies us from all sin.
1 John 1:7
3,047 प्रश्न
6,007 उत्तर
5,672 टिप्पणियाँ
2,027 उपयोगकर्ता