0 वोट
954 व्यूज़

क्या विदेशी शब्दों में उपयोग किए जाने वाले अक्षरों (जो कभी-कभी फुटनोट्स में उपयोग किए जाते हैं) को अक्षर सूची (character inventory) में शामिल किया जाना चाहिए? या क्या कोई तरीका है जिससे हम उन्हें मान्य (valid) मान सकें जब वे मूल जाँच (basic checks) में अमान्य (invalid) के रूप में दिखाई देते हैं?

English से मशीन-अनुवादित
Paratext में द्वारा (105 अंक) | 954 व्यूज़

6 उत्तर

+1 मत
सर्वोत्तम उत्तर

इस बातचीत में थोड़ी देर बाद आ रहा हूँ, लेकिन मैं davidc78 से पूरी तरह सहमत हूँ। USFM में (न्यूनतम रूप से) एक marker होना चाहिए (शायद \fo … \fo* - “o” के लिए “other language”) फुटनोट में उपयोग किए जाने वाले शब्दों के लिए जो किसी अलग भाषा में हैं, चाहे वह यूनानी, हिब्रू, क्षेत्रीय LWC, राष्ट्रीय भाषा, अंतर्राष्ट्रीय भाषा, या कुछ भी हो। उस तरह से चिह्नित किए गए शब्दों को wordlist से बाहर रखा जाना चाहिए, और character checking से भी। कुछ उपयोगकर्ताओं को शायद markers का एक सेट चाहिए होगा, जैसे हिब्रू शब्दों के लिए \foh, यूनानी शब्दों के लिए \fog, अरामी शब्दों के लिए \foa, राष्ट्रीय भाषा के लिए \fon, क्षेत्रीय LWC (या शायद संबंधित variety) के लिए \for, आदि, साथ ही Paratext को multiple wordlists (vernacular, यूनानी, हिब्रू, अरामी, आदि) को संभालने में सक्षम बनाना। क्या यह Paratext को FLEx से link करने को भी आसान नहीं बना देगा, शब्दों को बाहर रखकर जो उपयोगकर्ता FLex lexicon में शामिल नहीं करना चाहता? वास्तव में, यदि मैंने वर्णन किया है तो multiple markers होना Paratext को Paratext के भीतर multiple wordlists से link करने की अनुमति दे सकता है, और शायद कई FLex lexicons से भी।

English से मशीन-अनुवादित
द्वारा (264 अंक)

मुझे बाद में पता चला कि \tl एक USFM marker है जिसे फुटनोट के भीतर उपयोग किया जा सकता है, किसी अन्य भाषा के शब्दों को चिह्नित करने के लिए (चाहे वह बाइबली भाषा हो, राष्ट्रीय भाषा हो, या कुछ भी)। हालाँकि, \tl से चिह्नित किए गए शब्द अभी भी wordlist में दिखाई देते हैं। यह वह नहीं है जो मैं चाहता हूँ, और मुझे आश्चर्य होगा यदि कोई इसे चाहता है, क्योंकि वे vernacular के शब्द नहीं हैं। (यदि कुछ उपयोगकर्ता wordlist में ऐसे शब्द देखना चाहते हैं, तो मैं सुझाव दूँगा कि Paratext में केवल उन शब्दों की secondary wordlist बनाने की क्षमता हो जो \tl से चिह्नित हैं।)

English से मशीन-अनुवादित

मैं सहमत हूँ कि यह अच्छा होगा यदि Paratext में vernacular में शब्दों और अन्य भाषाओं में शब्दों (साथ ही अक्षरों में अंतर) को अलग करने का विकल्प हो। हालाँकि, इसका दूसरा पक्ष यह है कि Paratext उन शब्दों की जाँच कर रहा है जो पाठ में मौजूद हैं (और प्रकाशित किए जाएंगे)। शब्द vernacular है या नहीं, जाँच प्रक्रिया के लिए अप्रासंगिक है, जब तक कि यह सुनिश्चित करने की आवश्यकता हो कि शब्द सही वर्तनी के साथ हैं और शायद सही ढंग से hyphenated हैं। Paratext word list उन शब्दों की रिपोर्ट कर रहा है जो publishable पाठ में मौजूद हैं।

English से मशीन-अनुवादित

अच्छा बिंदु।

English से मशीन-अनुवादित
0 वोट

anon070973,

इस पर कुछ विविध राय हैं, लेकिन मुझे लगता है कि सहमति यह होगी कि आप भाषा सेटिंग्स में केवल उन अक्षरों को शामिल करें जो उस भाषा में आते हैं। इसलिए, मैं यूनानी या हिब्रू को भाषा सेटिंग्स में शामिल नहीं करूँगा क्योंकि वे उस भाषा में नहीं आते। हालाँकि, यदि मेरे पाठ में Cristo शब्द है और c अक्षर सामान्यतः मेरी भाषा में नहीं आता, तो फिर भी मैं c अक्षर को अपनी भाषा सेटिंग्स में शामिल करूँगा क्योंकि Cristo अब मेरी भाषा में “उपयोग” किया जाने वाला शब्द है।
अन्य विदेशी अक्षरों के लिए, यदि वे परियोजना में “मान्य” हैं, तो आप उन्हें अक्षर सूची (Character Inventory) में बस मान्य (valid) के रूप में चिह्नित कर सकते हैं।

जबकि मैंने यह राय दी है - मुझे यकीन है कि विभिन्न कारणों से मेरी राय से असहमत होने वाले लोग होंगे।

English से मशीन-अनुवादित
द्वारा (9.9k अंक)
0 वोट

मैं anon848905 से सहमत हूँ कि यदि अक्षर उधार लिए गए शब्दों में आते हैं, तो उन्हें भाषा सेटिंग्स में शामिल किया जाना चाहिए। anon848905 द्वारा कहे गए बात में जोड़ते हुए, मैंने एक ऐसी भाषा में काम किया जहाँ “b” केवल उधार लिए गए शब्दों में था, glottalized b (b’) और “v” मूल शब्दों में थे, और glottal को टाइप करना भूलना, या “b” और “v” को भ्रमित करना आम बात थी।
"b’ ", “b”, और “v” को वैध अक्षरों के रूप में शामिल करने के बाद, गलत शब्दों को खोजने का एक बहुत ही उपयोगी तरीका Wordlist में “Find similar words” (समान शब्द खोजें) कमांड का उपयोग करना था। इन तीन ध्वनियों के जोड़ों को “Letters that sound alike” (जो अक्षर एक जैसे सुनाई देते हैं) बॉक्स में शामिल करके, Wordlist उन शब्दों के जोड़ों की सूची देता था जो केवल ध्वनियों में भिन्न थे। (उदाहरण के लिए, यदि “bolt” और “volt” दोनों अनुवाद में आते थे, तो “b” और “v” की तुलना करने से उन दो शब्दों की सूची आती और बताती कि प्रत्येक कितनी बार आया।)
इसके अलावा, Wordlist में देखकर यह देखना कि अनुवाद में कौन से शब्द आते हैं, वर्तनी त्रुटियों वाले शब्दों को खोजने में मददगार होता है - चाहे वे त्रुटियाँ उधार लिए गए शब्दों के अक्षरों के कारण हों या अपूर्ण लोगों के अनजाने में गलती करने के कारण।

English से मशीन-अनुवादित
द्वारा [Expert]
(735 अंक)
0 वोट

क्या SFMs के साथ विदेशी शब्द को चिह्नित करने का कोई तरीका नहीं होना चाहिए? ऐसा लगता है कि कभी-कभी हमारे अनुवाद फुटनोट में कुछ समझाने के लिए एक फ्रेंच शब्द शामिल करना चाहते हैं, लेकिन इसे SFMs के साथ अलग करना अच्छा होगा, और आदर्श रूप से Paratext character inventory में ऐसे चिह्नित शब्दों को शामिल नहीं किया जाना चाहिए। ऐसे चिह्नित SFMs को अलग रूप से typeset करने की आवश्यकता नहीं होगी, जब तक कि इच्छित न हो।

English से मशीन-अनुवादित
द्वारा (1.4k अंक)

हाँ, हमने वही किया है – फुटनोट्स में LWC का उपयोग करके – और उन अक्षरों को विशेष रूप से Valid (मान्य) के रूप में चिह्नित करने की आवश्यकता है। मुझे संदेह है कि typesetting के समय एक उपयुक्त font चुनने में मदद के लिए उन अक्षरों को चिह्नित करने के लिए SFMs उपयोगी होंगे।

English से मशीन-अनुवादित
0 वोट

मुझे USFM reference में \tl … \tl* मार्कर मिला:
http://ubs-icap.org/chm/usfm/2.4/special_text_character_styles.htm#tl
(आपको उस विशेष SFM की व्याख्या तक पहुँचने के लिए \tl … \tl* लिंक पर क्लिक करना पड़ सकता है…)

इसे इस प्रकार परिभाषित किया गया है:

Transliterated (या विदेशी) शब्द।

उस पृष्ठ पर दिए गए उदाहरण की तरह, उन शब्दों के लिए उस SFM का उपयोग किया जा सकता है जिन्हें आप अलग रूप से (जैसे कि italics में) typesetting में दिखाई देना चाहते हैं। लेकिन उन्हें अलग रूप से दिखाई देने की आवश्यकता नहीं है। मैं कल्पना कर सकता हूँ कि हम फ्रेंच में व्याख्या का हिस्सा बनने वाले शब्दों वाले फुटनोट में उस SFM का उपयोग करना चाहेंगे, लेकिन क्या इसे अलग रूप से typeset किया जाना चाहिए या नहीं, यह टीम के लिए एक प्रश्न होगा। लेकिन यदि हमने उन विदेशी शब्दों को चिह्नित किया, तो शायद उन्हें character inventory में बाहर रखा जा सके।

मैंने character inventory की जाँच की, और यह हमेशा \tl … \tl* मार्कर के भीतर के अक्षरों को शामिल करता है। मुझे लगता है कि यदि यह transliterated और/या विदेशी शब्द है, तो शायद पाठ को character inventory से बाहर रखा जाना चाहिए। या शायद बेहतर होगा, “Show combinations” चेकबॉक्स के नीचे “Include foreign words (\tl)” नामक एक चेकबॉक्स जोड़ें, और जब यह अनचेक्ड हो, तो \tl से चिह्नित पाठ बाहर रखा जाता है। @anon291708 के लिए यह एक अपेक्षाकृत सरल और काफी उपयोगी feature request लगता है?

English से मशीन-अनुवादित
द्वारा (1.4k अंक)

हाँ, Characters Check/Inventory में कुछ विशेष शैलियों में अक्षरों को बाहर रखना सरल होगा।

English से मशीन-अनुवादित
0 वोट

मुझे लगता है कि यहाँ दो अलग-अलग मुद्दों पर विचार किया जा रहा है। एक है विदेशी शब्दों को चिह्नित करना और उन्हें संभालना। यह पहले से मौजूद है। दूसरा मुद्दा यह है कि क्या उन अक्षरों को character inventory में सूचीबद्ध किया जाना चाहिए। मेरी राय में - कोई भी अक्षर जो छपा जाएगा उसे character inventory में सूचीबद्ध किया जाना चाहिए ताकि आप यह सत्यापित कर सकें कि वे अक्षर मान्य हैं या नहीं। Language Settings में आप उन अक्षरों की पहचान करते हैं जो भाषा के हैं, लेकिन आपको वास्तव में यह पहचानने की आवश्यकता होती है कि आपके पास अन्य अक्षर हैं जो छपे जाएंगे। मुझे स्पष्ट नहीं है कि उन अक्षरों को inventory से वैकल्पिक रूप से छिपाने से क्या लाभ होगा। जब आप Character Inventory में अक्षरों को valid के रूप में चिह्नित कर रहे होते हैं, तो आप यह नहीं कह रहे हैं कि ये भाषा के अक्षर हैं, बल्कि यह कि वे इस परियोजना में छापने के लिए valid अक्षर हैं।

English से मशीन-अनुवादित
द्वारा (9.9k अंक)

मैं एक परियोजना में काम करता हूँ जिसमें अलग-अलग भाषाओं को चिह्नित करने के लिए कई उपयोगकर्ता-परिभाषित मार्कर (\zeng, \zgrk, \zheb, आदि) हैं। इससे हम अलग-अलग भाषाओं के लिए अलग-अलग फ़ॉन्ट और लेखन दिशा का उपयोग कर सकते हैं। लेकिन एक अतिरिक्त लाभ यह था कि स्टाइलशीट में उन्हें \nonpublishable के रूप में चिह्नित करने से वे कैरेक्टर इन्वेंटरी में नहीं दिखाई देते, और जो बहुत महत्वपूर्ण है, वर्तनी शब्दसूची (spelling wordlist) में भी नहीं।

जैसा कि ऊपर के लोगों ने टिप्पणी की है, आप कुछ कार्यक्षमता खो देते हैं और अंततः आपको यह जाँचने की इच्छा होती है कि सभी अक्षर मान्य हैं, इसलिए मैं कभी-कभी उस \nonpublishable टैग को हटाकर एक जाँच चलाने के लिए पाता हूँ। और स्पष्ट रूप से, यदि आपका प्रकाशन प्रणाली (publishing system) उस टैग को पढ़ता है, तो आपको इसे हटाना होगा।

English से मशीन-अनुवादित

यहाँ मूल समस्या यह है कि हम एक बहुभाषी दुनिया में काम कर रहे हैं (यूनानी, हिब्रू, स्थानीय भाषा, language of wider communication), लेकिन Paratext में editor इसे पहचानता नहीं है। इसलिए परियोजना X में “सब कुछ” भाषा X में है। और यह दृष्टिकोण बस बहुत सरल है।

यूनानी, हिब्रू, और LWC को चिह्नित करने का एक तरीका चाहिए, अद्वितीय SFM शैलियों (प्रत्येक के लिए) के साथ और इन्हें “Valid/Invalid” सूची में अलग-अलग बनाए रखना चाहिए। और X भाषा के character, spelling, या wordlist inventories के साथ मिलाकर नहीं। (यह भी हो सकता है कि LWC की वैध punctuation भाषा X के लिए अमान्य हो।)

जहाँ हम काम करते हैं, आज हम फुटनोट में LWC से एक शब्द में पाए गए किसी अजीब अक्षर को valid के रूप में चिह्नित कर सकते हैं। लेकिन क्या ऐसा करने से यह संभावना खुलती है कि कोई X भाषा में उस “valid” अक्षर का उपयोग करके typo कर सकता है, क्योंकि हमने इसे valid के रूप में चिह्नित किया था? अर्थात् यह LWC के लिए valid है, लेकिन यदि X भाषा में उपयोग किया जाता है तो यह INVALID है।

तो हम इसमें अंतर कैसे करते हैं? और हम बस इन्हें अलग-अलग भाषाओं के रूप में क्यों नहीं चिह्नित कर सकते? वह सबसे स्पष्ट समाधान लगता है। मुझे पता है कि हर अन्य उचित रूप से शक्तिशाली editor “भाषा” को पहचानता है, निश्चित रूप से हमें अनुवाद के इस व्यवसाय में भी ऐसा करना चाहिए।

माना जाता है, यह बहुत बार आवश्यक नहीं है, लेकिन यह इतनी बार आवश्यक है कि एक समाधान बहुत उपयोगी होगा। (और मैं anon848905 से सहमत हूँ कि बस उन्हें “नज़रअंदाज़” करना एक कम से आदर्श समाधान है।) ये कुछ मामलों में “valid” हैं; हमें Paratext को इतना smart होना चाहिए कि वह context (SFM brackets) को पहचाने और उनके विशेष उपसमूह के आधार पर उन्हें validate करे।

English से मशीन-अनुवादित

संबंधित प्रश्न

0 वोट
2 उत्तर 435 व्यूज़
मेरे पाठ में 3 000 000 जैसे अंक हैं। अक्षरों की सूची जाँच (characters inventory check) मुझे एक त्रुटि दिखाती है: ... रूप में जाँच सकूँ, मैं इस समस्या का समाधान कैसे करूँ?
anon057624 136 पूछा गया सितंबर 6, 2021
0 वोट
2 उत्तर 34 व्यूज़
मेरे पास Paratext में Mixed Capitalization Inventory के बारे में एक प्रश्न है। इंडोनेशियाई भाषा में, हमारे पास अक्सर ... की सराहना करूंगा। आपकी सहायता के लिए बहुत-बहुत धन्यवाद।
Prabhu_beelagi 241 पूछा गया मार्च 10
Paratext में
0 वोट
2 उत्तर 85 व्यूज़
मेरे पास एक प्रोजेक्ट है जिसमें प्रश्न और चिंता के प्रारंभिक चिह्न (opening punctuation) का उपयोग होता है, जैसे कि स्पेनिश ... (invalid) चिह्नित कर सकूँ? पहले से ही धन्यवाद! fork
Fork 184 पूछा गया नवंबर 14, 2024
0 वोट
1 उत्तर 472 व्यूज़
मार्करों के बाद छोटे अक्षरों की सूची में Paratext ने निम्नलिखित को फ्लैग किया है: \fr 4:10 क्या Paratext अंक (digits ... किया जाए, इसलिए ऐसे प्रश्नों की संख्या अधिक हो सकती है!]
Paul 642 पूछा गया मार्च 30, 2023
+1 मत
1 उत्तर 229 व्यूज़
Is it Possible to use same Inventory (Character, Punctuation, Repeated Words ) in Multiple Projects. I have ... different project. Is there a Copy Paste function available.
anon606768 115 पूछा गया दिसंबर 11, 2019
Welcome to Support Bible, where you can ask questions and receive answers from other members of the community.
And I tell you that you are Peter, and on this rock I will build my church, and the gates of Hades will not overcome it.
Matthew 16:18
3,046 प्रश्न
6,006 उत्तर
5,671 टिप्पणियाँ
2,027 उपयोगकर्ता