0 suara
520 tampilan

Saya memperhatikan apa yang tampaknya menjadi perbedaan biner antara beberapa ID istilah yang muncul di Major Biblical Terms dibandingkan dengan yang digunakan dalam file rendering proyek. ID istilah yang cocok semuanya terlihat sama secara visual jika Anda membuka xml di editor. Tetapi saya sedang membuat prototipe plug-in dan kode saya menemukan perbedaannya. Mungkin itu sesuatu seperti composed vs uncomposed, tetapi saya sama sekali tidak mengerti bahasa Ibrani. Saya memposting tautan ke dua versi Term ID untuk Shem. Satu dari Major Biblical Terms. Yang lain dari TermRenderings.xml di salah satu proyek saya. Kedua ID terlihat sama, tetapi penampil file biner menunjukkan bahwa mereka berbeda.
Terima kasih atas saran apa pun.
stevepence

Shem dari file Renderings
Shem dari Major Terms

Diterjemahkan secara otomatis dari English
Paratext oleh (127 poin) | 520 tampilan

4 Jawaban

0 suara
Jawaban terbaik

Ini mungkin lebih detail dari yang ingin Anda ketahui, tetapi ini adalah pandangan saya tentang masalah normalisasi Ibrani. Unicode menemukan urutan diakritik kanonik yang tidak ideal secara linguistik. Karena urutan diakritik antara diakritik yang tidak berinteraksi bisa bersifat sewenang-wenang, mereka memutuskan untuk tidak mengubah urutan ketika diminta. Tetapi ada beberapa situasi di mana urutan penting untuk diakritik yang berinteraksi dalam bahasa Ibrani dan urutan itu hilang melalui normalisasi. Untuk mengatasi ini, orang-orang menggunakan CGJ (U+034F) untuk memungkinkan urutan diakritik yang berbeda. Ini harus dianggap sebagai bagian dari ejaan kata.

Sementara semua ini sedang dibahas, font sering kali tidak dirancang untuk menangani urutan kanonik Unicode. Tetapi itu sudah lama diperbaiki dan font dapat menangani teks yang diurutkan secara kanonik Unicode dengan baik.

Semua ini untuk mengatakan bahwa saya tidak melihat alasan mengapa data tidak boleh disimpan dalam bentuk normal Unicode (NFC, NFD yang menurut saya identik dalam bahasa Ibrani), tetapi jika Anda memiliki beberapa data legacy (data Unicode lama) maka kehati-hatian harus diambil dalam normalisasi. Secara khusus periksa kata untuk Jerusalem (jika ingatan saya yang kabur tentang kata-kata yang mengandung masalah urutan diakritik) yang harus mengandung CGJ (atau dilihat dengan cermat dengan representasi visual di depan Anda).

Menyangkut contoh Lorna, seharusnya tidak ada kesulitan dengan dua diakritik tersebut karena mereka tidak berinteraksi (satu di atas, satu di bawah).

Diterjemahkan secara otomatis dari English
oleh (656 poin)
0 suara

Untuk mengetahui karakter apa saja yang ada dalam sebuah string, Anda bisa menggunakan UniView 14 . Tempel teks Anda ke dalam kotak yang bertuliskan “text area”, lalu klik pada panah yang menunjuk ke bawah tepat di bawah kotak text area dan Anda akan melihat daftar karakter (bentuk karakter, nilai Unicode, dan deskripsi).

Jika kecurigaan Anda benar dan perbedaannya disebabkan oleh bentuk normalisasi, Anda mungkin ingin menyertakan langkah normalisasi dalam plug-in Anda.

Diterjemahkan secara otomatis dari English
oleh (296 poin)
0 suara

ShemFrompmcdblRendering.txt encoding string: U+05E9 U+05B5 U+05C1 U+05DD
ShemFromMajorTerms.txt encoding string: U+05E9 U+05C1 U+05B5 U+05DD

Jika kita melihat properti Unicode, saya percaya encoding dari ShemFromMajorTerms.txt salah dan dokumen Major Terms mungkin perlu dinormalisasi.
Peringatan: Saya tahu bahwa bahasa Ibrani memiliki beberapa masalah normalisasi Unicode dan saya tidak sepenuhnya memahami di mana normalisasi tidak seharusnya diikuti.

Diterjemahkan secara otomatis dari English
oleh (329 poin)

stevepence,
Saya menduga bahwa semakin banyak organisasi yang menulis plug-in mereka sendiri; orang lain mungkin akan mengalami masalah Anda. Hal itu tidak berdampak pada pengguna Paratext, tetapi tampaknya berdampak pada Anda jika Anda menulis plug-in. Jika daftar Major Biblical terms tidak menggunakan praktik terbaik untuk encoding Ibrani, maka mungkin Anda bisa mendiskusikan kebutuhan Anda dengan anon291708.

Diterjemahkan secara otomatis dari English
0 suara

Terima kasih kepada semua yang membalas. Respons semua orang sangat membantu dalam memahami masalah ini. Saya sangat berterima kasih!

Saya tidak akan berani berkomentar tentang file mana yang memiliki encoding “benar” - tentu saja topik yang kompleks. Keprihatinan saya yang sangat terbatas adalah kemampuan untuk menggunakan id secara tidak ambigu sebagai kunci untuk set data. Jelasnya, alat Biblical Terms mampu menghubungkan id di file yang berbeda dengan benar meskipun ada perbedaan dalam representasi biner mereka, kemungkinan melalui normalisasi on-the-fly.

Karena saya saat ini hanya membuat prototipe, ini sedalam yang perlu saya jelajahi sekarang. Setelah saya mulai mengkodekan plug-in itu sendiri, saya perlu menggali detail tentang bagaimana PT melakukan apa yang dilakukannya di bidang ini.

Saya sekarang memahami masalahnya jauh lebih baik. Terima kasih kepada semua orang!

stevepence

Diterjemahkan secara otomatis dari English
oleh (127 poin)

Di Paratext, semua ID istilah dan ID rendering dinormalisasi ke format NFC saat dimuat untuk mengatasi masalah ini. Sebenarnya, hampir semua data dinormalisasi secara internal saat membandingkan dua string karena masalah ini. Saya menganggap ini sebagai masalah desain Unicode, tetapi itu adalah topik yang berbeda. :stuck_out_tongue_winking_eye:

EDIT: Juga, jika Anda membuat plug-in Paratext, Anda harus menggunakan IProject.GetBiblicalTermRenderings dan IPluginHost.GetBiblicalTermList / IProject.BiblicalTermList untuk menangani Biblical Terms - yang seharusnya menghindari masalah ini.

Diterjemahkan secara otomatis dari English

Terima kasih. Saat ini saya masih bekerja di VBA untuk menyelesaikan prototipe dan mendapatkan umpan balik pengguna. Saya belum mulai melakukan pekerjaan nyata dengan api. Saya sangat berharap bahwa api akan menyembunyikan semua detail ini, tetapi saya menghargai bantuan semua orang dalam memahami masalah-masalah ini - bahkan jika saya tidak pernah harus pergi ke sana.

stevepence

Diterjemahkan secara otomatis dari English

Pertanyaan terkait

0 suara
2 jawaban 199 tampilan
When downloading Paratext 8, I'm told: The Online file is smaller and may be used if you are installing while connected to the ... to download that extra 85Mb, if I don't have to.
jeffh 1,4k bertanya Mar 23, 2017
0 suara
3 jawaban 409 tampilan
We have a problem with language IDs not matching which prevents the Interlinearizer from working. The KPZ project was registered ... or how I can look at those changes. Iver+Larsen
Iver Larsen 869 bertanya Jan 24, 2020
0 suara
2 jawaban 360 tampilan
In PT8 when I compare two project (of the same language) there were two arrows to go backwards or forwards to ... they do not work for difference between two different projects.
anon784407 105 bertanya Jan 13, 2020
0 suara
0 jawaban 154 tampilan
Biblical Term rendering discussion not | Biblical Term rendering description e | The entire history leading to a deci ... Terms tool. See also: Introduction to Biblical Term notes
[Expert]
anon421222
735
bertanya Feb 23, 2017
0 suara
2 jawaban 639 tampilan
Kami memiliki pengguna yang memiliki sejumlah terjemahan yang terkait dengan daftar Istilah Alkitab Kunci PB. Mereka ... alfabetis untuk proses ini. Terima kasih, james_post
[Moderator]
james_post
2,1k
bertanya Nov 10, 2021
Welcome to Support Bible, where you can ask questions and receive answers from other members of the community.
They all joined together constantly in prayer, along with the women and Mary the mother of Jesus, and with his brothers.
Acts 1:14
3,048 pertanyaan
6,007 jawaban
5,672 komentar
2,028 pengguna