0 suara
646 tampilan

Saya memiliki skrip Teckit (dengan bantuan bagian perangkat lunak inisiatif non-aksara Latin MSEA) untuk konversi antara aksara non-Latin kami (Tibet) ke Latin. Kami memiliki fasilitas di dalamnya untuk kapitalisasi setelah titik penuh dan kami telah memasukkannya ke Paratext 8 untuk transliterasi otomatis.

Ini berfungsi dengan baik jika titik penuh terjadi di tengah ayat atau wilayah backslash; namun skrip kami rusak/gagal ketika ada perintah backslash di antara titik penuh dan karakter berikutnya yang seharusnya dikapitalisasi.

Apakah ada sesuatu di Paratext 8 yang dapat digunakan sebagai alat otomatis untuk mengubah huruf kecil setelah titik penuh menjadi bentuk kapitalisasi di batas kalimat?

Atau apakah ada fasilitas di konverter SIL yang dapat melakukan itu?

Diterjemahkan secara otomatis dari English
Paratext oleh (115 poin)
ditampilkan kembali | 646 tampilan

4 Jawaban

0 suara

Dari komentar Anda, saya menduga bahwa penataan karakter apa pun, atau baris puisi baru (\q1 , \q2) akan menghalangi penerapan aturan tersebut. Demikian pula, nomor ayat (\v # ) juga mungkin menjadi masalah.

Saya tidak memiliki jawaban, tetapi saya memiliki masalah serupa yang mungkin memiliki solusi terkait, jadi saya menumpang di posting Anda.

Yang saya coba lakukan adalah mengubah kapitalisasi judul bahasa Inggris AS menjadi kapitalisasi judul Inggris UK. Gaya judul AS mengkapitalisasi kata pertama dan semua kata kecuali serangkaian kata pendek yang terbatas, sedangkan gaya UK mengkapitalisasi kata pertama dan hanya kata benda khusus. Saya memiliki logika untuk melakukan ini, tetapi saya membutuhkan cara untuk menerapkannya hanya pada teks dalam judul (\s1 , \s2 , dll. ).

Yang saya temukan adalah bahwa proyek transliterasi hanya menerapkan perubahan konverter enkoding pada teks vernakular, dan mereka tidak menyadari konteks markup. Saya memiliki tabel cc yang menerapkan perubahan kapitalisasi dengan benar di luar Paratext, tetapi ketika saya memuatnya ke proyek transliterasi, itu tidak berfungsi dengan benar. Tabel saya membuat perubahan pada semua bidang teks vernakular. Bidang non-vernakular (\id , \rem ) tidak terpengaruh

Agar fungsionalitas transliterasi benar-benar berguna, kita membutuhkan cara untuk membuat perubahan yang menyadari konteks markup. Apakah itu mungkin?

Diterjemahkan secara otomatis dari English
oleh (1,8k poin)
ditampilkan kembali

Sebelum Paratext memungkinkan proyek transliterasi di dalam Paratext itu sendiri, kami
memakai alat TECkit Bulk SFM Converter yang merupakan bagian dari SIL Converters (
http://scripts.sil.org/cms/scripts/page.php?site_id=nrsi&id=enccnvtrs).
Alat ini menggunakan file *.tec yang sama yang digunakan dalam proyek transliterasi di
Paratext tetapi memiliki kemampuan untuk menerapkan konversi hanya pada SFM tertentu.
Satu-satunya masalah dalam menggunakan alat ini adalah bahwa itu harus diterapkan pada
teks secara manual dan di luar Paratext setiap kali teks atau konverter
berubah dan setiap file Kitab Suci (kitab) harus disimpan secara manual, yang menyakitkan ketika
ada 66+ kitab yang harus ditangani.

Doa,

Shegnada J.

Koordinator Teknologi Bahasa & Penerbitan, SIL Nigeria

Ahli Tata Letak Skrip Kompleks, GPS Dallas

Skype: Shegnada.james.

([Phone Removed]

Diterjemahkan secara otomatis dari English
0 suara

Menjawab percakapan ini daripada memulai yang baru karena percakapan ini tampaknya sangat terkait dengan pertanyaan saya:

Kami memiliki Perjanjian Baru yang diterbitkan dalam aksara Arab; ada permintaan untuk menerbitkan teks yang sama dalam aksara Latin.

Ini akan menjadi transliterasi sekali jadi, jadi tidak perlu diperbarui secara dinamis di dalam Paratext. Tetapi saya bertanya-tanya apakah ada yang telah mengembangkan string RegEx untuk membuat karakter awal kalimat menjadi huruf besar? Saya memiliki tantangan yang sama seperti yang disebutkan anon024386 di posting awal, yaitu mendapatkan string untuk melihat di sekitar semua SFM yang mungkin dan melihat kata berikutnya setelah tanda baca akhir…

Diterjemahkan secara otomatis dari English
oleh (175 poin)

Ini adalah tanggapan sampingan terhadap email Anda, bukan jawaban atas pertanyaan Anda tetapi komentar tentang proses Anda.

Dari pengalaman saya, transliterasi tidak pernah menjadi peristiwa sekali jadi yang sederhana seperti yang kita semua harapkan dan layak menggunakan alat transliterasi di Paratext. Anda akan ingin menjalankan semua pemeriksaan Paratext lagi pada proyek yang ditransliterasi dan Anda akan menemukan masalah yang akan membuat Anda mengedit konverter Anda dan teks sumber Anda beberapa kali. Selain itu, pemetaan TecIt jauh lebih kuat dan lebih fleksibel daripada RegEx dan dapat mencakup kebutuhan kapitalisasi Anda di dalamnya. Setelah melakukan proses baik di luar Paratext (ketika tidak mungkin) dan di dalam Paratext, saya sangat mendorong Anda untuk melakukannya di dalam Paratext.

Diterjemahkan secara otomatis dari English

Terima kasih Shegnada! Ya, saya sepenuhnya setuju bahwa tidak ada protokol transliterasi yang akan memberikan hasil sempurna, dan kami perlu menjalankan pemeriksaan di Paratext.

Kami menggunakan TecKit untuk transliterasi, tetapi itu tidak memadai karena beberapa ambiguitas saat beralih dari aksara Arab ke Latin yang tidak dapat (untuk saat ini) diselesaikan oleh algoritma. Jadi kami harus menggunakan pendekatan berbasis kamus/daftar kata untuk transliterasi awal.

Ini menyelesaikan kapitalisasi nama-nama khusus. Tetapi kami mencari cara otomatis untuk menambahkan konvensi kapitalisasi untuk awal kalimat, kutipan, dll.

Semoga ini memperjelas!

Diterjemahkan secara otomatis dari English
0 suara

Anda dapat menggunakan kode berikut untuk mengkapitalisasi huruf di RegexPal:
^^^
Berikut adalah regex yang akan mengkapitalisasi huruf pertama kalimat setelah [.?!] . Ini memungkinkan tanda kutip penutup, paragraf, markup puisi atau daftar yang menyela, baris kosong, nomor ayat, dan tanda kutip awal kalimat. Ini juga mengkapitalisasi setelah \s dan \p , yang mungkin terjadi di awal bab atau setelah judul yang tidak memiliki tanda baca akhir. Anda perlu memeriksa secara manual kata-kata setelah ?" atau !" ini kadang-kadang dikapitalisasi dan kadang-kadang tidak.
Cari:
(?<=([.?!][”’]*(\s+\\(b|p|q|li))*|\\(p|s)?)(\s+\\v\s\S+)?\s+[“‘]*)(\p{Ll})
Ganti:
^^^\6
Kode ini akan mengkapitalisasi kata-kata dalam daftar yang ditandai dengan \li dan puisi yang ditandai dengan \q Jika Anda menggunakan markup yang lebih kompleks: catatan kaki silang-referensi, \q1\q2 \li1 \li2 \pm \pc \qc \qr dll. Anda perlu melakukan penyesuaian.
Catatan Tanda kutip lengkung tidak mencerminkan sehingga mereka perlu dibalik dalam konverter enkoding transliterasi dari RTL ke LTR.

Diterjemahkan secara otomatis dari English
oleh (1,8k poin)
ditampilkan kembali
0 suara

CrazyRocky, terima kasih sangat terlambat untuk RegEx ini untuk kapitalisasi. (Akhirnya kembali ke tugas ini setelah jeda yang lama.) Saya mampu memodifikasi string seperti yang Anda sarankan untuk mengakomodasi tanda kutip kami « » serta penanda \q1 dan \q2, dan itu berfungsi dengan sangat baik.

Saya perhatikan hari ini bahwa di Lukas 2:49-50 kami memiliki catatan kaki di antara tanda baca penutup dan tanda kutip penutup, yang tampaknya mencegah kapitalisasi kata pertama ayat 50:

image

Catatan kaki tersebut berisi terjemahan alternatif dari frasa terakhir kutipan. Apakah Anda menyarankan memodifikasi string pencarian, atau memindahkan catatan kaki?

Diterjemahkan secara otomatis dari English
oleh (175 poin)

CrazyRocky, saya sedang tidak di meja kerja minggu ini, tetapi ingin memberi tahu Anda bahwa Anda dapat menjalankan proses eksternal menggunakan file batch (dengan loop untuk masing-masing dari 66+ kitab) yang hanya mengkonversi penanda tertentu, baik menggunakan pemetaan CC atau TECkit. Satu-satunya catatan adalah bahwa Anda perlu mengganti bab di Paratext (yang bahkan dapat tetap terbuka saat berjalan) untuk memperbarui/memperbarui teks yang ditampilkan.
Pengalaman saya adalah bahwa itu cepat DAN andal.
Saya bisa mengirim contoh kepada Anda di akhir minggu, tetapi saya menduga Anda sudah memiliki pengetahuan tentangnya. :slight_smile:
Doa,
Mark

Diterjemahkan secara otomatis dari English

Pertanyaan terkait

0 suara
1 jawaban 205 tampilan
We have a user who is doing a transliteration from one script in a language to another script in the same language. ... has the reference number of PTXS-17276 Thank you, MSEAIT/LT
MSEAIT_LT 478 bertanya Agu 3, 2018
0 suara
3 jawaban 459 tampilan
I am trying to navigate my first transliteration project. Background information The team is starting typesetting, and has ... are supposed to work and what behavior is expected.
[Moderator]
dhigby
1,3k
bertanya Agu 3, 2018
0 suara
3 jawaban 816 tampilan
Saya sedang mencoba menyempurnakan konverter encoding .tec agar aman untuk perjalanan bolak-balik (round trip) untuk ... RegexPal. Apakah ada saran tentang cara melakukan ini?
DVM 175 bertanya Mar 17, 2021
0 suara
1 jawaban 176 tampilan
I have the main vernacular project in a special script and also a Romanized version using transliteration. When trying to do ... you want to do spell checking on the primary text?
anon650332 163 bertanya Des 31, 2018
0 suara
4 jawaban 344 tampilan
As I am gradually getting more involved in language and dialect adaptations, I keep thinking about what might be the best ... a discussion on this topic with pros and cons, etc.
anon233143 252 bertanya Okt 31, 2018
Welcome to Support Bible, where you can ask questions and receive answers from other members of the community.
For we were all baptized by one Spirit so as to form one body—whether Jews or Gentiles, slave or free—and we were all given the one Spirit to drink.
1 Corinthians 12:13
3,045 pertanyaan
6,005 jawaban
5,671 komentar
2,026 pengguna