Dalam tim kami, kami memulai revisi terjemahan Perjanjian Baru yang sudah diterbitkan. Pada awalnya kami optimis, berharap bahwa prosesnya tidak akan memakan waktu lama, dan tidak banyak perubahan yang perlu dilakukan. Sekarang, kami menemukan bahwa lebih dari 90% ayat telah dimodifikasi.
Kami melakukan semua pekerjaan revisi di luar Paratext. Ada banyak alasan untuk itu, yang tidak akan saya jelaskan di sini. Namun, sekarang karena kami mendekati garis akhir, kami perlu bekerja untuk mengimpor pekerjaan tersebut kembali ke Paratext.
Teks yang kami miliki terstruktur sangat sederhana, Anda bisa membayangkannya sebagai tabel, di mana kolom pertama adalah referensi ayat (misal: Markus 1:1), dan kolom kedua adalah isi ayat dalam teks polos. Tidak ada judul, tidak ada penanda paragraf, tidak ada catatan kaki, tidak ada yang seperti itu. Saya ingin mengambil USFM yang ada, dan memperbaruinya dengan teks baru. Saya mengembangkan beberapa kode yang melakukan ini, terutama menggunakan usfm-grammar. Saya mengambil USFM yang ada, mengonversinya ke JSON, memodifikasi JSON untuk memperbarui terjemahan, dan kemudian mengonversi terjemahan kembali ke USFM menggunakan alat yang sama.
Namun, saya memperhatikan bahwa menjaga agar header, paragraf, dan silang-rujukan tetap terjaga itu rumit. Saya menghabiskan satu atau dua hari bekerja pada ini (termasuk proses memutuskan pendekatan ini), dan saya tidak benar-benar ingin menghabiskan banyak waktu untuk memprogram sesuatu jika itu bukan penggunaan waktu yang baik. Ketika saya mengimpor hasilnya kembali ke Paratext, program itu mengeluh tentang USFM yang tidak valid. Jadi sepertinya usfm-grammar dapat menghasilkan USFM yang tidak valid.
Saya mencari pustaka untuk menulis USFM. Saya menemukan cukup banyak opsi untuk parsing USFM dan untuk mengonversi USFM ke format lain, tetapi usfm-grammar adalah satu-satunya pustaka yang saya temukan yang dapat menulis USFM, mengonversi JSON ke USFM.
Saya sekarang melihat dua opsi:
- Melanjutkan pengembangan alat yang dapat menggabungkan revisi teks polos dengan USFM yang ada.
- atau… pada dasarnya memulai proyek baru di Paratext, mengimpor teks polos sebagai USFM, tanpa mencoba menggabungkannya dengan header dan informasi lain dalam terjemahan yang ada.
Saya sudah mencoba opsi 2. Seperti yang bisa Anda bayangkan, cukup mudah untuk menghasilkan output seperti ini:
\id MRK
\c 1
\p
\v 1 the first verse
\v 2 the second verse
\v 3 the third verse
\v 4 etc
Saran apa yang akan Anda berikan kepada saya? Saat ini saya cenderung memilih opsi 2, dan hanya melakukan pekerjaan menambahkan kembali header dan silang-rujukan secara manual. Header perlu direvisi secara manual anyway.