+2 suara
2,0k tampilan

Halo semua, saya ingin membahas tentang spasi non-breaking (no-break) (U+00A0) di era penerbitan digital.

Saya bekerja di negara yang secara resmi dwibahasa antara Prancis dan Inggris. Di negara-negara berbahasa Inggris, spasi non-breaking dan setengah spasi jarang ditemukan. Anda mungkin menemukan spasi non-breaking di antara bagian-bagian 1·Tawarikh.

Sebaliknya, sebagian besar penerjemah kami dari wilayah berbahasa Prancis ingin mengikuti aturan spasi Prancis. Di dunia berbahasa Prancis, spasi diperlukan sebelum/sekitar tanda baca dengan 2 tanda (; ! : ? « »). Spasi non-break sering digunakan sebagai pemisah ribuan dalam angka besar, seperti 1·000 (Number Settings - Thousands Separator gets reset - #3 by jeffh). Standar penerbitan bervariasi, tetapi kandidat ideal untuk kasus ini adalah spasi non-break umum (U+00A0) dan spasi non-break sempit (U202F). Ini mencegah tanda penutup dari terdorong ke baris berikutnya, terutama dalam tata letak multi-kolom. Spasi-spasi ini menjaga teks mengalir di komputer di seluruh dunia. Spasi standar (U+0020), spasi tipis (U+2009), dan spasi rambut (U+022A) memiliki lebar yang bervariasi, tetapi tidak memberikan perlindungan yatim piatu yang diperlukan.

Beberapa alat memilih untuk merepresentasikan spasi non-break secara visual sebagai titik samar atau kotak abu-abu. Paratext secara otomatis mengganti spasi non-break (U+00A0) dengan tilde yang sangat besar (~, U+007E). Pada versi saat ini, memasukkan 00A0 dan menekan ALT-X mengganti apa yang seharusnya menjadi spasi non-break dengan spasi sederhana (0020), yang jelas-jelas salah. Tilde raksasa ini sangat mengganggu penerjemah kami, dan oleh karena itu, sebagian besar waktu, penerjemah berbahasa Prancis telah diinstruksikan untuk menggunakan spasi sederhana atau tidak menggunakan spasi sebelum tanda baca, dengan pemahaman bahwa penata letak akan menstandarkan spasi di menit-menit terakhir mengikuti keputusan mereka sebelum pencetakan. Saya sepenuhnya menyadari bahwa tilde raksasa diganti dengan spasi non-break dalam mode pratinjau, dan dapat diganti melalui perubahan Print Draft atau ptxPrint. Teknisi yang kreatif dapat mengonfigurasi PTX print untuk menyisipkan spasi sebelum karakter-karakter tersebut, tetapi kemudian mereka tidak akan terlihat sama sekali di Paratext.

Dari Dokumentasi Paratext:

Karena hal ini, Paratext tidak lagi mendukung penggunaan spasi non-break. Jika Anda ingin menggunakan spasi non-break dalam teks Anda, Anda harus memasukkan tilde sebagai pengganti spasi non-break. Tilde ini dapat dikonversi menjadi spasi non-break saat penataan letak. Tilde yang dimasukkan dalam teks ditampilkan sebagai spasi non-break dalam tampilan Preview.

Jika ini sesuatu yang langka (seperti dalam bahasa Inggris), saya tidak akan khawatir, tetapi ini muncul hampir di setiap paragraf teks berbahasa Prancis. Kekhawatiran saya adalah 1) tilde-tilde tersebut mengganggu bagi penerjemah yang menghabiskan waktu mereka di tampilan standar, dan bagi mereka yang membaca dari bahu mereka, dan 2) bahwa pembatasan ini tidak bertahan di era penerbitan dan berbagi digital ini.

Secara teknis,~seseorang~dapat~bertahan~dan~menerbitkan~melalui~tilde~perantara. Respons staf lapangan terhadap tilde dengan mengabaikan spasi non-break hingga penataan letak tidak lagi layak, karena teks tidak hanya disiapkan untuk dicetak oleh penata letak. Buku-buku individual diterbitkan secara lokal, versi digital dimasukkan ke DBL dan dibuat tersedia, dan Scripture Apps dibuat. Ini berarti bahwa memiliki spasi "final" dalam versi Paratext semakin penting, dan Paratext masih tidak "benar-benar" mendukung ini. (Saya baru saja menemukan hari ini bahwa spasi non-break sempit (U202F) tidak memiliki indikator visual, tetapi untungnya tidak menjadi tilde.) Tampilan/penanganan U+202F yang tidak konsisten, yang seharusnya lebih sempit, dibahas di sini (Deletion of Unicode 202F ("narrow no break space") in project)

LibreOffice menggunakan kotak abu-abu untuk membedakan spasi non-break dari spasi normal. Fitur Show/Hide Word menggunakan lingkaran terbuka untuk spasi non-breaking dan titik terpusat untuk spasi normal.

Apakah para pengembang Paratext akan mempertimbangkan untuk menghapus tilde di antarmuka dan menggunakan sesuatu yang lebih mudah dibaca dan kurang mengganggu? Apakah ini memerlukan perubahan pada USFM, atau hanya Paratext? Penerjemah sudah terbiasa dengan metadata keabu-abuan dalam teks mereka seperti penanda USFM. Titik abu-abu samar · dalam tampilan standar akan membantu membedakan spasi khusus dan spasi normal, bukan? Memilih kotak abu-abu justru akan menunjukkan sifat non-breaking dan panjangnya, yang saya kira adalah alasan LibreOffice memilihnya. Ini akan menjadi kemenangan besar untuk kompatibilitas lintas budaya, saya berharap seseorang lain yang bekerja di dunia berbahasa Prancis dapat memberikan masukan. @jeffh @dhigby @anon023887 ?

Saya memahami dari posting ini (Non-breaking space issues) bahwa tildefikasi diperkenalkan untuk melawan masalah alternation Internet Explorer. Bahkan sekarang, dua spasi berurutan di halaman web membutuhkan setidaknya satu yang diubah menjadi NBSP. Ya, sulit untuk membedakan spasi secara visual, tetapi tim masih harus menstandarkannya.
~ Matthew_Lee
Konsultan Teknologi Bahasa
SIL Kamerun

Untuk memperburuk keadaan, bantuan Paratext memperlakukan spasi non-break sebagai wabah yang harus diberantas (lihat di bawah).

Mengapa saya melihat tilde sebagai pengganti spasi dalam teks saya?
Spasi non-break adalah karakter yang terlihat seperti spasi tetapi tidak mengijinkan…
Spasi non-break adalah karakter yang terlihat seperti spasi tetapi tidak mengizinkan baris untuk patah di lokasi tersebut. Saat membuka teks dengan spasi non-break, jika Anda menemukan bahwa spasi tersebut tampaknya telah diganti dengan karakter tilde (~), ini disengaja. Paratext membuat spasi non-break terlihat dengan menampilkannya sebagai tilde.
Apa yang paling sedikit saya perlu ketahui tentang ini?
Versi-versi awal Paratext kadang-kadang dan salah menyisipkan spasi non-break di mana spasi normal diperlukan. Oleh karena itu, jika Anda melihat tilde sesekali di tempat dalam teks yang Anda yakin sama sekali tidak memerlukan spasi non-break, Anda dapat saja mengganti tilde tersebut dengan spasi.
Bagaimana jika saya ingin menangani masalah ini sekaligus?
Jika Anda TIDAK sengaja menyisipkan spasi non-break atau tilde dalam teks Anda dan oleh karena itu ingin menghapus semua spasi non-break dan tilde, ikuti instruksi di Opsi 1. Jika Anda tidak yakin sama sekali apakah tilde atau spasi non-break disisipkan secara sengaja, periksa dengan orang dukungan CAP Anda sebelum menghapus semuanya, jika tidak Anda mungkin harus memasukkannya kembali secara manual.

             Option 1 (To get rid of all no-break spaces and tildes):
             
                Click the tab of your project to make it the active tab.
                From the Tools menu, point to Advanced and then select Replace No-Break Spaces With Normal Spaces.
                Read the warning message and click Yes if you are sure you wish to continue.

        If your project has been following the USFM manual and so has been manually inserting tildes either to represent no-break spaces or for some other function, follow the instructions in Option 2. Doing this sooner rather than later prevents Paratext from inserting any more occasional unwanted tildes.

             Option 2 (To get rid of no-break spaces, but keep all tildes):
             
                Click the tab of your project to make it the active tab.
                From the Tools menu, point to Advanced and then select Replace No-Break Spaces With Normal Spaces But Keep Tildes.
                Read the warning message and click Yes if you are sure you wish to continue.
        
         See also:
        
          Important information about no-break spaces and tildes
Diterjemahkan secara otomatis dari English
Paratext oleh (231 poin)
ditampilkan kembali | 2,0k tampilan

11 Jawaban

+1 suara
Jawaban terbaik

Ya, saya setuju dengan Matthew_Lee bahwa ini adalah masalah penting, terutama di dunia berbahasa Prancis. Ada beberapa hal yang ingin saya sebutkan dalam analisis saya, tetapi saya akan mencoba merangkumnya (TLDR) di bagian bawah posting ini.

Penelitian online singkat menunjukkan beberapa hal menarik, yang sebenarnya bukan “di luar topik”:

image

Dan beberapa kegagalan yang lucu (di mana mereka jelas-jelas menggunakan spasi biasa - yang dalam kasus ini menyebabkan pemutusan baris):

image

Itulah yang persis ingin kita hindari - bagian tanda baca yang tidak terhubung dengan teks terkaitnya. Jadi, jika kita akan menggunakan semacam karakter spasi untuk memisahkan tanda baca, kita HARUS SELALU menggunakan spasi non-breaking (non-breaking space) dari jenis tertentu.

Dua opsi utama adalah Full No-Break Space (NBSP, U+00A0), atau Narrow No-Break Space (NNBSP, U+202F), yang definisinya dapat ditemukan dalam standar Unicode, di https://unicode.org/charts/PDF/U0090.pdf dan https://unicode.org/charts/PDF/U2000.pdf, masing-masing:

image
image

Sebagaimana Anda lihat, definisi NNBSP menyatakan bahwa lebarnya biasanya sama dengan lebar spasi tipis (thin space), yang didefinisikan dalam grafik yang sama sebagai :

image

Jadi, NNBSP biasanya berukuran seperlima em (0.2em). Seberapa besar spasi biasa atau NBSP? Metrik ini bergantung pada font, tetapi perhitungan kasar dengan font Charis SIL menunjukkan bahwa karakter spasi dan NBSP berukuran sekitar 0.34em. NNBSP berukuran sekitar 0.22em. Ini adalah perbedaan yang signifikan, dan jika Anda menggunakan NBSP (atau sebagai langkah sementara, spasi biasa, yang memiliki kelemahan berupa pemutusan baris) di sekitar tanda baca, para typesetter yang saya kenal akan mengatakan bahwa spasi itu terlalu besar. Penggunaan NNBSP sangat membantu, dan dapat dilakukan dengan cukup mudah di PTXprint dengan perubahan seperti baris-baris berikut di PrintDraftChanges.txt:

' *:'  >    '\u202f:'     # Place non-breaking thin space before colon
'« *' >    '«\u202f'     # Place non-breaking thin space after opening guillemets
' *»' >    '\u202f»'     # Place non-breaking thin space before closing guillemets
'‹ *' >    '‹\u202f'     # Place non-breaking thin space after opening guillemets
' *›' >    '\u202f›'     # Place non-breaking thin space before closing guillemets

Ini menempatkan NNBSP sebelum atau sesudah (sesuai kebutuhan) tanda baca, dan juga menghapus spasi apa pun yang ada (jika ada). Artinya, terlepas dari apakah tim memasukkan spasi atau tidak, spasi tersebut akan dinormalisasi menjadi karakter NNBSP. Misalnya, dalam proyek ini, tim tidak konsisten dan menggunakan (spasi) biasa di sekitar tanda tanya dan titik dua, tetapi tidak di sekitar tanda kutip (guillemets):

Perhatikan bahwa Anda dapat melihat bahwa ini hanyalah spasi biasa jika Anda menyesuaikan zoom dan/atau ukuran panel dengan tepat, karena spasi tersebut akan memungkinkan pemutusan baris, seperti ini:

Tetapi perubahan di atas seharusnya dapat menangani kedua kasus tersebut dengan baik, dan menyisipkan NNBSP untuk typesetting.

Dengan cara yang serupa, Anda akan ingin menempatkan aturan perubahan dalam proyek SAB Anda, untuk memastikan bahwa aplikasi Alkitab Anda menangani spasi dengan benar. Periksa posting ini untuk contoh aturan: https://community.scripture.software.sil.org/t/suggestions-for-changes-gallery/590/3.

Perhatikan bahwa aturan dalam posting ini tidak menangani spasi atau tanpa spasi seanggun aturan di atas, tetapi Anda dapat menyesuaikannya dengan trik seperti " *" yang digunakan di atas.

Dan satu poin tambahan sebelum kita masuk ke Paratext… Dalam pekerjaan typesetting baru-baru ini, kami sebenarnya telah menggunakan sepersepuluh em (0.1em) sebagai spasi di sekitar tanda baca, yaitu lebih kecil dari NNBSP. Berikut adalah definisi tanda baca yang kami gunakan:

\catcode`\:=\active \def:{\unskip\kern0.1em\char`\:{}} % colon

Catatan: ini dilakukan dalam XeTeX, tetapi hal yang sama dapat dilakukan dengan PTXprint. Saya percaya Anda akan ingin mendefinisikannya dalam file konfigurasi ptxprint-mods.tex yang tersedia di tab tool Advanced. Ini memberikan spasi yang cukup minimal di sekitar tanda baca, seperti yang terlihat dalam contoh ini:

Tetapi tim-tim tersebut merasa bahwa itu adalah spasi yang cukup untuk memenuhi kebutuhan mereka akan spasi di sekitar tanda baca yang diperlukan dalam bahasa Prancis. (Tentu saja, orang Prancis mungkin tidak setuju, tetapi itu bukan bahasa mereka!)

Kesimpulan (TLDR): Jadi, apa artinya ini untuk Paratext?

Jika tim menggunakan spasi biasa dalam teks untuk menggeser tanda baca mereka, maka kadang-kadang itu akan muncul dengan tidak benar di layar mereka di Paratext (yaitu, dengan tanda baca yang tidak terikat dengan benar pada teksnya, seperti yang ditunjukkan di atas), yang mengganggu tetapi bukan akhir dari dunia. Dalam kasus ini, tanggung jawab ada pada typesetter atau pembangun aplikasi untuk mengubah spasi biasa tersebut secara tepat. Sayangnya, jika ini adalah bentuk yang dimasukkan ke dalam DBL (sangat mungkin), maka aplikasi seperti YouVersion akan mengalami masalah, karena mereka terkenal TIDAK menangani spasi tersebut dengan tepat.

Dengan kecenderungan ini menuju spasi non-breaking yang semakin kecil untuk memisahkan tanda baca (pertama NNBSP pada 0.2em, kemudian typesetting manual pada 0.1em dengan PTXprint) yang telah saya lihat dalam proyek typesetting saya, saya hampir selalu merekomendasikan agar tim TIDAK menempatkan spasi di sekitar tanda baca mereka di Paratext, dan kemudian hanya mempercayakan typesetting atau pembangunan aplikasi untuk melakukan hal yang benar di sekitar tanda baca tersebut. Ini berarti bahwa ketika teks dimasukkan ke dalam DBL, YouVersion tidak akan memiliki tanda baca yang menggantung. (Tidak akan ada spasi di sekitar tanda baca juga, tetapi itu adalah masalah yang lebih kecil menurut saya.)

Jadi, dengan rencana tindakan spesifik ini, tidak diperlukan perubahan di Paratext. Jika Anda menginginkan, seperti yang disarankan Matthew_Lee, cara untuk menampilkan karakter NNBSP atau NBSP, saya pikir itu akan menjadi ide yang bagus, tetapi keyboard kami juga perlu memiliki cara untuk mengetik karakter-karakter tersebut (yang tidak selalu tersedia), dan Paratext perlu tahu untuk tidak mengutak-atik karakter-karakter tersebut. (Dan inventaris tanda baca perlu menunjukkan semua kombinasi dengan spasi-spasi tersebut, untuk memastikan bahwa mereka digunakan secara konsisten, misalnya, selalu dengan NNBSP.)

Posting ini tidak begitu banyak mengusulkan solusi, melainkan menyediakan lebih banyak latar belakang dan informasi. Saya benar-benar tidak suka cara kerja tilde / NBSP ini di Paratext sekarang, dan setuju bahwa itu harus berubah. Sepertinya Paratext harus mengasumsikan bahwa ia harus mengambil setiap karakter dalam teks secara apa adanya, baik itu tilde, NBSP, atau NNBSP. Dan cara untuk melihatnya (secara halus) akan menjadi hal yang bagus. Apakah dua atau lebih spasi harus digabungkan secara otomatis (menanggapi @anon942452)? Mungkin jika mereka adalah karakter yang identik? Itu masih akan memungkinkan perbaikan spasi otomatis Paratext, tetapi juga menyediakan beberapa opsi untuk menghindarinya. Dan seseorang juga perlu memikirkan cara untuk menangani semua proyek legacy yang memiliki tilde untuk spasi non-breaking, mungkin hanya konversi, untuk mengubah semuanya menjadi NBSP, setelah itu ditangani dengan benar di Paratext.

Nah, beberapa bahan pemikiran lagi…

Diterjemahkan secara otomatis dari English
oleh (1,4k poin)

Beberapa bahasa nasional di Asia Tenggara menggunakan spasi antara frasa dan bukan antara kata. Beberapa bahasa minoritas yang menggunakan skrip ini telah memilih untuk menggunakan spasi biasa antara setiap kata dan spasi yang lebih lebar pada jeda frasa. Jika EM SPACE (\u2003) digunakan untuk jeda frasa spasi lebar ini di Paratext, maka Inventaris Karakter dan Tanda Baca memperlakukan EM SPACE sebagai karakter pembentuk kata alih-alih tanda baca, sehingga tidak mungkin untuk memeriksa urutan yang benar. Saya telah melaporkan ini sebagai PTXS-31753.

Ketika jeffh merekomendasikan agar penerjemah meninggalkan spasi Prancis sepenuhnya dari Paratext, ia membantu memastikan bahwa teks di Paratext menandai struktur/makna secara tidak ambigu dengan biaya presentasi yang lebih jelek. Saya melakukan hal yang sama ketika saya merekomendasikan penggunaan koma alih-alih EM SPACE di dalam Paratext. Tetapi pengguna benar untuk menolak kedua saran tersebut; saya juga sangat lebih memilih WYSIWYG di Microsoft Word daripada perintah titik WordStar yang saya gunakan di komputer pertama saya.

Saya ingin melihat Paratext menambahkan opsi “Tampilkan Karakter Tak Terlihat” yang akan, misalnya, menampilkan karakter spasi sebagai kotak abu-abu. “Tampilkan Karakter Tak Terlihat” ini akan sangat bermanfaat bagi bahasa-bahasa yang mengetik Zero Width Space (\u0200b) antara setiap kata. Saat ini Paratext merekomendasikan agar garis miring (/) diketik antara setiap kata. Garis miring ini kemudian (dengan jelek) terlihat di semua tampilan kecuali Preview.

Saya bertanya-tanya apakah area berbahasa Prancis dapat menemukan font yang (1) membuat ~ jauh lebih tidak mencolok atau (2) secara otomatis menyesuaikan spasi di sekitar tanda baca sesuai konteks.

Doa berkat,
LivingField

Diterjemahkan secara otomatis dari English

Kadang-kadang bisa menjadi kerugian bagi Paratext untuk mengakomodasi permintaan kustomisasi. Ini terutama berlaku ketika kustomisasi tersebut tidak didukung di perangkat lunak lain atau ketika itu memungkinkan pilihan yang bertentangan dengan arah yang diambil oleh perangkat lunak komersial. Komunitas bahasa kemudian membuat pilihan yang menjadi jalan buntu untuk pengembangan masa depan mereka di luar Paratext. (Tentu saja, ini juga telah sangat membantu dalam situasi lain, masalahnya hanya kompleks dan perlu dipikirkan dengan cermat.)

Tetapi dalam percakapan ini, kita berbicara tentang akomodasi untuk pilihan yang saat ini tersedia di perangkat lunak komersial serta alat yang sudah umum tersedia. Jika disajikan dengan cara ini dalam permintaan fitur, saya pikir kita bisa mencapai kemajuan. Mungkin mereka yang paling berpengetahuan tentang hal itu bisa memiliki percakapan terpisah di luar daftar tentang cara terbaik ke depan untuk menyajikan permintaan fitur dan apa yang sebenarnya paling dibutuhkan.

Doa berkat,

Diterjemahkan secara otomatis dari English
0 suara

Terima kasih Matthew_Lee, atas email Anda yang bermanfaat dan informatif. Saya tidak memiliki solusi untuk ditawarkan tetapi sangat tertarik dengan topik ini dan belajar lebih banyak dari ketelitian Anda. Saya terutama bergulat dengan karakter tak terlihat RTL dan LTR yang memengaruhi skrip kompleks kami. Jika ada cara untuk membuat semua karakter tak terlihat sedikit terlihat (atau mengaktifkan/menonaktifkan visibilitas dengan tombol ctrl mungkin), itu bisa membantu untuk lebih mudah menyelesaikan beberapa masalah rumit yang kami hadapi. Pendekatan itu juga mungkin membuat spasi non-breakable normal layak digunakan di Paratext meskipun saya tidak tahu tentang hambatan lain yang mungkin ada di sisi pemrogramannya.

Berkat,

Diterjemahkan secara otomatis dari English
oleh (1,3k poin)
ditampilkan kembali
+1 suara

Halo Matthew_Lee, terima kasih telah mengangkat hal ini. Saya bekerja dengan bahasa-bahasa First Nations di Amerika Utara yang menggunakan aksara non-Romawi (Syllabics Kanada), dan beberapa ortografi utama yang menggunakan aksara ini memanfaatkan berbagai lebar (tiga lebar) spasi putih untuk menunjukkan batas morfem dan kata. Spasi kata normal 0020 jauh lebih lebar pada font syllabic yang disarankan, yang berfungsi dengan baik di Paratext. Namun, narrow-no-break-space (U+202F) lebarnya 1/3 dari spasi kata normal. Penggunaan spasi ini sangat penting dalam bahasa kami juga–ia perlu digunakan di dalam kata sebagai batas morfem dan juga (seperti yang dilakukan dalam bahasa Prancis) untuk memisahkan tanda baca dari akhir kalimat. Terakhir, dalam banyak situasi, lebar non-breaking space ketiga diperlukan. Selama bertahun-tahun, komunitas bahasa yang kami kerjakan telah menggunakan dua narrow no-break-space (U+202F U+202F) secara berurutan untuk menyediakan non-breaking space antara prefiks dan akar kata, mencegah kata yatim di akhir baris dan memberikan isyarat visual tentang awal akar kata. Lebar ini setara dengan 2/3 spasi kata standar.

Sayangnya, sejak Paratext 7, ada algoritma paratext yang menghapus dua karakter spasi putih identik yang berurutan dan menggantinya dengan satu. Kami harus menemukan solusi sementara yang janggal dengan membuat keyboard keyman yang menyisipkan zero-width non-breaking space (U+200D) untuk mencegah Paratext mengganti double-thin-space yang disengaja (U+202F U+202F) menjadi hanya satu.

Saat mengekspor kitab suci kami ke DBL, urutan ini tidak dapat diterima, jadi kami harus menjalankan program konversi terlebih dahulu yang mengganti semua urutan (U+202F U+200D U+202F) dengan non-breaking space “standar” (di Paratext, “tilde”, yang menjadi U+00A0).

Nah, semua itu untuk mengatakan bahwa saya mendukung topik Anda tentang meninjau ulang tilde sebagai non-breaking space, karena alasan yang Anda berikan, dan saya ingin memberikan masukan dengan aksara yang menggunakan tiga lebar spasi putih yang berbeda.

Hormat saya, anon942452 J

Diterjemahkan secara otomatis dari English
oleh (106 poin)

Teknologi web modern cenderung mengompresi spasi duplikat tanpa bertanya, tetapi BIASANYA memungkinkan pergantian antara beberapa jenis spasi. Karena alasan ini, desainer web telah lama menyalahgunakan spasi dengan mengganti-ganti spasi biasa dan nbsp (non-breaking space) alih-alih mengatur indentasi. @anon942452 telah menemukan metode yang berhasil untuk menimpa pembersihan sampah otomatis dengan cara yang sama.

Jika saya memahami dengan benar, saya setuju dengan @Shegnada bahwa memungkinkan pengguna melakukan hal-hal di Paratext yang sudah berfungsi di alat perusahaan seharusnya berisiko rendah, tetapi membuat alur kerja kustom baru yang hanya akan berfungsi di Paratext akan menempatkan komunitas dalam tantangan literasi dan penerbitan di kemudian hari. Saya telah melihat ini pada orang-orang yang mengurung diri mereka sendiri dalam font yang diretas dan makro lama.

Saya berharap Paratext dapat belajar mendukung semua jenis spasi, sehingga proyek Paratext dapat menjadi standar emas.

Tantangan pertama adalah menerima spasi tersebut dan membiarkannya lolos ke DBL dan penerbitan digital/cetak. Mungkin saya seorang optimis, tetapi aplikasi seluler, inDesign, dan HTML seharusnya tidak menjadi masalah karena ini adalah glif Unicode dalam font yang disarankan. TeX (PTXPrint) akan memerlukan sedikit pra-pemrosesan, tetapi alat-alat dalam TeX ada untuk mengelola ini. Jika alat hilir seperti YouVersion perlu belajar menggunakan spasi/pecah lanjutan, itu adalah diskusi yang layak dilakukan.

Tantangan kedua adalah membuatnya lebih mudah untuk bekerja dengan spasi lanjutan di Paratext. Saya akan SANGAT SUKA melihat kotak abu-abu untuk spasi non-breaking. Alat tanda baca mungkin saja berfungsi karena sudah menampilkan nilai Unicode untuk kombinasi.

Diterjemahkan secara otomatis dari English
0 suara

Saya pikir sebagai usulan awal, kita bisa meminta Paratext untuk menambahkan opsi “Tampilkan format tersembunyi” di menu Project View. Ketika Anda melakukan itu di Word, Anda mendapatkan berikut ini untuk serangkaian tiga spasi, tiga NBSP, dan tiga NNBSP (202F):
image
Di LibreOffice Writer Anda mendapatkan:
image

LO Writer tidak menampilkan NBSP, dan tidak ada satu pun yang menampilkan NNBSP. Untuk menjadi standar emas, kita ingin melakukan itu. Tetapi Anda juga tidak ingin memiliki simbol yang berbeda untuk setiap format tersembunyi yang mungkin, jadi apakah kita beralih ke menampilkan kode karakter, kecuali untuk beberapa karakter utama seperti spasi dan NBSP (yang akan memiliki simbol), mungkin dalam pola diagonal kecil? Bagaimana dengan sesuatu seperti ini:

Saya pikir membantu untuk menampilkan format tersembunyi dalam warna yang berbeda. Matthew_Lee menyarankan abu-abu, LO Writer menggunakan biru, Word tetap menggunakan hitam. Saya juga menyukai ide abu-abu, tetapi kuncinya adalah mendapatkan nuansa abu-abu yang tepat, sehingga terlihat tetapi halus.

Jelas jika kita menampilkan kode karakter, maka semua taruhan lepas untuk lebar karakter sebenarnya. Itu juga berlaku untuk format tersembunyi yang ditampilkan di Word atau LO Writer.

Mengenai “penyederhanaan” spasi di Paratext, saya akan mengusulkan agar Paratext terus memadatkan beberapa spasi menjadi satu spasi, tetapi HANYA untuk spasi aktual U+0020. Spasi lain atau karakter format tersembunyi akan dipertahankan.

Secara bertahap kita mungkin ingin memiliki beberapa pintasan untuk MENGETIK karakter format tersembunyi tersebut langsung di Paratext juga, tetapi untuk saat ini, kita bisa mengandalkan AUTOCORRECT.TXT dan/atau keyboard Keyman untuk mengetik karakter-karakter tersebut.

OK, jadi itu satu ide, dilempar ke arena… Apa pro dan kontranya? Ide lain apa yang Anda miliki?

Diterjemahkan secara otomatis dari English
oleh (1,4k poin)

Ini yang saya maksud dengan LibreOffice (6) menampilkan NBSP seperti yang saya ingat: Ini bahkan bukan mode tampilkan semua karakter, hanya tampilan normal. Saya percaya ini adalah bawaan. Apakah tidak sama di LO 7?

image

Anda benar bahwa itu tidak menampilkan NNBSP (bahkan dalam mode tampilkan semua, tetapi kita mendapatkan titik-titik yang berguna untuk dihitung untuk NBSP dan spasi.

image

Usulan diagonal jeffh itu elegan, tetapi kita membutuhkan font dengan huruf-huruf tersebut. Ada font yang sudah ada yang menggunakan kotak alfanumerik untuk menampilkan nilai Unicode dari font.

image

Saya takut bahwa memungkinkan spasi non-normal duplikat akan menghasilkan indentasi multi-spasi seperti yang sudah disalahgunakan orang di Word, tetapi itu akan sejalan dengan standar web lain dalam aliran teks.

Saya sudah memiliki NBSP di keyboard saya selama bertahun-tahun, tetapi saya juga memiliki hal-hal seperti dagger, hak cipta, dan lingkaran kosong.

Diterjemahkan secara otomatis dari English

Ada opsi yang dimatikan dalam konfigurasi LO Writer 7 saya di Tools - Options - LibreOffice Writer - Formatting Aids, opsi Non-breaking spaces dimatikan. Dengan itu diaktifkan, saya mendapatkan kotak abu-abu yang Anda bicarakan:
image
Tetapi bukan titik…

Diterjemahkan secara otomatis dari English
+1 suara

Ini adalah percakapan yang sangat menggembirakan. Sangat menyenangkan mendengar tentang kebutuhan dan potensi solusi dalam konteks Paratext dan alat lain. Saya perkirakan ini adalah sesuatu yang akan “berguna bagi banyak orang” dan karenanya kemungkinan besar akan dipertimbangkan di depan beberapa fitur yang kurang berguna.

(Sebagai catatan sampingan - karena saya pikir saya melihat beberapa penyebutan tentang cara mengetik beberapa karakter yang tidak muncul di keyboard standar … Bagi mereka yang belum tahu, mengetik karakter yang tidak biasa tanpa aplikasi pihak ketiga dapat dibuat lebih mudah dengan menggunakan aplikasi Character Map di Windows. Ketika Anda mengklik karakter di peta karakter, itu menampilkan pintasan “Keystroke” di bagian kanan bawah aplikasi untuk banyak karakter. Pintasan tersebut dapat diketik dengan menahan Alt dan mengetik empat angka dari numpad (bukan angka di atas huruf). Misalnya: Alt+0160 mengetik no-break space (U+00A0), Alt+0169 menghasilkan simbol ©, en-dash adalah Alt+0150 –, sedangkan em-dash adalah Alt+0151 —.)

Diterjemahkan secara otomatis dari English
oleh [Moderator]
(1,2k poin)

ditampilkan kembali
0 suara

Hanya satu komentar mengenai penerbitan digital melalui DBL. Pengunggah Paratext menghapus spasi non-breaking saat membuat bundle USX yang kita bagikan dengan penerbit. Sayangnya, ketika teks dibagikan secara digital, spasi non-breaking secara historis telah menyebabkan masalah.

Diterjemahkan secara otomatis dari English
oleh (192 poin)

Dan bagaimana jika TIDAK menggunakan spasi non-breaking? Berikut adalah halaman acak dari Parole de Vie, terjemahan Prancis yang sangat dihormati seperti yang dilihat di YouVersion, aplikasi Alkitab yang sangat dihormati:

Perhatikan tanda baca yang rusak (masalah) yang disorot. Saya meremang setiap kali melihat itu, dan saya melihatnya BANYAK di teks yang diambil dari DBL tepat (saya bayangkan) karena spasi non-breaking yang valid telah dikonversi menjadi spasi biasa.

Jika kita menangani spasi non-breaking dengan baik di Paratext, maka saya pikir pengunggah seharusnya tidak menghapusnya saat mengunggah ke DBL. Jadi mari kita lakukan!

Diterjemahkan secara otomatis dari English

Saya setuju bahwa mereka “secara historis” telah menyebabkan masalah. Ini akan berlaku secara keseluruhan sebelum Unicode, tetapi jika produsen konten dan penerbit hilir masih belum belajar mendukung spasi khusus, sudah saatnya mereka melakukannya.

Menghapus NBSP saat ini adalah kesalahan, karena teknologi tampilan yang kita gunakan semuanya memiliki proses untuk menangani spasi yang dikodekan dengan benar (HTML, XML, TeX, inDesign), dan spasi-spasi ini adalah bagian dari pedoman gaya untuk banyak bahasa mayoritas dan minoritas di dunia. Kode apa pun yang berada di bawah Paratext memiliki kemungkinan untuk diubah, termasuk tampilan internal dan ekspor USX. TeX dan SAB sudah menangani semua spasi ini, jika tidak hack print-draft-changes tidak akan berfungsi di print draft atau ptxPrint (mungkin seseorang dari PTXPrint bisa memberikan pendapat). Jika standar USFM dan USX saat ini melarang spasi non-breaking, mereka perlu diperbaiki.

Saya tahu bahwa perubahan ini perlu dilakukan ke seluruh pipeline, tetapi itu tidak membuatnya kurang penting. Paratext, Chorus, USFM, USX, dan lainnya perlu berhenti menghapusnya dan mulai mendukung serta menampilkannya. Saya menduga bahwa kasus tepi utama akan terjadi jika seseorang memilih untuk mengganti SETIAP spasi dengan NBSP dan meluapi baris.

Di sini di Kamerun, saya masih berbicara tentang karakter IPA dalam bahasa tersebut sebagai “karakter khusus”, tetapi dengan dukungan luas yang kita miliki, salah satu ahli bahasa di sini baru-baru ini mengingatkan saya bahwa kita seharusnya hanya menyebutnya “karakter”. Alat-alat yang tidak dapat mendukung berbagai karakter dalam teks menjadi semakin jarang. Batas akhir tampaknya adalah mendukung karakter khusus dalam nama folder untuk perangkat lunak baris perintah Windows. Windows telah mendukung ini selama bertahun-tahun, tetapi hal-hal masih menjadi rusak.

~Matthew_Lee

Diterjemahkan secara otomatis dari English

Halo jeffh,

Saya telah mengirim kekhawatiran Anda kepada teman-teman kami di YouVersion…meskipun saya percaya proses untuk mengkonversi spasi non-breaking menjadi spasi biasa dilakukan di pengunggah Paratext, bukan di sisi YouVersion (atau penerbit lainnya).

Diterjemahkan secara otomatis dari English

Terima kasih telah menghubungi pihak YouVersion @anon175865. Ya, seperti yang Anda sebutkan, saya bayangkan bahwa spasi non-breaking apa pun sudah hilang di DBL, dihapus oleh pengunggah Paratext. Jadi itu bukan kesalahan mereka. Yang @Matthew_Lee dan saya katakan adalah bahwa kita perlu memperbaiki pipeline kita, sehingga Paratext nyaman dengan dan dapat dengan mudah menangani spasi khusus ini, dan pengunggah tidak akan menghapusnya. Maka mereka akan ada di DBL, dan ketika YouVersion menggunakan teks-teks tersebut, mereka akan muncul dengan benar di layar.

Diterjemahkan secara otomatis dari English
+1 suara

WSTech membahas beberapa masalah dalam thread ini, dan saya ingin mengirim ringkasan:

  • Saya menduga bahwa tilde yang sangat besar yang ditampilkan (untuk NBSP) berasal dari font Charis SIL. Jika font skrip Latin lain digunakan, apakah ukuran tilde berubah?
  • Ada font yang secara otomatis menyesuaikan spasi di sekitar tanda baca (yang diperlukan di wilayah berbahasa Prancis) tetapi tampaknya jarang. Jadi memasukkan spasi yang diperlukan tampaknya pendekatan terbaik.
  • Menggunakan font terpisah untuk menampilkan nilai Unicode dari spasi (yaitu, bukan font utama yang digunakan untuk teks) seharusnya berhasil.
  • PTXprint dapat menangani semua karakter spasi yang berbeda.
Diterjemahkan secara otomatis dari English
oleh (185 poin)

WSTech juga baru-baru ini menyesuaikan lebar spasi di font kami. Untuk kompatibilitas mundur, font skrip Latin (dan mungkin beberapa lainnya) tidak mengikuti rekomendasi baru kami untuk semua spasi, hanya beberapa spasi.

Diterjemahkan secara otomatis dari English

Saya merasa termotivasi mendengar dari begitu banyak orang, termasuk WSTech dan Paratext. Bagaimana kita melangkah maju dengan ini, apakah ini perlu ditulis sebagai permintaan fitur dan melewati proses prioritas normal?

Isu-isu besar (yang dapat ditangani secara terpisah) adalah:

  1. Memungkinkan karakter NBSP dan karakter serupa yang disebutkan dalam thread ini ada di seluruh pipeline PTX/USFM/USX/DBL (dan menangani masalah tampilan yang muncul sesuai kebutuhan). Ini adalah rintangan pertama dan paling penting. Kemudian kita dapat "memperbaiki" spasi di proyek-proyek individu ke depannya.
  • Karakter-karakter ini perlu ditampilkan dengan benar di PTX standar dan pratinjau.
  • Dikenali secara individual dalam pemeriksaan Tanda Baca dan Karakter.
  • Diterima dalam pengaturan Kutipan dan Angka (perhatikan bahwa FLEx menggunakan titik untuk menunjukkan spasi dalam Configure Dictionary).
  1. Menyediakan cara di dalam Paratext untuk memvisualisasikan karakter-karakter ini.
  • Font sementara khusus telah diusulkan sebagai kemungkinan.
  • Kotak abu-abu yang selalu aktif telah diusulkan.
  • Fitur tampilkan semua karakter yang mirip dengan Word/LibreOffice.
    • Salah satu pengguna saya mengusulkan bahwa fitur Tampilkan/Sembunyikan membuka dialog (mirip dengan dialog Basic Checks) yang memungkinkan Anda menentukan karakter khusus mana yang akan ditampilkan (spasi normal, spasi NB, penghubung, tanda hubung non-breaking, penanda bidireksional, dan pengembalian lunak dan keras). Saya bisa membayangkan kasus di mana teknisi ingin semua penanda disorot (yang sering saya lakukan di alat eksternal), serta situasi di mana tim hanya perlu penanda "khusus" disorot.
    • gambar

~Matthew_Lee

Diterjemahkan secara otomatis dari English

Ya, itu akan menjadi opsi terbaik. Mengaitkan thread ini dalam permintaan fitur apa pun juga akan membantu.

Bagi siapa pun yang tidak familiar dengan proses membuat permintaan fitur - ini tersedia untuk semua pengguna Paratext. Dari menu utama Paratext, pilih Help > Give feedback dan pilih opsi Make a suggestion... di formulir yang muncul.

Jika seseorang merasa permintaan fitur sangat penting atau berguna, layak untuk membuat perwakilan area atau organisasi Anda untuk Paratext mengetahui hal ini. Mereka mungkin memilih untuk menyajikannya dalam pertemuan prioritas Paratext kuartalan.

Diterjemahkan secara otomatis dari English
+1 suara

Ini sekarang telah diajukan sebagai permintaan fitur. Thread ini dirujuk dalam laporan tersebut.

Laporan terkait:
https://paratext.myjetbrains.com/youtrack/issue/PTX-22626
https://paratext.myjetbrains.com/youtrack/issue/PTUX-1318
https://paratext.myjetbrains.com/youtrack/issue/PTX-22623

Diterjemahkan secara otomatis dari English
oleh (231 poin)
ditampilkan kembali

Komentar lain yang saya tambahkan di dalam YouTrack:

Karakter tak terlihat harus dicantumkan dalam inventaris Karakter dan Tanda Baca, yang akan menjadi indikasi terbaik bahwa karakter tersebut ada dan dalam konteks apa mereka ada. Mereka juga perlu diizinkan sebagai pemisah valid dalam pengaturan Kutipan ([NBSP]»), pengaturan referensi Kitab Suci (1[NBSP]Raja-raja), dan pengaturan Angka (10[NBSP]000). Ini akan mencakup banyak kasus penggunaan.

Diterjemahkan secara otomatis dari English
0 suara

Saya terlambat di sini, baru saja menemukan topik ini.

Saya memberikan +1 saya, atau lebih tepatnya +100000, untuk fitur-fitur yang diusulkan tersebut. Saya bekerja untuk bahasa lain, di mana karena alasan historis dan ko-eksistensi, ortografinya berusaha sedekat mungkin dengan bahasa Prancis.

Saya ingin mengingatkan semua orang untuk membaca tentang bahasa Prancis, sebelum membuat perubahan teknis apa pun. Tipografi Prancis bahkan lebih kompleks dari yang diketahui orang awam. Ya, ada spasi di sekitar karakter tanda baca tertentu, tetapi mereka tidak sama. Spasi di depan (kiri) titik dua harus berukuran penuh, misalnya.

Saya memiliki dokumen, yang dikumpulkan dari beberapa sumber dan sumber utamanya sayangnya tidak lagi online.

Juga tersedia buku-buku kertas yang membantu, seperti “Lexique des règles typographiques” en usage à l’imprimerie nationale" oleh imprimerie nationale (de la France) dan “Règles de l’écriture typographique du français à l’usage des personnes qui exercent une activité sur MAC ou PC” oleh Yves Perrousseaux.

Diterjemahkan secara otomatis dari English
oleh (934 poin)
ditampilkan kembali
0 suara

Sampai saat ini kami sepenuhnya menggunakan dan menerima tilde di PT, seperti orang lain yang mengatasi XeTeX dan memiliki kekaguman saya — tetapi bukan keinginan saya untuk menjadi seperti mereka.

Logika penerbitan yang sering dilakukan melalui aplikasi dan per bagian Kitab Suci juga relevan untuk konteks kami. Dan tilde harus segera dihapus.

Juga lebih banyak font perlu menyediakan narrow-non-breaking. Sepertinya bahkan tidak semua font SIL yang melakukannya. Tolong teriakkan pada saya, jika mereka melakukannya; itu akan menjadi kabar baik bagi saya, sangat layak untuk diteriaki.

Untuk memasukkan tilde sekarang (NNBSP semoga segera), saya telah menciptakan fitur cerdas untuk PT, di mana saya menggunakan fitur autocorrect.txt bawaan. Misalnya untuk mendapatkan tilde plus tanda seru, saya menekan tanda seru tiga kali dan PT melakukan sisanya dengan cara yang benar. Saya memiliki pengaturan ini untuk semua tanda baca yang memerlukan perhatian khusus.

(Dan saya juga menggunakan ini untuk memasukkan kata-kata yang sering seperti Abraham, Yesus, atau Yerusalem.)

Diterjemahkan secara otomatis dari English
oleh (934 poin)
ditampilkan kembali

Pertanyaan terkait

0 suara
4 jawaban 532 tampilan
Tildes (used in USFMs as non-breaking spaces) disappear when the view is changed in Preview view, as expected. ... . Am I missing some step that would make these disappear?
Alex W. 191 bertanya Jul 13, 2018
0 suara
0 jawaban 171 tampilan
(anon451647 writes) This line (in PrintDraftChanges.txt) will change a plus sign to a thin space if it has a non- ... not match them (especially if they are non-Roman letters).
anonim bertanya Apr 10, 2015
0 suara
1 jawaban 64 tampilan
Karena sudah lama tidak melihat Wordlist, saya terkejut melihat kotak merah besar yang menyebutkan inkonsistensi encoding. ... tentang cara menangani hal ini sangat diterima. Bart.
goodgoan 347 bertanya Nov 13, 2024
0 suara
0 jawaban 156 tampilan
We are having difficulties in parts of Paratext 8 with non-roman front rendering. The Karenni Unicode font we are ... KB Paratext 8 Conflicts Display Problem.jpg1298 866 178 KB
anon281504 144 bertanya Feb 22, 2018
0 suara
2 jawaban 47 tampilan
Proyek kami menggunakan Skrip Arab dan merupakan bahasa aglutinatif. Karena persyaratan ortografis bahasa kami, banyak kata ... menjadi bantuan yang sangat besar! Terima kasih!
Nathaniel Shaver 102 bertanya Apr 16, 2025
Welcome to Support Bible, where you can ask questions and receive answers from other members of the community.
How good and pleasant it is when God’s people live together in unity!
Psalm 133:1
3,045 pertanyaan
6,005 jawaban
5,671 komentar
2,026 pengguna