Bertahun-tahun lalu, saya ingat pernah melihat buletin Paratext dengan pengumuman tentang fitur baru yang membantu pengguna memvisualisasikan titik kode Unicode dalam teks. Isinya kurang lebih seperti ini: “Kami tahu bahwa sering kali ada lebih dari satu kombinasi titik kode Unicode yang dapat digunakan untuk merepresentasikan karakter tertentu. Seringkali, cara karakter atau kata tersebut disusun sangat bergantung pada keyboard yang digunakan penerjemah dan ketukan tombol tertentu yang ia gunakan. Jika Anda mengalami kesulitan menemukan kata dalam hasil pencarian atau saat mencoba melakukan operasi regex, Anda dapat menggunakan alat yang kami buat untuk Anda ini untuk memvisualisasikan bagaimana setiap kata dan karakter direpresentasikan secara mendasar.”
Saya familiar dengan Alt+X untuk melihat titik kode untuk sebuah karakter, dan juga dengan Tools>Checking Inventories>Characters Inventory, tetapi tidak satu pun dari keduanya menampilkan kata utuh beserta titik kodenya - itulah yang saya ingat melihat di printscreen dalam pengumuman tersebut.
Apakah ada yang tahu di mana menemukan pengumuman ini atau fitur yang digambarkan di dalamnya? Saya sudah mencari-cari dan tidak menemukannya.
Tujuan akhir saya adalah untuk lebih memahami bagaimana berbagai cara pengkodean karakter dan representasi kata memengaruhi proyek bahasa. Baik melalui membaca dokumentasi pendamping atau berbicara dengan ahli di bidang tersebut.
Terima kasih!
Years ago I remember seeing a Paratext newsletter with an announcement about a new feature that helps users visualize the Unicode codepoints in the text. It said something like “We know that there is often more than one combination of Unicode codepoints that can be used to represent a given character. Often, the way the character or word is composed depends a lot on the keyboard the translator is using and the particular keystrokes he used. If you’re having trouble finding words in search results or when trying to perform regex operations, you can use this tool we made for you to visualize how each word and character is represented underlyingly.”
I’m familiar with Alt+X to see the codepoints for a character, and also with Tools>Checking Inventories>Characters Inventory, but neither of these show entire words with their codepoints- that’s what I remember seeing in the printscreen in the announcement.
Does anyone know where to find this announcement or the feature it describes? I’ve searched around and can’t find it.
My ultimate goal is to better understand how different ways of encoding characters and representing words affect language projects. Be it through looking through accompanying documentation or talking with experts on the topic.
Thank you!
Diterjemahkan secara otomatis dari English