Terima kasih banyak untuk ini!
Saya baru saja mencobanya, tetapi belum sepenuhnya melakukan apa yang saya inginkan.
Berikut adalah RegEx saya, seperti yang saya sesuaikan:
regex:(?<!\w|\\[cv] )(kopo|menas|misika|foa|faev|siks|seven|eit|nain|ten|ileven|tuelv|tetin|fotin|fiftin|seventin|eitin|naintin|tuenti|teti|foti|fifti|siksti|seventi|eiti|nainti|andled|taosen|[0-9])
Sebagaimana adanya, ini menemukan jauh lebih banyak instans daripada yang seharusnya, misalnya, awalan kata kerja yang dimulai dengan ‹ten›. Akan sangat bagus jika kita bisa membatasi pencarian ke kata-kata yang:
- berada di awal kata atau didahului oleh tanda hubung
- dan berada di akhir kata atau diikuti oleh tanda hubung
Di sisi lain, karena kami memiliki nada gramatikal pada tingkat klausa, sebagian besar vokal dapat berakhir dengan diakritik (áàāa᷄â), tetapi kemunculan seperti itu tidak ditemukan. Sepertinya setiap kali saya menggunakan RegEx di Find Paratext, Ignore Diacritics And Vowel Points, tidak berfungsi, dan oleh karena itu Paratext tidak menemukan ‘sevén’, misalnya.
Apakah ada ide bagaimana saya bisa menyelesaikan masalah-masalah ini?
Terima kasih lagi!
PS: Saya menyadari adanya Numbers Settings dan semuanya sudah diatur untuk PB, tetapi tampaknya tidak ada cara untuk menyertakan angka yang ditulis dalam bentuk kata. (Atau ada?)
Thank you very much for this!
I just tried it out, but it doesn't quite do yet what I would like it to do.
Here is my RegEx, as I adapted it:
regex:(?<!\w|\\[cv] )(kopo|menas|misika|foa|faev|siks|seven|eit|nain|ten|ileven|tuelv|tetin|fotin|fiftin|seventin|eitin|naintin|tuenti|teti|foti|fifti|siksti|seventi|eiti|nainti|andled|taosen|[0-9])
As it is, this finds far more instances than it should, for example, verb prefixes starting with ‹ten›. It would be great if we could limit the search to words being:
- at the beginning of a word or preceded by a hyphen
- and at the end of word or followed by a hyphen
On the other hand, since we have grammatical tone on clause level, most of the vowels can end up with a diacritic (áàāa᷄â), but such occurrences are not found. It seems that whenever I use RegEx in Paratext's Find, Ignore Diacritics And Vowel Points, does not work, and therefore Paratext doesn't find ‘sevén’, for example.
Any idea how I could solve these issues?
Thanks again!
PS: I'm aware of the Numbers Settings and it is all set up for the NT, but there doesn't seem to be a way to include numbers written in words. (Or is there?)
Diterjemahkan secara otomatis dari English