0
599 次瀏覽

我們有一個專案使用了部分 Unicode 映射。使用者擁有一個自訂字型,該字型會將標準的 Unicode 值顯示為非 Unicode 字元。

說明主題「我的專案文字使用了『自訂』字型。我該如何將其轉換為 Unicode?」建議套用映射檔案(我們已有此檔案),並將現有的書卷匯入新的專案。

然而,還有專案註解需要轉換,可能還有一些聖經術語(Biblical Terms),以及其他檔案。說明主題似乎沒有涵蓋這些檔案。

有沒有辦法確保這些檔案都能正確轉換?「轉換專案」(Convert Project)功能會將映射套用到新檔案嗎?

謝謝,

james_post

機器翻譯自 English
Paratext [Moderator]
(2.1k 點) 提出
| 599 次瀏覽

3 個回答

0
最佳回答

「轉換專案」(Convert project)功能不允許使用映射檔案。建議是在 Paratext 中使用搜尋/取代來轉換文字檔案,然後手動對其他檔案(主要是專案資料夾中的 .xml 檔案)進行搜尋/取代。
另一個選項是使用 CC 之類的工具,在其中建立一個變更表格(映射),然後將其套用到需要修復的各個檔案。這很可能涵蓋專案資料夾中的大多數 .xml 檔案。使用 CC 的優點是您可以相當確定所進行的變更。由於這些都是不常見的字元,因此不應出現意外損毀檔案的問題。
在對這些檔案進行任何轉換之前,我建議確保專案有完整的備份。

機器翻譯自 English
(9.9k 點) 提出

聽起來這是一份適合使用「轉寫專案」(Transliteration project)搭配「編碼轉換器」(Encoding converters)的工作。這裡的優點是您實際上不會更改原始專案,可以嘗試對專案進行任意數量的常規變更,直到轉換達到完美為止。一旦您完善了轉換,就可以將轉寫專案的文字複製回基礎專案,並刪除轉寫專案。
缺點是使用編碼轉換器有一定的學習曲線。最好尋求有經驗的人的幫助,以盡量減少麻煩……

機器翻譯自 English

不幸的是,我認為轉寫專案除了文字本身之外,不會做更多的工作。

機器翻譯自 English

我同意,它不會更改任何 USFM 標記,也不會觸及任何不可發佈的文字,例如 \id 行和 \rem 備註。但它可以更改所有書卷中的所有可發佈文字,包括周邊內容,以及腳註、標題等中的文字。如果這是 @james_post 所尋找的,我認為這是一個很好的選項。

機器翻譯自 English
0

如果專案是 Unicode(在 Paratext 中),而問題在於某些字元不是正確的碼位(code points),那麼您應該能夠透過基本的搜尋/取代來更改這些字元。我會將字型設定為適當的 Unicode 字型,然後按需進行更改。既然專案已經是 Unicode,這不應該涉及轉換問題。

​祝福,

機器翻譯自 English
(9.9k 點) 提出

我理解您的立場,但我更擔心的是輔助檔案(而非主要的 SFM 檔案)。雖然我想我們也可以在這些檔案中進行搜尋/取代。

話雖如此,我不確定要在哪些檔案中進行更改……

此外,如果透過「轉換專案」(Convert Project)功能可行,它將保留專案歷史記錄。但在這種情況下,這可能行不通。

謝謝,

james_post

機器翻譯自 English
0

我認為 james_post 希望變更包括 PT 註解(PT Notes)、聖經術語(Biblical Terms)的呈現、詞彙表(Wordlist)條目(包括形態學)等。
我認為這些主要儲存在 xml 檔案中,如果有勇氣的話可以直接編輯。但有人能明確說明與這些工具相關的決定和核准會發生什麼情況嗎?

機器翻譯自 English
(673 點) 提出

用於修改 sfm 檔案的同一個 TechKit 檔案也可以用於修改 XML 控制檔案,包括詞彙表(Wordlist)、平行經文(Parallel passages)和聖經術語(Biblical Terms)檔案,甚至是註解檔案和其他您可能想要更新的檔案。編碼轉換器工具包含一個 XML 數據轉換器,這應該會有所幫助。因此,從技術上講這是可行的,並且將消除重新執行這些檢查的需要,儘管轉換可能會導致一些合理的錯誤。
話雖如此,這需要時間,以及一位熟悉該工具以及需要修改哪些檔案的人。例如:

  • 我會將詞彙表匯出為單個 XML 檔案,對其進行轉換,然後重新匯入,而不是在三個詞彙表控制檔案(hyphenatedWord.txt、SpellingStatus.xml 和 WordAnalysis.xml)上進行操作。
  • 對於註解,您應該只更改 <SelectedText><ContextBefore><ContextAfter> 欄位,而不是 <Contents>(我猜測)
  • 如果您有逐字對照文本(interlinear texts),那將是另一個我不是很熟悉的複雜層級
機器翻譯自 English

相關問題

0
3 個回答 459 次瀏覽
有其他人遇到這個問題並知道解決方法嗎?我使用的是 Paratext 9.3.103.7 和 Keyman 16.0.138 當我切換到 IPA Unicode 6.2 (v.1.3) KMN 鍵盤時,它在其他程式中可以正常運作,但在 Paratext ... 何內容 我不常使用這個鍵盤,但大約一兩週前我注意到這個問題,當時以為是因為我剛開啟了 Keyman
bbrollier 245 提出 已提問 2月 20, 2023
0
0 個回答 189 次瀏覽
This week I discovered that Alt-X does work for Unicode characters where the code is longer than 4 hex digits. The ... desired character when typing two periods: ..-->\ud804\udf
[Expert]
sewhite
3.3k 提出
已提問 8月 16, 2019
+1
0 個回答 161 次瀏覽
Some Unicode characters have a code longer than 4 hex digits. For instance David Rowe was trying to help someone ... on that character gives the UTF16 coding equivalent for it.
[Expert]
sewhite
3.3k 提出
已提問 3月 18, 2019
0
1 個回答 265 次瀏覽
Hi all, I am working on migrating a user to Paratext 8 and noticed that their translation project is still in Western European ... , web, or Scripture app)? Thank you, SIL+LSS+PNG
SIL LSS PNG 411 提出 已提問 12月 4, 2018
0
2 個回答 398 次瀏覽
We are working with a language that has long vowels which we can't write with Odia letters. There are some books printed ... type it neither we know the Unicode of it. please help
anon480013 162 提出 已提問 10月 1, 2018
Welcome to Support Bible, where you can ask questions and receive answers from other members of the community.
Finally, all of you, be like-minded, be sympathetic, love one another, be compassionate and humble.
1 Peter 3:8
3,048 個問題
6,007 個回答
5,672 則評論
2,028 位使用者