0
597 次浏览

我们有一个项目使用了部分 Unicode 映射。用户有一个自定义字体,该字体将正常的 Unicode 值显示为非 Unicode 字符。

帮助主题“我的项目文本使用‘自定义’字体。如何将其转换为 Unicode?”建议应用一个映射文件(我们已有该文件),并将现有的书卷导入到一个新项目。

然而,还有一些项目笔记需要转换,可能还有一些圣经术语(Biblical Terms),也许还有其他文件。帮助主题似乎没有涵盖这些文件。

有没有办法确保所有这些文件都能正确转换?“转换项目”(Convert Project)功能是否会对新文件应用映射?

谢谢,

james_post

机器翻译自 English
Paratext [Moderator]
(2.1k 分) 发布
| 597 次浏览

3 个回答

0
最佳答案

“转换项目”(Convert project)不允许使用映射文件。建议是在 Paratext 中使用查找/替换转换文本文件,然后手动对其他文件(主要是项目文件夹中的 .xml 文件)进行查找/替换。
另一个选项是利用像 CC 这样的工具,创建一个更改表(映射),然后将其应用于需要修复的各种文件。这很可能是项目文件夹中的大多数 .xml 文件。使用 CC 的优点是你相当确定正在进行的更改。由于这些都是不常见的字符,应该不会出现意外损坏文件的问题。
在对这些文件进行任何转换之前,我会确保项目有一个良好的备份。

机器翻译自 English
(9.9k 分) 发布

听起来这是一个适合使用编码转换器(Encoding converters)的转写(Transliteration)项目的工作。这里的优点是你实际上不会更改原始项目,并且可以实验对项目进行任意数量的常规更改,直到转换完美为止。一旦你完善了转换,你可以将转写项目的文本复制回基础项目,并删除转写项目。
缺点是,使用编码转换器有一定的学习曲线。最好从有经验的人那里获得帮助,以使这个过程尽可能无痛……

机器翻译自 English

不幸的是,我认为转写项目除了文本本身之外不做任何额外的工作。

机器翻译自 English

我同意,它不会更改任何 USFM 标记,也不会触及任何不可发布的文本,例如 \id 行和 \rem 备注。但它可以更改所有书卷中所有可发布的文本,包括周边内容,以及脚注、标题等中的文本。如果这正是 @james_post 所寻找的,我认为这是一个很好的选择。

机器翻译自 English
0

如果项目在 Paratext 中已经是 Unicode,而问题在于某些字符不是正确的码点,那么你应该能够通过一些基本的查找/替换来更改这些字符。我会将字体设置为合适的 Unicode 字体,然后根据需要做出更改。既然项目已经是 Unicode,这不应该涉及转换问题。

​祝福,

机器翻译自 English
(9.9k 分) 发布

我理解你的出发点,但我更担心的是辅助文件(而不是主要的 SFM 文件)。不过,我想我们也可以对那些文件进行查找/替换。

话虽如此,我不确定应该在哪些文件中进行更改……

另外,如果可以通过“转换项目”(Convert Project)实现,它将保留项目历史记录。但在这种情况下这可能行不通。

谢谢,

james_post

机器翻译自 English
0

我认为 james_post 希望更改包括 PT 笔记(PT Notes)、圣经术语(Biblical Terms)渲染、词汇表(Wordlist)条目(包括词形)等。
我认为这些主要存储在 xml 文件中,如果有勇气的话可以直接编辑。但有人能明确说明与这些工具相关的决定和批准会发生什么吗?

机器翻译自 English
(673 分) 发布

修改 sfm 文件的同一个 TechKit 文件也可以用于修改 XML 控制文件,包括词汇表(Wordlist)、平行经文(Parallel passages)和圣经术语(Biblical Terms)文件,甚至笔记(Notes)文件和其他可能需要更新的文件。编码转换工具包括一个 XML 数据转换器,这应该会有所帮助。因此,这在技术上是可行的,并将消除重新执行这些检查的需要,尽管由于转换可能会出现一些合法的错误。
话虽如此,这需要时间,并且需要一个人很好地掌握该工具以及需要修改哪些文件。例如:

  • 我会将词汇表导出到单个 XML 文件,在该文件上进行转换,然后重新导入它,而不是在三个词汇表控制文件(hyphenatedWord.txt、SpellingStatus.xml 和 WordAnalysis.xml)上工作。
  • 对于笔记,你应该只更改 <SelectedText><ContextBefore><ContextAfter> 字段,而不是 <Contents>(我想是这样)
  • 如果你有逐行对照文本(interlinear texts),那将是另一个我不太熟悉的复杂程度
机器翻译自 English

相关问题

0
3 个回答 459 次浏览
其他人也遇到过这个问题吗?知道怎么解决吗?我使用的是 Paratext 9.3.103.7 和 Keyman 16.0.138 当我切换到 IPA Unicode 6.2 (v.1.3) KMN 键盘时,它在其他程序中工作正常,但在 ... 不常在 Paratext 中使用这个键盘,但大约一两周前我注意到这个问题,当时以为是因为我刚开启了 Keyman
bbrollier 245 发布 提问于 二月 20, 2023
0
0 个回答 189 次浏览
This week I discovered that Alt-X does work for Unicode characters where the code is longer than 4 hex digits. The ... desired character when typing two periods: ..-->\ud804\udf
[Expert]
sewhite
3.3k 发布
提问于 八月 16, 2019
+1
0 个回答 161 次浏览
Some Unicode characters have a code longer than 4 hex digits. For instance David Rowe was trying to help someone ... on that character gives the UTF16 coding equivalent for it.
[Expert]
sewhite
3.3k 发布
提问于 三月 18, 2019
0
1 个回答 265 次浏览
Hi all, I am working on migrating a user to Paratext 8 and noticed that their translation project is still in Western European ... , web, or Scripture app)? Thank you, SIL+LSS+PNG
SIL LSS PNG 411 发布 提问于 十二月 4, 2018
0
2 个回答 398 次浏览
We are working with a language that has long vowels which we can't write with Odia letters. There are some books printed ... type it neither we know the Unicode of it. please help
anon480013 162 发布 提问于 十月 1, 2018
Welcome to Support Bible, where you can ask questions and receive answers from other members of the community.
Just as a body, though one, has many parts, but all its many parts form one body, so it is with Christ.
1 Corinthians 12:12
3,048 个问题
6,007 个回答
5,672 条评论
2,028 位用户