0
820 次浏览

我们团队着手修订一部已出版的新约译本。起初我们很乐观,希望不会花太长时间,也不需要做太多改动。但现在我们发现,超过 90% 的经文都被修改了。

我们在 Paratext 外部完成了所有修订工作。原因有很多,这里就不赘述了。然而,现在临近收尾阶段,我们需要将修订后的内容重新导入 Paratext。

我们拥有的文本结构非常简单,可以将其视为一个表格,其中第一列是经文引用(例如:马可福音 1:1),第二列是经文的纯文本内容。没有标题,没有段落标记,没有脚注,也没有类似的东西。我想获取现有的 USFM 文件,并用新文本对其进行更新。我开发了一些代码来实现这一点,主要使用了 usfm-grammar。我获取现有的 USFM,将其转换为 JSON,修改 JSON 以更新翻译,然后使用同一工具将翻译转换回 USFM。

然而,我注意到保留标题、段落和交叉引用是一件棘手的事情。我花了一两天时间处理这个问题(包括决定采用这种方法的过程),如果这不是对我时间的良好利用,我真的不想花大量时间去编程。当我将结果重新导入 Paratext 时,它会抱怨 USFM 无效。因此,看起来 usfm-grammar 可能会生成无效的 USFM。

我查找了一些用于编写 USFM 的库。我找到了许多用于解析 USFM 和将 USFM 转换为其他格式的选项,但 usfm-grammar 是我找到的唯一能够将 JSON 转换为 USFM 的库。

我现在正在考虑两个选项:

  1. 继续开发一个工具,可以将纯文本修订版与现有的 USFM 合并。
  2. 或者……实际上在 Paratext 中启动一个新项目,将纯文本作为 USFM 导入,而不尝试将其与现有翻译中的现有标题和其他信息合并。

我已经尝试过选项 2。正如你可以想象的那样,生成如下输出非常容易:

\id MRK
\c 1
\p
\v 1 the first verse
\v 2 the second verse
\v 3 the third verse
\v 4 etc

你会给我什么建议?我目前倾向于选项 2,只是手动完成添加标题和交叉引用的工作。无论如何,标题都需要手动修订。

机器翻译自 English
Paratext (495 分) 发布 | 820 次浏览

4 个回答

0
最佳答案

在比较版本工具中,你可以在左侧和右侧选择不同的项目。因此,你可以将主项目与最小项目进行比较(在两侧都选择 当前版本)。然后,你可以右键单击差异,以使主项目包含来自最小项目的更改:

机器翻译自 English
[Expert]
(16.7k 分) 发布

感谢截图。我现在意识到,我在 Linux 版 Paratext 上似乎遇到了一个 bug。我看到的是这样的:

当我在 Windows 上打开 Paratext 时,我确实看到了那些工具栏。

机器翻译自 English

有趣!我使用的是 PT9,Linux 版本 9.0,0.99。在工具栏中,我看到两个项目下拉框,如 anon291708 的截图(来自 Windows PT)所示。我可以在任一下拉列表中选择另一个项目名称,但显示的经文文本不会更新。版本按钮都是激活的。所以确实似乎存在一个 Linux bug。

顺便说一下——在我当前安装的 PT8 中,工具 > 比较文本菜单项会打开一个没有项目下拉框的窗口,就像“bit”从他的 PT9 屏幕发布的那张截图一样;我猜测我的 PT9-Linux 版本可能比 bit 的更新。

因此,我目前在 PT8 或 PT9 中都无法比较两个不同的项目文本。PT 中曾经有两个菜单项:项目菜单中的比较版本,以及工具菜单中的比较文本。我知道这两个工具之间曾有一些混淆,所以也许它们被合并为一个了?但这两个工具的功能都非常重要。

机器翻译自 English
+1

你可能可以结合使用 #1#2。Paratext 包含一个显示两个文本之间差异的工具。你可以创建一个简单的项目,然后使用该工具将简单项目中的更改合并到主项目中。这仍然需要大量的手动工作,但可能比开发一个自动执行此操作的工具更容易。

你可以在 Paratext 的帮助中搜索“如何比较两个不同的项目?”来查找有关该工具的帮助。然后,你可以右键单击更改以接受/还原它们(例如,以恢复标题和题名)。

机器翻译自 English
[Expert]
(16.7k 分) 发布

已重新显示

谢谢。我没想到可以比较两个项目。

我在 Paratext 的帮助中搜索了“如何比较两个不同的项目?”,并找到了以下结果:

  • “如何找到两个项目中标点符号不同的地方?”

如果我搜索“两个项目中不同”,我会得到更多结果:

  • “如何找到两个项目中引号不同的地方?”
  • “如何找到两个项目中标记不同的地方?”
  • “如何找到两个项目中标点符号不同的地方?”

看起来你运行各种检查清单,并将其与另一个项目进行比较。点击项目的汉堡图标,然后展开菜单,然后点击“工具”下的“检查清单”,再选择其中一个子菜单项。似乎这些检查清单可以正常工作:

  • 经文文本
  • 单词或短语
  • 章节标题
  • 书卷题名
  • 引用
  • 脚注
  • 标记
  • 引号
  • 标点符号
  • 相对较长的经文
  • 相对较短的经文
  • 长句
  • 长段落

我记录这些是为了那些潜水者,也为了我稍后回来时参考。

既然我知道了这一点,我想我会选择选项 #2,并使用 Paratext 内部可以比较两个项目的这些工具。这听起来比尝试编写一个工具来合并两个译本更容易。

机器翻译自 English

这完全不是我的意思。你使用的是哪个版本的 Paratext?

我指的是比较版本工具(在 PT8 中是 工具 > 比较文本 - 我想,在 PT9 中是 项目 > 比较版本)。

机器翻译自 English

我使用的是 Paratext 9.0

如果我点击项目窗口中的汉堡图标,我可以找到标记为“比较版本”的菜单项。这会打开一个带有两个窗格的窗口,每列一个。我可以按下看起来像箭头的工具栏按钮在更改之间导航。对我来说,这看起来像是让我查看项目中的历史更改(我想)。我不明白这个工具如何让我比较两个项目,因为它甚至没有问我想要比较哪两个项目。

机器翻译自 English
+1

This is a really long shot, but your description of getting table-based data to standard format made me think of SheetSwiper (https://software.sil.org/sheetswiper/). Suppose you export the headers, paragraph markers, etc (arranged in appropriate columns) along with their reference indications, then sort that together with the existing verse information, could you generate a spreadsheet that would give the output you need? Unfortunately Scripture text is not as hierarchical as the lexical data that SheetSwiper targets.

(296 分) 发布

SheetSwiper

感谢推荐 SheetSwiper。我点击了链接,并试图找到 GitHub 仓库,但看起来该页面上的链接已损坏。我认为这个工具将电子表格转换为 USFM,这很有用,但自己编写代码也不太难。困难的部分是将其与现有的 USFM 合并。

机器翻译自 English

很高兴你找到了不使用 SheetSwiper 的前进路径。看起来没有可用的源代码,只有 Windows .exe 下载。

机器翻译自 English
0

你会给我什么建议?我目前倾向于选项 2,只是手动完成添加标题和交叉引用的工作。无论如何,标题都需要手动修订。

那看起来确实是更容易的方法。尤其是标题反正都需要手动修订。

但我在想,你是否可以将其作为一个转换(transformation)来做,你现在似乎已经很接近了。我会试着感受一下手动处理标题需要多长时间,然后决定是否直接让转换正确运行更快。

我理解你不需要往返(round-trip),这只是一个导入?现有的 Paratext USFM 中是否有需要保留的内容,还是你导入的文本是一个可以替换现有内容的当前版本?

Jonathan+Robie

机器翻译自 English
(448 分) 发布
已重新显示

最初,我希望保留现有 Paratext USFM 中的标题、交叉引用等。但我现在认为手动移植这些更容易,原因如下:

  • 无论如何,我们可能都会对标题进行相当多的手动更改
  • 任何链接到经文特定部分的内容,例如交叉引用,无论如何都需要手动检查
  • 开发一些代码来进行转换会节省时间,但其质量无论如何都只能靠手动验证
机器翻译自 English

相关问题

0
0 个回答 185 次浏览
When importing Scripture from Paratext into Fieldworks, It is possible to have the back translation import along with the ... Paratext has to be linked to the vernacular project.
[Expert]
Jeff_Shrum
2.9k 发布
提问于 十二月 2, 2016
+1
3 个回答 435 次浏览
Exporting the Wordlist to HTML is a nice feature, except that for many users including me, working with HTML is ... that are currently marked as spelled correctly in PT? anon101508
anon101508 117 发布 提问于 三月 11, 2019
0
4 个回答 607 次浏览
Continuing the discussion from Importing Back Translation along with Vernacular into Fieldworks: Importing Back Translation ... translation but obviously that didn't work either.
jbabt 115 发布 提问于 一月 9, 2017
0
1 个回答 212 次浏览
According to my old notes, I get the cleanest text via copy and paste, with my View Setting set to unformatted . I ... best way to get clean text with valid markers out of PT8.
Tim 934 发布 提问于 三月 8, 2019
0
2 个回答 368 次浏览
Brief background: our majority language project has had a bit of a rocky history. The four Gospels were printed in ... verses you've checked and are satisfied with, for example.
wdavidhj 1.4k 发布 提问于 九月 26, 2016
Welcome to Support Bible, where you can ask questions and receive answers from other members of the community.
Don’t you know that you yourselves are God’s temple and that God’s Spirit dwells in your midst?
1 Corinthians 3:16
3,045 个问题
6,005 个回答
5,671 条评论
2,026 位用户