Я недавно делал это с почти 100 главами в отдельных файлах doc/rtf. Вот моя базовая процедура:
1. Сначала я конвертировал файлы в txt с помощью командной строки LibreOffice.
2. Я написал скрипт на Python для разбора файлов txt, чтобы определить заголовки разделов, перекрестные ссылки и стихи. Скрипт также удалял лишние данные и преобразовал некоторые кодовые точки для обновления кодировки. В некоторых файлах всё ещё были маркеры \v (исходно экспортированные из Paratext), а в других их не было, поэтому мне пришлось ориентироваться по номерам в тексте. Скрипт на Python выводил SFM.
3. Я многократно возвращался и двигался вперёд, обновляя/уточняя код и внося ручные правки в файлы txt, чтобы навести порядок, пока результат не стал достаточно хорошим.
4. Последним шагом было объединение глав в один файл SFM, после чего я копировал и вставлял книгу за книгой в стандартный вид (Standard view) в Paratext. (Мне рекомендовали это много лет назад как самый безопасный способ вставки данных, так как при этом PT выполняет некоторую проверку и наведение порядка в форматировании.)
5. Если были серьёзные проблемы (например, после маркеров \s отсутствовали \p, из-за чего половина главы форматировалась как заголовок раздела), я возвращался к шагу 3. В противном случае я вручную исправлял мелкие проблемы непосредственно в PT.
Меня поощряли выложить мой код/процедуру в интернет, и я надеюсь сделать это в ближайшее время. Если это может быть вам полезно, я могу заняться этим раньше...