Acabei de fazer isso recentemente com quase 100 capítulos em arquivos doc/rtf individuais. Este foi meu procedimento básico:
1. Primeiro, converti os arquivos para txt usando a linha de comando do LibreOffice.
2. Escrevi um script em Python para analisar os arquivos txt, identificando títulos de seção, referências cruzadas e versículos. Ele também limpou alguns resíduos e converteu alguns pontos de código para atualizar a codificação. Alguns arquivos ainda tinham marcadores \v (exportados originalmente do Paratext) e outros não, então tive que me basear apenas nos números no texto. O script em Python gerou SFM
3. Alternei entre atualizar/refinar o código e fazer algumas edições manuais nos arquivos txt para limpar as coisas, até que estivesse em uma forma bastante boa.
4. A última etapa foi concatenar os capítulos em um único arquivo SFM e, em seguida, copiei e colei esse livro por livro na visão Standard no Paratext. (Isso me foi recomendado anos atrás como a maneira mais segura de colar dados, pois o PT fará algumas verificações e ajustes na formatação quando você faz isso.)
5. Se houvesse problemas graves (por exemplo, os marcadores \s estavam faltando \p depois deles, de modo que metade do capítulo fosse formatada como título de seção), eu voltaria para a etapa 3. Caso contrário, eu corrigiria quaisquer pequenos problemas manualmente dentro do próprio PT.
Fui incentivado a colocar meu código/procedimento online e espero fazer isso em breve. Se isso puder ser útil para você, posso me dedicar a isso o quanto antes...