Недавно со мной связались несколько пользователей, которым нужен способ подсчитать количество стихов с текстом и количество непереведённых стихов.
Конечно, мой стандартный ответ — использовать план проекта (Project Plan). Но даже с планом проекта отображается процент завершённости книг на каждом этапе, а не количество стихов. Можно сказать, что это даже полезнее, но всё ещё многие люди используют старые системы электронных таблиц для отслеживания таких показателей или для включения их в отчёты.
Стив Уайт предложил регулярное выражение (Regex), которое я немного модифицировал, чтобы получить список всех стихов, содержащих хотя бы фразу «Иисус плакал».
regex:\\v \d+ .*? \w{4,} \w{3,}
Хотя это позволяет составить список всех стихов в книге, содержащих текст, это всё равно довольно ручная операция.
Мы запустили новый раздел «Скрипты и хаки» (Scripts and Hacks), который использует встроенный в Paratext движок для скриптов на Python. Я предполагаю, что кто-то мог бы создать скрипт, который быстро извлекает количество переведённых стихов для каждой книги Библии.
Конечно, это не скажет ничего о качестве этого текста, но можно было бы сгенерировать простой одностраничный HTML-отчёт, который многим оказался бы полезен. Кто-нибудь готов принять этот вызов? Или у кого-то уже есть собственное решение этой проблемы?
I’ve had a couple users contact me now because they want a way to count the verses with text in them, and the ones untranslated.
Of course my standard answer is to use the project plan. But even with the project plan, it shows percentage complete for books at each stage, not the number of verses. Arguably more helpful, but there are still many people that are using an old spreadsheet system to track things like this, or to include in reports.
Steve White came up with a Regex that I modified a bit to list all verses with at least, “Jesus wept” in them.
regex:\\v \d+ .*? \w{4,} \w{3,}
Now, while this will make a list of all the verses in a book that contain text, it is still a rather manual operation.
We started a new Scripts and Hacks section that takes advantage of the Python scripting engine that is built into Paratext. I imagine that someone could create a script that can quickly pull out the number of translated verses for each book of the Bible.
Of course, this won’t say anything about the quality of that text, but a simple one page html report could be generated that many people would find useful. Is anyone up for the challenge? Or does someone already have a home brewed solution to this problem?