Поскольку примерно 50% консультантов по НЗ уже проверили текст, я недавно начал использовать инструмент «Список слов» (Wordlist) в Paratext, чтобы сравнить лексические варианты в трёх связанных языковых переводах. Данные впечатляют: подавляющее большинство лексических вариантов практически идентичны, но различия достаточно существенны, чтобы оправдать наличие отдельных (хотя и связанных) переводов. Список слов очень полезен тем, что позволяет сортировать по количеству (Count), благодаря чему я вижу, какие слова встречаются чаще всего, а также показывает число вхождений. Тогда кажется, что совсем несложно было бы подсчитать сумму всех количеств для каждого слова, отображённого в текущем представлении (с фильтром по нужному набору книг), и вывести общее количество токенов для всех слов, включённых в текущее представление. Это дало бы дополнительные данные для статистики.
Спасибо!