0 votos
594 visualizações

Temos um projeto com um mapeamento Unicode parcial. O usuário possui uma fonte personalizada, que exibe caracteres não-Unicode para valores Unicode normais.

O tópico de Ajuda: Meu texto do projeto usa uma fonte “personalizada”. Como faço para convertê-lo para Unicode? diz para aplicar um arquivo de mapeamento (que temos) e importar os livros existentes em um novo projeto.

No entanto, também há notas do projeto que precisam ser convertidas, talvez alguns Termos Bíblicos e, talvez, outros arquivos. O tópico de Ajuda não parece cobrir esses arquivos.

Existe uma maneira de garantir que todos esses arquivos sejam convertidos corretamente? O “Convert Project” aplicará um mapeamento aos novos arquivos?

Obrigado,

james_post

Tradução automática de English
Paratext por [Moderator]
(2,1k pontos)
| 594 visualizações

3 Respostas

0 votos
Melhor resposta

O Convert project não permite o uso de um arquivo de mapeamento. A recomendação seria converter os arquivos de texto dentro do Paratext usando Find/Replace e, em seguida, fazer manualmente o Find/Replace nos outros arquivos (principalmente os arquivos .xml na pasta do projeto).
A outra opção seria usar uma ferramenta como o CC, onde você cria uma tabela (mapa) das alterações a serem feitas e, em seguida, aplica isso aos vários arquivos que precisam ser corrigidos. Isso provavelmente seria a maioria dos arquivos .xml na pasta do projeto. A vantagem do CC é que você tem bastante certeza de quais alterações estão sendo feitas. Como esses são todos caracteres incomuns, não deve haver problemas com a corrupção acidental de um arquivo.
Antes de fazer qualquer conversão desses arquivos, eu me certificaria de que há um bom backup do projeto.

Tradução automática de English
por (9,9k pontos)

Parece que este é um trabalho adequado para um projeto de Transliteração usando conversores de codificação. A vantagem aqui é que você não altera realmente seu projeto original e pode experimentar fazer qualquer número de alterações regulares no projeto até obter a conversão perfeita. Uma vez que você tenha aperfeiçoado a conversão, pode copiar o texto do projeto de transliteração de volta para o projeto base e excluir o projeto de transliteração.
A desvantagem é que há uma pequena curva de aprendizado para usar os Conversores de Codificação. Seria bom obter ajuda de uma pessoa experiente para tornar isso o menos doloroso possível…

Tradução automática de English

Infelizmente, não acredito que o projeto de transliteração faça algo além do próprio texto.

Tradução automática de English

Concordo, ele não altera nenhum dos marcadores USFM, nem tocará em nenhum texto não publicável, como linhas \id e observações \rem. Mas ele pode alterar todo o texto publicável em todos os livros, incluindo periféricos, e texto em notas de rodapé, títulos, etc. Se isso é o que @james_post está procurando, acho que é uma boa opção.

Tradução automática de English
0 votos

Se o projeto for Unicode (no Paratext) e o problema for que certos caracteres não estão nos pontos de código corretos, você deve ser capaz de fazer algumas operações básicas de localizar/substituir para alterar os caracteres. Eu configuraria a fonte para uma fonte Unicode apropriada e, em seguida, faria as alterações necessárias. Isso não deve ser sobre uma conversão, já que o projeto já é Unicode.

​Abençoados,

Tradução automática de English
por (9,9k pontos)

Entendo de onde você está vindo, mas estou mais preocupado com os arquivos suplementares (não os arquivos SFM principais). Embora eu suponha que também pudéssemos fazer uma operação de localizar/substituir neles.

Dito isso, não tenho certeza em quais arquivos fazer a alteração…

Além disso, se fosse possível via Convert Project, isso manteria o histórico do projeto. Mas isso pode não ser possível neste caso.

Obrigado,

james_post

Tradução automática de English
0 votos

Acho que james_post quer que as alterações incluam Notas do PT, renderizações de Termos Bíblicos, entradas do Wordlist (incluindo morfologia), etc.
Acho que esses são armazenados principalmente em arquivos xml que podem ser editados diretamente, se alguém tiver coragem. Mas alguém pode afirmar definitivamente o que aconteceria com decisões e aprovações relacionadas a essas ferramentas?

Tradução automática de English
por (673 pontos)

O mesmo arquivo TechKit que modifica os arquivos sfm também pode ser usado para modificar os arquivos de controle XML, incluindo os arquivos Wordlist, Parallel passages e Biblical Terms, até mesmo os arquivos Notes e outros arquivos que se possa querer atualizar. As ferramentas de conversor de codificação incluem um conversor de dados XML, que deve ajudar. Portanto, isso é tecnicamente viável e eliminará a necessidade de refazer essas verificações por completo, embora alguns erros legítimos possam surgir devido à conversão.
Dito isso, levará tempo e alguém com um bom domínio da ferramenta e de quais arquivos precisam ser modificados. Por exemplo:

  • Eu exportaria o Wordlist para um único arquivo XML, faria a conversão nele e o reimportaria, em vez de trabalhar nos três arquivos de controle do Wordlist (hyphenatedWord.txt, SpellingStatus.xml e WordAnalysis.xml).
  • Para notas, você deve alterar apenas os campos <SelectedText>, <ContextBefore> e <ContextAfter>, não o <Contents> (eu imagino)
  • Se você tiver textos interlineares, isso será outro nível de complexidade com o qual não estou muito familiarizado
Tradução automática de English

Perguntas relacionadas

0 votos
3 respostas 459 visualizações
Alguém mais teve esse problema e sabe de uma solução? Estou usando o Paratext 9.3.103.7 e o Keyman 16.0.138. ... e achei que fosse porque eu tinha acabado de ativar o Keyman.
bbrollier 245 perguntada Fev 20, 2023
0 votos
0 respostas 189 visualizações
This week I discovered that Alt-X does work for Unicode characters where the code is longer than 4 hex digits. The ... desired character when typing two periods: ..-->\ud804\udf
[Expert]
sewhite
3,3k
perguntada Ago 16, 2019
+1 voto
0 respostas 161 visualizações
Some Unicode characters have a code longer than 4 hex digits. For instance David Rowe was trying to help someone ... on that character gives the UTF16 coding equivalent for it.
[Expert]
sewhite
3,3k
perguntada Mar 18, 2019
0 votos
1 resposta 265 visualizações
Hi all, I am working on migrating a user to Paratext 8 and noticed that their translation project is still in Western European ... , web, or Scripture app)? Thank you, SIL+LSS+PNG
SIL LSS PNG 411 perguntada Dez 4, 2018
0 votos
2 respostas 398 visualizações
We are working with a language that has long vowels which we can't write with Odia letters. There are some books printed ... type it neither we know the Unicode of it. please help
anon480013 162 perguntada Out 1, 2018
Welcome to Support Bible, where you can ask questions and receive answers from other members of the community.
Very truly I tell you, whoever accepts anyone I send accepts me; and whoever accepts me accepts the one who sent me.
John 13:20
3,048 perguntas
6,007 respostas
5,672 comentários
2,028 usuários