+3 votos
671 vistas

Tengo varias palabras extranjeras en mi lista de palabras de Paratext que provienen de la portada (p. ej., ‘Ilustraciones’, ‘permiso’ o los nombres de los artistas) o de entre \tl…\tl*.
¿Hay alguna forma de excluir dichas palabras para que no aparezcan en la lista de palabras o de marcarlas de alguna manera como no pertenecientes al idioma?
¡Gracias!

Traducción automática desde English
Paratext por (245 puntos) | 671 vistas

8 Respuestas

0 votos
Mejor respuesta

Este tema ha estado en nuestra mente durante mucho tiempo (creo que lo digo mucho en este foro) y se relaciona con la aprobación de no solo palabras, sino también caracteres y puntuación.

Como todos han notado, la Wordlist y los Inventories actualmente solo permiten a los equipos aprobar palabras “en todas partes” o “en ninguna parte”, pero las cosas rara vez son tan simples. La solución que hemos planificado muestra el estado de las palabras (o caracteres) en ubicaciones de escritura y no escritura en columnas separadas en la Wordlist y los inventarios.

Especificar la aprobación según la ubicación estará disponible para quienes lo deseen. No será obligatorio para quienes no lo necesiten.

Los primeros indicios de estos cambios se pueden ver en Find en PT9.2. Esto permite a los usuarios buscar en “Verse text” o “All text” (‘non-verse text’ llegará "pronto"™️). Además, la Wordlist ya no tiene tres botones en cada fila para establecer la aprobación de palabras. En cambio, el estado se establece en el encabezado de la columna según la fila activa. Esto se debe a que, cuando agregamos una columna para texto no de versículo (y en proyectos de Biblia de Estudio, aparece otra columna para material de Biblia de Estudio), el “muro” de 6-9 botones por fila se vuelve un poco abrumador. Un modelo del Characters Inventory a continuación da una buena idea de cómo se vería en la Wordlist. Por defecto, aprobar una palabra en el texto de versículo también la aprobará en el texto no de versículo; aprobar una palabra en el texto no de versículo no aprueba esa palabra en el texto de versículo.

No habíamos pensado que hubiera necesidad de una lista de hibernación separada. Eso es algo que debemos tener en cuenta.

Probablemente todos se pregunten cuándo se implementará. Puede estar en 9.4 (sin garantías).

Traducción automática desde English
por [Moderator]
(1,2k puntos)
0 votos

Actualmente no hay forma de excluir estas palabras de la lista de palabras. La lista de palabras no es simplemente una lista de palabras del idioma, sino una lista de palabras que aparecen en el texto del proyecto. Es importante verificar todas esas palabras, ya que es posible cometer errores de ortografía en palabras extranjeras.

Traducción automática desde English
por (9,9k puntos)
+1 voto

Paratext en realidad excluye las palabras nonpublishable (no publicables) de la lista de palabras. Por ejemplo, las palabras en las notas no se encuentran en la lista de palabras. Para excluir el texto de referencia de las tablas de texto de mapas, creé un estilo de carácter personalizado llamado \zrm …\zrm* con \TextProperties nonpublishable y lo agregué al archivo frtbak.sty de mi proyecto:

# Map Table Reference text
# Reference text in Map tables marked with \zrm ...\zrm* do not appear in the Wordlist or other checks 
\Marker zrm
\Endmarker zrm*
\Name zrm...zrm* - Remark span
\Description For Comments and remarks
\OccursUnder ip im ipi imi ipq imq ipr iq iq1 iq2 iq3 io io1 io2 io3 io4 ms ms1 ms2 s s1 s2 s3 s4 cd sp d lh li li1 li2 li3 li4 lf lim lim1 lim2 lim3 lim4 ili ili1 ili2 ili3 ili4 m mi nb p pc ph phi pi pi1 pi2 pi3 pr pmo pm pmc pmr po q q1 q2 q3 q4 qc qr qd qm qm1 qm2 qm3 cls tr th1 th2 th3 th4 thr1 thr2 thr3 thr4 tc1 tc2 tc3 tc4 tcr1 tcr2 tcr3 tcr4 f fe ef rem NEST
\TextType Other
\TextProperties nonpublishable 
\StyleType Character
\FontSize 12
\Color 16711680 # Same color as \rem

Este es un ejemplo de cómo se utiliza en el libro BAK de un proyecto

\periph Map 02_03 The World of the Patriarchs

\tr \thc1 \zrm The world of the Patriarchs \zrm* \thc2 পিতৃপুরুষদের জগৎ
\tr \th1 \zrm Legend \zrm* \th2 ~
\tr \tc1 \zrm km\zrm* \tc2 কিমি
\tr \tc1 \zrm Journeys of Abraham\zrm* \tc2 অব্রাহামের যাত্রা

Las palabras de la primera columna se excluyen de la lista de palabras, pero las palabras de la segunda columna se revisan ortográficamente.

Permítanme añadir que no recomiendo excluir de la lista de palabras ninguna palabra que vaya a ser publicada. Los nombres y las palabras en la declaración de derechos de autor también deben revisarse en cuanto a la ortografía.

Traducción automática desde English
por (1,8k puntos)
mostrada de nuevo

Teniendo en cuenta las advertencias que hace @CrazyRocky, también uso bastante el marcador nonpublishable por las mismas razones enumeradas aquí.

Una desventaja es que PT también ignora los caracteres nonpublishable al realizar ciertas búsquedas y dar resultados. Por ejemplo, al realizar búsquedas de paréntesis y otras comprobaciones, a menudo obtengo resultados extraños, como algo que parece un conjunto de marcas de paréntesis con nada dentro, pero que en realidad solo tiene caracteres nonpublishable dentro. Como resultado, de vez en cuando edito mi hoja de estilos custom.sty para que PT maneje las palabras extranjeras como yo quiero en ese momento.

Agrego “nonpublishable” en la hoja de estilos custom.sty y luego lo cambio de vuelta a “publishable” en PrintDraft-mods.sty y/o en cualquier hoja ptxprint.sty relevante.

Traducción automática desde English
+1 voto

Me he encontrado con esto muchas veces. Apoyo a equipos de traducción que se están preparando para publicar, trabajando en sus comprobaciones finales, incluida la lista de palabras. Nuestro objetivo para la lista de palabras siempre es “0 palabras desconocidas o incorrectas en el NT”, pero nuestro conteo siempre incluye esas 100-200 palabras en francés (porque estos equipos están en la RCA, un país francófono) que han decidido incluir en su texto. No es razonable esperar que utilicen ÚNICAMENTE su lengua materna, ya que muchos de los miembros de su comunidad hablan y leen al menos algo de francés. Suele ser una palabra aquí o allá, generalmente en cursiva: Así es como se escribe “X palabra en francés” en nuestro idioma.

Por lo tanto, quiero hacer una sugerencia a los desarrolladores: ¿Podríamos crear una forma de excluir las palabras extranjeras de la lista de palabras, o proporcionar una forma de eliminarlas del conteo de “palabras desconocidas”? Tengo dos ideas sobre cómo se podría hacer.

  1. Agregar una cuarta casilla de verificación opcional en la lista de palabras; es decir, signo de interrogación azul, marca de verificación verde, X roja y… digamos, estrella naranja? (¿O algún cuarto icono + color diferente que signifique “palabra extranjera”?) El problema es que la validación global que ocurre en la lista de palabras no es apropiada para las “palabras extranjeras”, ya que cada caso de la palabra extranjera necesita ser revisado y validado por separado. Así que supongo que esta cuarta casilla significaría “esta palabra no es ortografía de la lengua materna, pero no es ‘desconocida’, se puede ignorar para los fines de la lista de palabras, pero cada caso necesitará ser revisado antes de publicar para asegurarse de que siga siendo válido.”

  2. Otra opción es cambiar \tl u otro marcador para que sea un marcador de “palabra extranjera”. No cambiaría ningún formato, solo cómo lo trata PTX: “esta palabra se puede ignorar en la lista de palabras”. A diferencia de las ideas de “nonpublishable” explicadas anteriormente, todavía tendría que ser publicable. Esto resolvería el problema de “revisar cada caso” que mencioné anteriormente, pero requeriría marcadores especiales para cada y todos los casos de cada palabra.

Cualquiera de las opciones probablemente necesitará algún tipo de inventario + par de comprobaciones básicas para permitir la validación, pero no estoy seguro de cómo se haría esto caso por caso.

¿Qué opinan todos ustedes? ¿Sería algo útil pedirle esto a los desarrolladores?

Gracias,
~anon550568

Traducción automática desde English
por (114 puntos)

Habría una ventaja adicional en la opción 2. En algunos casos, una cierta cadena de caracteres puede ser tanto una palabra extranjera (correctamente escrita) como una palabra vernácula (ya sea correctamente o incorrectamente escrita). Uno podría querer juzgar estos casos caso por caso.

En tales casos, la solución ideal sería poder decirle a PT que ignore las apariciones individuales de palabras, igual que podemos negar errores individuales en las comprobaciones básicas (y PT recordará esta elección). Si eso es demasiado complejo de implementar, ignorar un cierto marcador para la revisión ortográfica podría ser una buena alternativa.

Por cierto, cuando se trata de la revisión ortográfica final, generalmente defino un filtro que incluye todos los libros bíblicos (y posiblemente el glosario y la introducción) y excluye el material preliminar. Pero esto no resuelve el problema si el libro INT contiene tanto una introducción vernácula como una en LWC.

Paulus+Kieviet

Traducción automática desde English

P.D. Otro ejemplo donde me gustaría excluir apariciones individuales es este: en algunos libros, el Esquema de Contenidos contiene elementos de segundo nivel, que están etiquetados con letras alfabéticamente. El alfabeto vernáculo es “a e f”, etc. Ahora, “a” y “e” también son errores ortográficos de palabras vernáculas (deberían ser ꞌ****a y ꞌ****e, respectivamente), así que sería bueno poder ignorar esas apariciones. Lo sé, es un detalle minúsculo, pero simplemente no nos permite llegar a esa etapa muy satisfactoria de cero palabras incorrectas o indecisas.

Paulus+Kieviet

Traducción automática desde English

Las descripciones de imágenes en inglés a menudo se dejan en las leyendas de las figuras junto con las leyendas vernáculas (aunque no se muestran en la salida). Esto también sería otra sección para ignorar selectivamente.

Traducción automática desde English
0 votos

Mientras trabajaba con otro equipo en su lista de palabras hoy, se me ocurrió otro beneficio que vendría de este cambio, particularmente de la idea del marcador “ignorar esta palabra”… las palabras en francés se eliminarían de la lista de palabras, por lo que el usuario no tendría que estar constantemente saltándolas. Tal como está ahora, todas las comprobaciones de ortografía –e incluso una comprobación manual– tienen que saltar mentalmente cualquier palabra extranjera, ya que actualmente no hay forma de excluirlas, a menudo muchas veces en una sola sesión porque ¡están por todas partes! Eliminarlas nos ahorraría a todos mucho trabajo mental.

Traducción automática desde English
por (114 puntos)

\tl … \tl* sería un buen candidato para palabras que se deban ignorar. Por defecto, pone las palabras en cursiva, pero se podría anular eso.

Paulus+Kieviet

Traducción automática desde English
0 votos

No lo sé. El marcador \tl ya tiene un uso particular, que es marcar palabras extranjeras en el texto, por lo que quizás tengan que crear uno nuevo específicamente para esto que no haga el cambio de formato, solo la función de “ignorar en la lista de palabras”… aunque no sería mala idea TAMBIÉN sacar las palabras \tl de la lista de palabras.

Traducción automática desde English
por (114 puntos)
mostrada de nuevo
0 votos

Solo por si alguien planea usar nonpublishable… Tenga en cuenta que la segunda parte del comentario de mnjames anterior es realmente importante (ponerlos como publicable en una hoja de estilos local): nonpublishable es usado por PTXprint para decir ‘esto es un comentario, no ponga nada en la página aquí’. Es decir, se omitirá silenciosamente.

Paratext en realidad ya tiene \tl con un \TextProperties de nonvernacular, es decir, que debería ser tratado de manera diferente a otras palabras.

Con la traducción en la que hemos estado trabajando, tenemos bastante palabras en la lengua nacional como sinónimos / traducciones en nuestro glosario y notas al pie. Al estar en la lengua nacional, rompen todo tipo de reglas para la lengua vernácula, pero son errores ortográficos / erratas comunes cuando la gente está cansada. Sería muy bueno poder excluir estas de los inventarios de caracteres, etc.

Propongo que el texto en cualquier estilo ‘nonvernacular’ sea:

  1. Buscable
  2. Ignorado por completo para los inventarios de caracteres y puntuación (a menos que alguien quiera implementar un segundo conjunto de inventarios no vernáculos).
  3. Tener una entrada distinta y separada en la lista de hifenización, para que puedan ser hifenizadas y revisadas ortográficamente de manera diferente. (es decir, una ortografía correcta en contextos nonvernacular no debería afectar a los contextos no vernáculos, y viceversa).
Traducción automática desde English
por (294 puntos)

Para los proyectos con los que trabajo, definitivamente quiero que las palabras no vernáculas sean publicadas, por lo que no seguiría la ruta de usar cualquier marcador no publicable. Solo quiero una forma de excluir estas palabras de la lista de palabras… o, como sugirió, anon542642, una forma de moverlas a una interfaz separada.

Como he estado discutiendo con Matthew_Lee, nos estamos preguntando si podría ser un clic derecho u otra acción opcional, como cuando rechazamos errores en las comprobaciones básicas. Así “rechazaríamos” una palabra y luego podríamos elegir un filtro para y revisar “todas las palabras rechazadas”.

Traducción automática desde English
0 votos

En lugar de “ignorar” o “rechazar” una palabra extranjera, me tendría más sentido marcar una palabra extranjera (correctamente escrita) como tal. Clic derecho > Marcar como palabra extranjera correctamente escrita (u otra opción). Entonces Paratext podría reconocer (en otros contextos) que esta palabra ES correcta, pero no pertenece al contexto de la lista de palabras vernáculas. Y podría ser mostrada en una lista diferente, o una sublista, o tener un filtro para mostrar TODAS las palabras, solo palabras vernáculas, o solo palabras extranjeras.

Traducción automática desde English
por [Moderator]
(2,1k puntos)

Preguntas relacionadas

0 votos
1 respuesta 299 vistas
Estoy al tanto del tema Excluir palabras extranjeras de la lista de palabras, y veo que la respuesta ... nacional) son errores ortográficos que los traductores podrían cometer.
anon542642 294 preguntada mar 16, 2023
+1 voto
1 respuesta 198 vistas
Dear All, I would like to how can I mark and display the scriptural text with a certain color or ... International Certified) ACC Coach(International Coach Federation) GMT+8.00
anon221954 128 preguntada dic 17, 2019
0 votos
3 respuestas 557 vistas
En Notas, cómo puedo buscar todas las notas que no contienen una palabra específica (en este caso, UNS )? He ... regulares en el cuadro de búsqueda, pero no logro resolverlo.
skim1124 219 preguntada jul 6, 2022
0 votos
2 respuestas 396 vistas
Here's your chance to shape how the wordlist tool works. Consider the following . . . In Paratext, WordList has ... wordlist. Screenshot_2020-03-05-11-01-37800 1280 139 KB
[Moderator]
anon089134
239
preguntada mar 5, 2020
0 votos
4 respuestas 529 vistas
Al exportar una parte de los Evangelios desde Paratext a PDF, las palabras de Jesús en rojo no aparecen en el archivo. Funciona al exportar a RTF, pero no con PDF.
ace541611 123 preguntada jul 7, 2021
Welcome to Support Bible, where you can ask questions and receive answers from other members of the community.
If anyone destroys God’s temple, God will destroy that person; for God’s temple is sacred, and you together are that temple.
1 Corinthians 3:17
3,048 preguntas
6,007 respuestas
5,672 comentarios
2,027 usuarios