0 votes
685 vues

Je dispose d'un script Teckit (avec l'aide de la section logicielle de l'initiative des scripts non latins de MSEA) pour la conversion entre notre script non latin (tibétain) et le latin. Il comporte une fonctionnalité pour la mise en majuscule après un point final et nous l'avons intégrée dans Paratext 8 pour la translittération automatique.

Ça fonctionne bien si le point final se trouve au milieu d'un verset ou d'une région de backslash ; cependant, notre script échoue/est interrompu lorsqu'une commande backslash se trouve entre le point final et le caractère suivant qui devrait être en majuscule.

Y a-t-il quelque chose dans Paratext 8 qui puisse être utilisé comme outil automatique pour convertir la lettre minuscule après un point final en forme majuscule à la limite d'une phrase ?

Ou existe-t-il une fonctionnalité dans les convertisseurs SIL qui peut le faire ?

Traduit automatiquement depuis English
Paratext par (115 points)
réaffiché | 685 vues

4 Réponses

0 votes

D'après vos commentaires, je suppose que tout style de caractère, ou un nouveau vers de poésie (\q1 , \q2) bloquera l'application de la règle. De même, un numéro de verset (\v # ) peut aussi poser problème.

Je n'ai pas de réponse, mais j'ai un problème similaire qui pourrait avoir une solution liée, donc je me greffe sur votre message.

Je cherche à changer la capitalisation des titres de l'anglais américain vers la capitalisation des titres de l'anglais britannique. Le style de titre américain met en majuscule le premier mot et tous les mots sauf un ensemble limité de mots courts, tandis que le style britannique met en majuscule le premier mot et uniquement les noms propres. J'ai la logique pour le faire, mais j'ai besoin d'un moyen de l'appliquer uniquement au texte des titres (\s1 , \s2 , etc. ).

Ce que j'ai constaté, c'est que les projets de translittération n'appliquent les modifications du convertisseur d'encodage qu'au texte vernaculaire, et qu'ils ne tiennent pas compte des contextes de balisage. J'ai un tableau cc qui applique correctement les modifications de capitalisation en dehors de Paratext, mais quand je le charge dans un projet de translittération, il ne fonctionne pas correctement. Mon tableau apporte des modifications à tous les champs de texte vernaculaire. Les champs non vernaculaires (\id , \rem ) n'étaient pas affectés

Pour que la fonctionnalité de translittération soit vraiment utile, nous avons besoin d'un moyen d'apporter des modifications qui tiennent compte du contexte de balisage. Est-ce possible ?

Traduit automatiquement depuis English
par (1,8k points)
réaffiché

Avant que Paratext ne permette les projets de translittération au sein de Paratext lui-même, nous
utilisions l'outil TECkit Bulk SFM Converter qui fait partie de SIL Converters (
http://scripts.sil.org/cms/scripts/page.php?site_id=nrsi&id=enccnvtrs).
Cet outil utilise le même fichier *.tec utilisé dans le projet de translittération dans
Paratext, mais a la capacité d'appliquer la conversion à des SFM spécifiques
uniquement. Le seul problème avec l'utilisation de cet outil est qu'il doit être appliqué au
texte manuellement et en dehors de Paratext chaque fois que le texte ou le convertisseur est
modifié et que chaque fichier des Écritures (livre) doit être enregistré manuellement, ce qui est pénible quand
il y a plus de 66 livres à traiter.

Bénédiction,

Shegnada J.

Coordinatrice Technologie des Langues & Édition, SIL Nigeria

Spécialiste de la mise en page des scripts complexes, GPS Dallas

Skype : Shegnada.james.

([Phone Removed]

Traduit automatiquement depuis English
0 votes

Je réponds à cette conversation plutôt que d'en démarrer une nouvelle, car cette conversation semble étroitement liée à ma question :

Nous avons un NT publié en script arabe ; il y a une demande pour publier le même texte en script latin.

Cela sera une translittération ponctuelle, donc n'a pas besoin d'être mise à jour dynamiquement dans Paratext. Mais je me demande si quelqu'un a développé une chaîne RegEx pour mettre les caractères initiaux des phrases en majuscule ? J'ai le même défi que celui mentionné par anon024386 dans le message initial, à savoir faire en sorte que la chaîne examine tous les SFM possibles et voit le mot suivant la ponctuation finale…

Traduit automatiquement depuis English
par (175 points)

Ceci est une réponse latérale à votre e-mail, pas une réponse à votre question, mais un commentaire sur votre processus.

D'après mon expérience, la translittération n'est jamais l'événement ponctuel et simple que nous souhaiterions tous, et il vaut la peine d'utiliser l'outil de translittération dans Paratext. Vous voudrez exécuter à nouveau toutes les vérifications de Paratext sur le projet translittéré et vous trouverez des problèmes qui vous feront modifier votre convertisseur et votre texte source plusieurs fois. De plus, le mapping TecIt est beaucoup plus robuste et plus flexible que RegEx et peut inclure votre besoin de capitalisation en son sein. Ayant effectué le processus à la fois en dehors de Paratext (quand ce n'était pas possible) et dans Paratext, je vous encourage vivement à le faire dans Paratext.

Traduit automatiquement depuis English

Merci Shegnada ! Oui, je suis tout à fait d'accord pour dire qu'aucun protocole de translittération ne donnera un résultat parfait, et que nous devrons exécuter les vérifications dans Paratext.

Nous utilisons TecKit pour la translittération, mais il est inadéquat en raison de certaines ambiguïtés lors du passage du script arabe au script latin qui ne peuvent pas (pour l'instant) être résolues par un algorithme. Nous devrons donc utiliser une approche basée sur un dictionnaire/liste de mots pour la translittération initiale.

Cela résout la capitalisation des noms propres. Mais nous cherchons un moyen automatisé d'ajouter des conventions de capitalisation pour le début des phrases, des citations, etc.

J'espère que cela clarifie les choses !

Traduit automatiquement depuis English
0 votes

Vous pouvez utiliser le code suivant pour mettre les lettres en majuscule dans RegexPal :
^^^
Voici une expression régulière qui mettra la première lettre d'une phrase en majuscule après un [.?!] . Elle permet des guillemets fermants intercalés, des balisages de paragraphe, de poésie ou de liste, des lignes vides, des numéros de versets et des guillemets d'ouverture de phrase. Elle met également en majuscule après un \s et un \p , qui peuvent se trouver au début d'un chapitre ou après un titre qui n'a pas de ponctuation finale. Vous devrez vérifier manuellement les mots suivant ?" ou !" car ils sont parfois en majuscule et parfois non.
Rechercher :
(?<=([.?!][”’]*(\s+\\(b|p|q|li))*|\\(p|s)?)(\s+\\v\s\S+)?\s+[“‘]*)(\p{Ll})
Remplacer par :
^^^\6
Ce code mettra en majuscule les mots dans les listes marquées avec \li et la poésie marquée avec \q Si vous utilisez un balisage plus complexe : notes de bas de page, références croisées, \q1\q2 \li1 \li2 \pm \pc \qc \qr etc., vous devrez faire des ajustements.
Note Les guillemets typographiques ne sont pas miroirs, ils doivent donc être inversés dans le convertisseur d'encodage lors de la translittération de RTL vers LTR.

Traduit automatiquement depuis English
par (1,8k points)
réaffiché
0 votes

CrazyRocky, merci beaucoup en retard pour cette expression régulière pour la capitalisation. (Je reviens enfin à cette tâche après une longue interruption.) J'ai pu modifier la chaîne comme vous l'avez suggéré pour accommoder nos guillemets « » ainsi que les marqueurs \q1 et \q2, et ça fonctionne très bien.

J'ai remarqué aujourd'hui qu'à Luc 2:49-50, nous avons une note de bas de page entre la ponctuation fermante et le guillemet fermant, ce qui semble empêcher la capitalisation du premier mot du v. 50 :

image

La note de bas de page contient une traduction alternative de la dernière phrase de la citation. Suggéreriez-vous de modifier la chaîne de recherche ou de déplacer la note de bas de page ?

Traduit automatiquement depuis English
par (175 points)

CrazyRocky, je suis loin de mon bureau cette semaine, mais je voulais vous faire savoir que vous pouvez exécuter un processus externe en utilisant un fichier batch (avec une boucle pour chacun des 66+ livres) qui ne convertit que des marqueurs spécifiques, en utilisant soit des mappings CC, soit des mappings TECkit. La seule réserve est que vous devez changer de chapitre dans Paratext (qui peut même rester ouvert pendant l'exécution) pour actualiser/mettre à jour le texte affiché.
D'après mon expérience, c'est rapide ET fiable.
Je pourrais vous envoyer un exemple à la fin de la semaine, mais je suppose que vous avez déjà les compétences nécessaires. :slight_smile:
Bénédiction,
Mark

Traduit automatiquement depuis English

Questions connexes

0 votes
1 réponse 211 vues
We have a user who is doing a transliteration from one script in a language to another script in the same language. ... has the reference number of PTXS-17276 Thank you, MSEAIT/LT
MSEAIT_LT 478 posée août 3, 2018
0 votes
3 réponses 477 vues
I am trying to navigate my first transliteration project. Background information The team is starting typesetting, and has ... are supposed to work and what behavior is expected.
[Moderator]
dhigby
1,3k
posée août 3, 2018
0 votes
3 réponses 867 vues
J'essaie d'affiner un convertisseur d'encodage .tec afin de le rendre sûr pour un aller-retour (round trip) pour ... avec RegexPal. Des suggestions sur la façon de faire cela ?
DVM 175 posée mars 17, 2021
0 votes
1 réponse 180 vues
I have the main vernacular project in a special script and also a Romanized version using transliteration. When trying to do ... you want to do spell checking on the primary text?
anon650332 163 posée déc. 31, 2018
0 votes
4 réponses 382 vues
As I am gradually getting more involved in language and dialect adaptations, I keep thinking about what might be the best ... a discussion on this topic with pros and cons, etc.
anon233143 252 posée oct. 31, 2018
Welcome to Support Bible, where you can ask questions and receive answers from other members of the community.
If anyone destroys God’s temple, God will destroy that person; for God’s temple is sacred, and you together are that temple.
1 Corinthians 3:17
3,049 questions
6,008 réponses
5,673 commentaires
2,029 utilisateurs