Il y a des années, je me souviens avoir vu une lettre d'information de Paratext annonçant une nouvelle fonctionnalité qui aide les utilisateurs à visualiser les points de code Unicode dans le texte. Il y était dit quelque chose comme : « Nous savons qu'il existe souvent plus d'une combinaison de points de code Unicode qui peut être utilisée pour représenter un caractère donné. Souvent, la façon dont le caractère ou le mot est composé dépend beaucoup du clavier utilisé par le traducteur et des frappes clavier spécifiques qu'il a utilisées. Si vous avez des difficultés à trouver des mots dans les résultats de recherche ou lors de l'exécution d'opérations regex, vous pouvez utiliser cet outil que nous avons créé pour vous afin de visualiser comment chaque mot et chaque caractère est représenté en profondeur. »
Je connais Alt+X pour voir les points de code d'un caractère, ainsi que Outils>Inventaires de vérification>Inventaire des caractères, mais aucun de ces deux éléments n'affiche des mots entiers avec leurs points de code - c'est ce dont je me souviens avoir vu dans la capture d'écran de l'annonce.
Quelqu'un sait-il où trouver cette annonce ou la fonctionnalité qu'elle décrit ? J'ai cherché un peu partout et je ne parviens pas à la trouver.
Mon objectif ultime est de mieux comprendre comment les différentes méthodes de codage des caractères et de représentation des mots affectent les projets linguistiques. Que ce soit en consultant la documentation accompagnante ou en discutant avec des experts du sujet.
Merci !
Years ago I remember seeing a Paratext newsletter with an announcement about a new feature that helps users visualize the Unicode codepoints in the text. It said something like “We know that there is often more than one combination of Unicode codepoints that can be used to represent a given character. Often, the way the character or word is composed depends a lot on the keyboard the translator is using and the particular keystrokes he used. If you’re having trouble finding words in search results or when trying to perform regex operations, you can use this tool we made for you to visualize how each word and character is represented underlyingly.”
I’m familiar with Alt+X to see the codepoints for a character, and also with Tools>Checking Inventories>Characters Inventory, but neither of these show entire words with their codepoints- that’s what I remember seeing in the printscreen in the announcement.
Does anyone know where to find this announcement or the feature it describes? I’ve searched around and can’t find it.
My ultimate goal is to better understand how different ways of encoding characters and representing words affect language projects. Be it through looking through accompanying documentation or talking with experts on the topic.
Thank you!
Traduit automatiquement depuis English