Hace años recuerdo haber visto un boletín de Paratext con un anuncio sobre una nueva función que ayuda a los usuarios a visualizar los puntos de código Unicode en el texto. Decía algo como: «Sabemos que a menudo hay más de una combinación de puntos de código Unicode que se puede utilizar para representar un carácter determinado. A menudo, la forma en que se compone el carácter o la palabra depende en gran medida del teclado que utiliza el traductor y de las combinaciones de teclas específicas que empleó. Si tiene problemas para encontrar palabras en los resultados de búsqueda o al intentar realizar operaciones de expresiones regulares, puede utilizar esta herramienta que hemos creado para usted para visualizar cómo se representa cada palabra y carácter a nivel subyacente».
Estoy familiarizado con Alt+X para ver los puntos de código de un carácter, y también con Herramientas>Inventarios de verificación>Inventario de caracteres, pero ninguno de estos muestra palabras completas con sus puntos de código; eso es lo que recuerdo haber visto en la captura de pantalla del anuncio.
¿Alguien sabe dónde encontrar este anuncio o la función que describe? He buscado por ahí y no puedo encontrarlo.
Mi objetivo final es comprender mejor cómo diferentes formas de codificar caracteres y representar palabras afectan a los proyectos de idiomas. Ya sea a través de la documentación adjunta o hablando con expertos en el tema.
¡Gracias!
Years ago I remember seeing a Paratext newsletter with an announcement about a new feature that helps users visualize the Unicode codepoints in the text. It said something like “We know that there is often more than one combination of Unicode codepoints that can be used to represent a given character. Often, the way the character or word is composed depends a lot on the keyboard the translator is using and the particular keystrokes he used. If you’re having trouble finding words in search results or when trying to perform regex operations, you can use this tool we made for you to visualize how each word and character is represented underlyingly.”
I’m familiar with Alt+X to see the codepoints for a character, and also with Tools>Checking Inventories>Characters Inventory, but neither of these show entire words with their codepoints- that’s what I remember seeing in the printscreen in the announcement.
Does anyone know where to find this announcement or the feature it describes? I’ve searched around and can’t find it.
My ultimate goal is to better understand how different ways of encoding characters and representing words affect language projects. Be it through looking through accompanying documentation or talking with experts on the topic.
Thank you!
Traducción automática desde English