+4 votos
334 vistas

Soy un fanático de las expresiones regulares. Mientras escribía una expresión regular para buscar versículos sin puntuación final:
[^\\][^\p{P}\d]\r\n\\v
o
[^\\l][^\p{P}\d]\r\n\\v \d+ \p{Lu}
, me di cuenta de que la variante de C# de RegEx en RegexPal (y en el filtrado/proceso de FLEx) admite categorías de caracteres Unicode abreviadas (no extensas).

Algunas de las más útiles son:

  • \p{L} Letra (casi cualquier ortografía)
  • \p{Lu} Letra mayúscula
  • \p{Ll} Letra minúscula
  • \p{P} Puntuación
  • \p{M} Cualquier diacrítico

Si la P después de la barra es mayúscula, significa NO esa clase de caracteres.

  • \P{L} Cualquier no letra

La lista completa:

  • \p{L}: cualquier tipo de letra de cualquier idioma.
    • \p{Ll}: una letra minúscula que tiene una variante mayúscula.
    • \p{Lu}: una letra mayúscula que tiene una variante minúscula.
    • \p{Lt}: una letra que aparece al inicio de una palabra cuando solo la primera letra de la palabra está en mayúscula.
    • \p{L&}: una letra que existe en variantes minúscula y mayúscula (combinación de Ll, Lu y Lt).
    • \p{Lm}: un carácter especial que se usa como una letra.
    • \p{Lo}: una letra o ideograma que no tiene variantes minúscula y mayúscula.
  • \p{M}: un carácter destinado a combinarse con otro carácter (p. ej., acentos, diéresis, recuadros envolventes, etc.).
    • \p{Mn}: un carácter destinado a combinarse con otro carácter sin ocupar espacio adicional (p. ej., acentos, diéresis, etc.).
    • \p{Mc}: un carácter destinado a combinarse con otro carácter que ocupa espacio adicional (signos vocálicos en muchos idiomas orientales).
    • \p{Me}: un carácter que envuelve al carácter con el que se combina (círculo, cuadrado, tecla, etc.).
  • \p{Z}: cualquier tipo de espacio en blanco o separador invisible.
    • \p{Zs}: un carácter de espacio en blanco que es invisible, pero ocupa espacio.
    • \p{Zl}: carácter separador de línea U+2028.
    • \p{Zp}: carácter separador de párrafo U+2029.
  • \p{S}: símbolos matemáticos, signos de moneda, dingbats, caracteres de dibujo de cuadros, etc.
    • \p{Sm}: cualquier símbolo matemático.
    • \p{Sc}: cualquier signo de moneda.
    • \p{Sk}: un carácter de combinación (marca) como un carácter completo por sí mismo.
    • \p{So}: varios símbolos que no son símbolos matemáticos, signos de moneda o caracteres de combinación.
  • \p{N}: cualquier tipo de carácter numérico en cualquier escritura.
    • \p{Nd}: un dígito del cero al nueve en cualquier escritura, excepto las escrituras ideográficas.
    • \p{Nl}: un número que parece una letra, como un numeral romano.
    • \p{No}: un dígito en superíndice o subíndice, o un número que no es un dígito del 0 al 9 (excluyendo números de escrituras ideográficas).
  • \p{P}: cualquier tipo de carácter de puntuación.
    • \p{Pd}: cualquier tipo de guion o raya.
    • \p{Ps}: cualquier tipo de corchete de apertura.
    • \p{Pe}: cualquier tipo de corchete de cierre.
    • \p{Pi}: cualquier tipo de comilla de apertura.
    • \p{Pf}: cualquier tipo de comilla de cierre.
    • \p{Pc}: un carácter de puntuación, como un guion bajo, que conecta palabras.
    • \p{Po}: cualquier tipo de carácter de puntuación que no es un guion, corchete, comilla o conector.
  • \p{C}: caracteres de control invisibles y puntos de código no utilizados.
    • \p{Cc}: un carácter de control ASCII o Latin-1: 0x00–0x1F y 0x7F–0x9F.
    • \p{Cf}: indicador de formato invisible.
    • \p{Co}: cualquier punto de código reservado para uso privado.
    • \p{Cs}: la mitad de un par de sustitutos en la codificación UTF-16.
    • \p{Cn}: cualquier punto de código al que no se le ha asignado ningún carácter.

Documentación completa:
https://www.regular-expressions.info/unicode.html#category

Traducción automática desde English
Paratext por (231 puntos)
mostrada de nuevo | 334 vistas

1 Respuesta

0 votos
***** Añadido para eliminar este comentario de las preguntas sin responder *****
Traducción automática desde English
por (9,9k puntos)

Preguntas relacionadas

0 votos
3 respuestas 411 vistas
Paratext incluye la lista de referencias cruzadas de la GNT92 (Sistema Breve de Referencias Bíblicas, editado por ... nueva traducción simplemente reutiliza la lista de la GNT92?
LivingField 607 preguntada oct 29, 2018
0 votos
0 respuestas 135 vistas
Are there ways to display genealogy information that helps make sense of what can be a textual maze? I've looked ... just wonder what others have done-if anything. Thanks, Paul
Paul 642 preguntada ago 4, 2015
0 votos
1 respuesta 13 vistas
<!--[if gte mso 9]> Normal 0 false false false EN-US EN-CA AR-SA MicrosoftInternetExplorer4 <![endif]--><!--[if gte mso ... 5.101.3, mientras que yo aún estoy usando la 9.4.101.25.
Kamesa49 102 preguntada sep 6, 2025
0 votos
2 respuestas 578 vistas
Estimado lector. Me gustaría encontrar \fq seguido de cualquier cadena de caracteres, incluyendo ɛ ɔ ɲ ŋ, hasta el ... a la primera no ocurrencia? Gracias de antemano, Bart
goodgoan 347 preguntada ago 3, 2023
+1 voto
5 respuestas 890 vistas
Quiero cambiar de minúsculas a mayúsculas en ciertas situaciones; por ejemplo, quiero cambiar todas las minúsculas después de ... muy simple y luego agregarle a medida que avanza.
Phil_Leckrone 9,9k preguntada mar 2, 2022
Welcome to Support Bible, where you can ask questions and receive answers from other members of the community.
If anyone destroys God’s temple, God will destroy that person; for God’s temple is sacred, and you together are that temple.
1 Corinthians 3:17
3,045 preguntas
6,005 respuestas
5,671 comentarios
2,026 usuarios