+4 वोट
336 व्यूज़

मैं नियमित अभिव्यक्तियों (Regular Expressions) का दीवाना हूँ। जब मैं ऐसे श्लोक खोजने के लिए regex लिख रहा था जिनमें अंत में विराम चिह्न नहीं है:
[^\\][^\p{P}\d]\r\n\\v
या
[^\\l][^\p{P}\d]\r\n\\v \d+ \p{Lu}
, तब मुझे एहसास हुआ कि RegexPal (और FLEx फ़िल्टरिंग/प्रोसेस) में C# फ्लेवर के RegEx में शॉर्टहैंड (लॉन्गहैंड नहीं) यूनिकोड वर्ण श्रेणियाँ समर्थित हैं।

सबसे उपयोगी में से कुछ ये हैं:

  • \p{L} अक्षर (लगभग किसी भी लिपि में)
  • \p{Lu} बड़ा अक्षर (Uppercase letter)
  • \p{Ll} छोटा अक्षर (Lowercase letter)
  • \p{P} विराम चिह्न (Punctuation)
  • \p{M} कोई भी दीयाक्रिटिक (diacritic)

यदि स्लैश के बाद P बड़ा (capital) है, तो इसका अर्थ है कि वह वर्ण श्रेणी नहीं है (NOT)।

  • \P{L} कोई भी गैर-अक्षर (non-letter)

पूरी सूची:

  • \p{L}: किसी भी भाषा का किसी भी प्रकार का अक्षर।
    • \p{Ll}: एक छोटा अक्षर जिसका बड़ा (uppercase) रूप मौजूद है।
    • \p{Lu}: एक बड़ा अक्षर जिसका छोटा (lowercase) रूप मौजूद है।
    • \p{Lt}: एक अक्षर जो शब्द के आरंभ में तब दिखाई देता है जब शब्द के केवल पहले अक्षर को बड़ा (capitalized) किया जाता है।
    • \p{L&}: एक अक्षर जो छोटे और बड़े दोनों रूपों में मौजूद है (Ll, Lu और Lt का संयोजन)।
    • \p{Lm}: एक विशेष चिह्न जो अक्षर की तरह उपयोग किया जाता है।
    • \p{Lo}: एक अक्षर या आइडियोग्राफ़ (ideograph) जिसके छोटे और बड़े रूप नहीं होते।
  • \p{M}: एक ऐसा चिह्न जिसे किसी अन्य चिह्न के साथ जोड़ने के लिए तैयार किया गया है (जैसे कि स्वर-चिह्न, उमलॉट्स, घेरे हुए बॉक्स, आदि)।
    • \p{Mn}: एक ऐसा चिह्न जिसे किसी अन्य चिह्न के साथ जोड़ने के लिए तैयार किया गया है बिना अतिरिक्त स्थान लेने के (जैसे कि स्वर-चिह्न, उमलॉट्स, आदि)।
    • \p{Mc}: एक ऐसा चिह्न जिसे किसी अन्य चिह्न के साथ जोड़ने के लिए तैयार किया गया है और जो अतिरिक्त स्थान लेता है (अनेक पूर्वी भाषाओं में स्वर-चिह्न)।
    • \p{Me}: एक ऐसा चिह्न जो जिस चिह्न के साथ जोड़ा जाता है, उसे घेर लेता है (वृत्त, वर्ग, कीकैप, आदि)।
  • \p{Z}: किसी भी प्रकार का व्हाइटस्पेस या अदृश्य विभाजक।
    • \p{Zs}: एक व्हाइटस्पेस चिह्न जो अदृश्य है, लेकिन स्थान लेता है।
    • \p{Zl}: लाइन विभाजक चिह्न U+2028।
    • \p{Zp}: अनुच्छेद विभाजक चिह्न U+2029।
  • \p{S}: गणितीय प्रतीक, मुद्रा चिह्न, डिंगबैट्स (dingbats), बॉक्स-ड्रॉइंग चिह्न, आदि।
    • \p{Sm}: कोई भी गणितीय प्रतीक।
    • \p{Sc}: कोई भी मुद्रा चिह्न।
    • \p{Sk}: एक संयोजक चिह्न (mark) जो अपने आप में एक पूर्ण चिह्न के रूप में होता है।
    • \p{So}: विभिन्न प्रतीक जो गणितीय प्रतीक, मुद्रा चिह्न या संयोजक चिह्न नहीं हैं।
  • \p{N}: किसी भी लिपि में किसी भी प्रकार का संख्यात्मक चिह्न।
    • \p{Nd}: आइडियोग्राफिक लिपियों को छोड़कर किसी भी लिपि में शून्य से नौ तक का अंक।
    • \p{Nl}: एक संख्या जो अक्षर जैसी दिखती है, जैसे कि रोमन अंक।
    • \p{No}: एक सुपरस्क्रिप्ट या सबस्क्रिप्ट अंक, या एक संख्या जो 0–9 का अंक नहीं है (आइडियोग्राफिक लिपियों की संख्याओं को छोड़कर)।
  • \p{P}: किसी भी प्रकार का विराम चिह्न।
    • \p{Pd}: किसी भी प्रकार का हाइफ़न या डैश।
    • \p{Ps}: किसी भी प्रकार का खुलने वाला ब्रैकेट।
    • \p{Pe}: किसी भी प्रकार का बंद होने वाला ब्रैकेट।
    • \p{Pi}: किसी भी प्रकार का खुलने वाला उद्धरण चिह्न।
    • \p{Pf}: किसी भी प्रकार का बंद होने वाला उद्धरण चिह्न।
    • \p{Pc}: एक विराम चिह्न, जैसे कि अंडरस्कोर, जो शब्दों को जोड़ता है।
    • \p{Po}: किसी भी प्रकार का विराम चिह्न जो डैश, ब्रैकेट, उद्धरण चिह्न या कनेक्टर नहीं है।
  • \p{C}: अदृश्य नियंत्रण चिह्न और अप्रयुक्त कोड पॉइंट।
    • \p{Cc}: एक ASCII या Latin-1 नियंत्रण चिह्न: 0x00–0x1F और 0x7F–0x9F।
    • \p{Cf}: अदृश्य प्रारूपण संकेतक।
    • \p{Co}: निजी उपयोग के लिए आरक्षित कोई भी कोड पॉइंट।
    • \p{Cs}: UTF-16 एन्कोडिंग में सरोगेट जोड़ी (surrogate pair) का आधा हिस्सा।
    • \p{Cn}: कोई भी कोड पॉइंट जिसके लिए कोई चिह्न निर्दिष्ट नहीं किया गया है।

पूर्ण दस्तावेज़ीकरण:
https://www.regular-expressions.info/unicode.html#category

English से मशीन-अनुवादित
Paratext में द्वारा (231 अंक)
फिर से दिखाया गया | 336 व्यूज़

1 उत्तर

0 वोट
***** इस टिप्पणी को उत्तर न मिले प्रश्नों से हटाने के लिए जोड़ा गया *****
English से मशीन-अनुवादित
द्वारा (9.9k अंक)

संबंधित प्रश्न

0 वोट
3 उत्तर 411 व्यूज़
Paratext के साथ GNT92 (Short Bible Reference System, Robert G. Bratcher द्वारा संपादित © 1961 UBS) की क्रॉस-रेफ़रेंस सूची ... नया अनुवाद केवल GNT92 सूची का ही पुनर्उपयोग करता है?
LivingField 607 पूछा गया अक्टूबर 29, 2018
0 वोट
0 उत्तर 135 व्यूज़
Are there ways to display genealogy information that helps make sense of what can be a textual maze? I've looked ... just wonder what others have done-if anything. Thanks, Paul
Paul 642 पूछा गया अगस्त 4, 2015
Paratext में
0 वोट
1 उत्तर 13 व्यूज़
<!--[if gte mso 9]> Normal 0 false false false EN-US EN-CA AR-SA MicrosoftInternetExplorer4 <![endif]--><!--[if gte mso 9 ... है, जबकि मैं अभी भी 9.4.101.25 का उपयोग कर रहा हूं।
Kamesa49 102 पूछा गया सितंबर 6, 2025
Paratext में
0 वोट
2 उत्तर 578 व्यूज़
प्रिय पाठक। मैं \fq के बाद किसी भी स्ट्रिंग को खोजना चाहता हूँ, जिसमें ɛ ɔ ɲ ŋ शामिल हैं, जब तक कि पहला \\ft न ... तक खोज को सीमित करने के लिए कोई सुझाव? पहले से ही धन्यवाद, बार्ट
goodgoan 347 पूछा गया अगस्त 3, 2023
Paratext में
+1 मत
5 उत्तर 890 व्यूज़
मुझे कुछ स्थितियों में लोअरकेस को अपरकेस में बदलना है - उदाहरण के लिए, मैं चाहता हूँ कि कॉलन के बाद के सभी लोअरकेस ... से शुरू करें और फिर जैसे-जैसे आगे बढ़ें उसे जोड़ते जाएं।
Phil_Leckrone 9.9k पूछा गया मार्च 2, 2022
Paratext में
Welcome to Support Bible, where you can ask questions and receive answers from other members of the community.
For just as each of us has one body with many members, and these members do not all have the same function, so in Christ we, though many, form one body, and each member belongs to all the others.
Romans 12:4-5
3,045 प्रश्न
6,005 उत्तर
5,671 टिप्पणियाँ
2,026 उपयोगकर्ता