+4 वोट
344 व्यूज़

मैं नियमित अभिव्यक्तियों (Regular Expressions) का दीवाना हूँ। जब मैं ऐसे श्लोक खोजने के लिए regex लिख रहा था जिनमें अंत में विराम चिह्न नहीं है:
[^\\][^\p{P}\d]\r\n\\v
या
[^\\l][^\p{P}\d]\r\n\\v \d+ \p{Lu}
, तब मुझे एहसास हुआ कि RegexPal (और FLEx फ़िल्टरिंग/प्रोसेस) में C# फ्लेवर के RegEx में शॉर्टहैंड (लॉन्गहैंड नहीं) यूनिकोड वर्ण श्रेणियाँ समर्थित हैं।

सबसे उपयोगी में से कुछ ये हैं:

  • \p{L} अक्षर (लगभग किसी भी लिपि में)
  • \p{Lu} बड़ा अक्षर (Uppercase letter)
  • \p{Ll} छोटा अक्षर (Lowercase letter)
  • \p{P} विराम चिह्न (Punctuation)
  • \p{M} कोई भी दीयाक्रिटिक (diacritic)

यदि स्लैश के बाद P बड़ा (capital) है, तो इसका अर्थ है कि वह वर्ण श्रेणी नहीं है (NOT)।

  • \P{L} कोई भी गैर-अक्षर (non-letter)

पूरी सूची:

  • \p{L}: किसी भी भाषा का किसी भी प्रकार का अक्षर।
    • \p{Ll}: एक छोटा अक्षर जिसका बड़ा (uppercase) रूप मौजूद है।
    • \p{Lu}: एक बड़ा अक्षर जिसका छोटा (lowercase) रूप मौजूद है।
    • \p{Lt}: एक अक्षर जो शब्द के आरंभ में तब दिखाई देता है जब शब्द के केवल पहले अक्षर को बड़ा (capitalized) किया जाता है।
    • \p{L&}: एक अक्षर जो छोटे और बड़े दोनों रूपों में मौजूद है (Ll, Lu और Lt का संयोजन)।
    • \p{Lm}: एक विशेष चिह्न जो अक्षर की तरह उपयोग किया जाता है।
    • \p{Lo}: एक अक्षर या आइडियोग्राफ़ (ideograph) जिसके छोटे और बड़े रूप नहीं होते।
  • \p{M}: एक ऐसा चिह्न जिसे किसी अन्य चिह्न के साथ जोड़ने के लिए तैयार किया गया है (जैसे कि स्वर-चिह्न, उमलॉट्स, घेरे हुए बॉक्स, आदि)।
    • \p{Mn}: एक ऐसा चिह्न जिसे किसी अन्य चिह्न के साथ जोड़ने के लिए तैयार किया गया है बिना अतिरिक्त स्थान लेने के (जैसे कि स्वर-चिह्न, उमलॉट्स, आदि)।
    • \p{Mc}: एक ऐसा चिह्न जिसे किसी अन्य चिह्न के साथ जोड़ने के लिए तैयार किया गया है और जो अतिरिक्त स्थान लेता है (अनेक पूर्वी भाषाओं में स्वर-चिह्न)।
    • \p{Me}: एक ऐसा चिह्न जो जिस चिह्न के साथ जोड़ा जाता है, उसे घेर लेता है (वृत्त, वर्ग, कीकैप, आदि)।
  • \p{Z}: किसी भी प्रकार का व्हाइटस्पेस या अदृश्य विभाजक।
    • \p{Zs}: एक व्हाइटस्पेस चिह्न जो अदृश्य है, लेकिन स्थान लेता है।
    • \p{Zl}: लाइन विभाजक चिह्न U+2028।
    • \p{Zp}: अनुच्छेद विभाजक चिह्न U+2029।
  • \p{S}: गणितीय प्रतीक, मुद्रा चिह्न, डिंगबैट्स (dingbats), बॉक्स-ड्रॉइंग चिह्न, आदि।
    • \p{Sm}: कोई भी गणितीय प्रतीक।
    • \p{Sc}: कोई भी मुद्रा चिह्न।
    • \p{Sk}: एक संयोजक चिह्न (mark) जो अपने आप में एक पूर्ण चिह्न के रूप में होता है।
    • \p{So}: विभिन्न प्रतीक जो गणितीय प्रतीक, मुद्रा चिह्न या संयोजक चिह्न नहीं हैं।
  • \p{N}: किसी भी लिपि में किसी भी प्रकार का संख्यात्मक चिह्न।
    • \p{Nd}: आइडियोग्राफिक लिपियों को छोड़कर किसी भी लिपि में शून्य से नौ तक का अंक।
    • \p{Nl}: एक संख्या जो अक्षर जैसी दिखती है, जैसे कि रोमन अंक।
    • \p{No}: एक सुपरस्क्रिप्ट या सबस्क्रिप्ट अंक, या एक संख्या जो 0–9 का अंक नहीं है (आइडियोग्राफिक लिपियों की संख्याओं को छोड़कर)।
  • \p{P}: किसी भी प्रकार का विराम चिह्न।
    • \p{Pd}: किसी भी प्रकार का हाइफ़न या डैश।
    • \p{Ps}: किसी भी प्रकार का खुलने वाला ब्रैकेट।
    • \p{Pe}: किसी भी प्रकार का बंद होने वाला ब्रैकेट।
    • \p{Pi}: किसी भी प्रकार का खुलने वाला उद्धरण चिह्न।
    • \p{Pf}: किसी भी प्रकार का बंद होने वाला उद्धरण चिह्न।
    • \p{Pc}: एक विराम चिह्न, जैसे कि अंडरस्कोर, जो शब्दों को जोड़ता है।
    • \p{Po}: किसी भी प्रकार का विराम चिह्न जो डैश, ब्रैकेट, उद्धरण चिह्न या कनेक्टर नहीं है।
  • \p{C}: अदृश्य नियंत्रण चिह्न और अप्रयुक्त कोड पॉइंट।
    • \p{Cc}: एक ASCII या Latin-1 नियंत्रण चिह्न: 0x00–0x1F और 0x7F–0x9F।
    • \p{Cf}: अदृश्य प्रारूपण संकेतक।
    • \p{Co}: निजी उपयोग के लिए आरक्षित कोई भी कोड पॉइंट।
    • \p{Cs}: UTF-16 एन्कोडिंग में सरोगेट जोड़ी (surrogate pair) का आधा हिस्सा।
    • \p{Cn}: कोई भी कोड पॉइंट जिसके लिए कोई चिह्न निर्दिष्ट नहीं किया गया है।

पूर्ण दस्तावेज़ीकरण:
https://www.regular-expressions.info/unicode.html#category

English से मशीन-अनुवादित
Paratext में द्वारा (231 अंक)
फिर से दिखाया गया | 344 व्यूज़

1 उत्तर

0 वोट
***** इस टिप्पणी को उत्तर न मिले प्रश्नों से हटाने के लिए जोड़ा गया *****
English से मशीन-अनुवादित
द्वारा (9.9k अंक)

संबंधित प्रश्न

0 वोट
3 उत्तर 426 व्यूज़
Paratext के साथ GNT92 (Short Bible Reference System, Robert G. Bratcher द्वारा संपादित © 1961 UBS) की क्रॉस-रेफ़रेंस सूची ... नया अनुवाद केवल GNT92 सूची का ही पुनर्उपयोग करता है?
LivingField 607 पूछा गया अक्टूबर 29, 2018
0 वोट
0 उत्तर 141 व्यूज़
Are there ways to display genealogy information that helps make sense of what can be a textual maze? I've looked ... just wonder what others have done-if anything. Thanks, Paul
Paul 642 पूछा गया अगस्त 4, 2015
Paratext में
0 वोट
1 उत्तर 21 व्यूज़
<!--[if gte mso 9]> Normal 0 false false false EN-US EN-CA AR-SA MicrosoftInternetExplorer4 <![endif]--><!--[if gte mso 9 ... है, जबकि मैं अभी भी 9.4.101.25 का उपयोग कर रहा हूं।
Kamesa49 102 पूछा गया सितंबर 6, 2025
Paratext में
0 वोट
2 उत्तर 620 व्यूज़
प्रिय पाठक। मैं \fq के बाद किसी भी स्ट्रिंग को खोजना चाहता हूँ, जिसमें ɛ ɔ ɲ ŋ शामिल हैं, जब तक कि पहला \\ft न ... तक खोज को सीमित करने के लिए कोई सुझाव? पहले से ही धन्यवाद, बार्ट
goodgoan 347 पूछा गया अगस्त 3, 2023
Paratext में
+1 मत
5 उत्तर 1.0k व्यूज़
मुझे कुछ स्थितियों में लोअरकेस को अपरकेस में बदलना है - उदाहरण के लिए, मैं चाहता हूँ कि कॉलन के बाद के सभी लोअरकेस ... से शुरू करें और फिर जैसे-जैसे आगे बढ़ें उसे जोड़ते जाएं।
Phil_Leckrone 9.9k पूछा गया मार्च 2, 2022
Paratext में
Welcome to Support Bible, where you can ask questions and receive answers from other members of the community.
Finally, all of you, be like-minded, be sympathetic, love one another, be compassionate and humble.
1 Peter 3:8
3,049 प्रश्न
6,007 उत्तर
5,672 टिप्पणियाँ
2,029 उपयोगकर्ता