Parsers
Parsers
आंतरिक API — इस पृष्ठ की कक्षाएँ सार्वजनिक API का हिस्सा नहीं हैं और टॉप-लेवल से निर्यात नहीं की गई हैं
aspose.words_fossपैकेज। इन्हें दस्तावेज़ परिवर्तन पाइपलाइन द्वारा आंतरिक रूप से उपयोग किया जाता है। अधिकांश डेवलपर्स को चाहिए कि वेLdmMarkdownWriter/LdmPdfWriterकक्षाओं औरDocument.textप्रॉपर्टी का उपयोग करें। देखें कोर प्रबंधन सार्वजनिक API के लिए। ये कक्षाएँ कार्यान्वयन विवरण हैं और बिना सूचना के बदल सकती हैं।
Aspose.Words FOSS for Python में विशेषीकृत पार्सर शामिल हैं जो DOCX आंतरिक हिस्सों से संरचित डेटा निकालते हैं। NumberingParser सूची क्रमांक परिभाषाओं को संभालता है, और StyleParser दस्तावेज़ शैलियों को निकालता है।
नंबरिंग पार्सर
NumberingParser DOCX पैकेज से क्रमांक परिभाषाओं को पढ़ता है और उन्हें एक क्वेरी API के माध्यम से उजागर करता है। क्रमांक XML लोड करने के लिए parse_numbering_part() का उपयोग करें, फिर सहायक विधियों से सूची गुणों को क्वेरी करें।
| विधि | विवरण |
|---|---|
NumberingParser.parse_numbering_part() | DOCX नंबरिंग तत्व को पार्स करें |
NumberingParser.get_list_info() | ID द्वारा किसी विशिष्ट सूची की जानकारी प्राप्त करें |
NumberingParser.get_level_info() | दिए गए गहराई पर सूची के लिए स्तर विवरण प्राप्त करें |
NumberingParser.is_ordered_list() | जाँचें कि सूची स्तर क्रमबद्ध है या बुलेटेड है |
NumberingParser.get_start_value() | सूची स्तर के लिए प्रारंभिक संख्या प्राप्त करें |
NumberingParser.get_delimiter() | सूची स्तर के लिए विभाजक स्ट्रिंग प्राप्त करें |
स्टाइल पार्सर
StyleParser शैली नामों को संरचित ParsedStyle वस्तुओं में पार्स करता है। यह DOCX शैली नामों से शीर्षक, ब्लॉककोट, कोड ब्लॉक्स, और सूची पैराग्राफ को पहचानता है।
| विधि | विवरण |
|---|---|
StyleParser.parse() | एक शैली नाम को ParsedStyle ऑब्जेक्ट में पार्स करें |
StyleParser.get_style_chain() | विरासत में मिली शैलियों के लिए शैली नामों की श्रृंखला को पार्स करें |
StyleParser.is_setext_heading() | जाँचें कि क्या कोई शैली Setext-शैली शीर्षक है |
StyleParser.extract_all_styles() | कॉमा-सेपरेटेड श्रृंखला से व्यक्तिगत शैली नाम निकालें |
नंबरिंग डेटा मॉडल
पार्स किया गया नंबरिंग डेटा संरचित ऑब्जेक्ट्स में संग्रहीत किया जाता है:
| क्लास | विवरण |
|---|---|
NumberingInfo | संख्या परिभाषा जिसमें num_id, abstract_num_id, और levels शामिल हैं |
NumberingLevel | स्तर परिभाषा जिसमें format, start, और text गुण शामिल हैं |
ListInfo | एक विशिष्ट सूची उदाहरण के बारे में जानकारी |
ListLevelInfo | स्तर-विशिष्ट स्वरूपण विवरण |
टिप्स और सर्वोत्तम प्रथाएँ
- दस्तावेज़ लोड करने के बाद
parse_numbering_part()को एक बार कॉल करें ताकि सभी सूची परिभाषाएँ भर सकें is_ordered_list()का उपयोग क्रमांकित सूचियों को बुलेटेड सूचियों से अलग करने के लिए करें- एक ही कॉल में वंशागत स्टाइल चेन को पार्स करने के लिए
get_style_chain()का उपयोग करें - डॉक्यूमेंट रूपांतरण पाइपलाइन द्वारा आंतरिक रूप से नंबरिंग और स्टाइल पार्सर का उपयोग किया जाता है
सामान्य समस्याएँ
| समस्या | कारण | समाधान |
|---|---|---|
| खाली क्रमांक परिभाषाएँ | दस्तावेज़ में कोई सूची नहीं है | गुणों तक पहुँचने से पहले get_list_info() के रिटर्न मान की जाँच करें |
| गायब style | स्टाइल नाम पहचाना नहीं गया | ज्ञात स्टाइल नाम के साथ parse() का उपयोग करें |
| गलत सूची स्तर | गलत स्तर पैरामीटर | सूची स्तर शून्य-सूचकांकित होते हैं |
API Reference सारांश
| क्लास / मेथड | विवरण |
|---|---|
NumberingParser.parse_numbering_part() | DOCX क्रमांकन परिभाषाओं को पार्स करें |
NumberingParser.get_list_info() | ID द्वारा सूची जानकारी क्वेरी करें |
NumberingParser.is_ordered_list() | जाँचें कि सूची स्तर क्रमबद्ध है या नहीं |
StyleParser.parse() | स्टाइल नाम को संरचित जानकारी में पार्स करें |
StyleParser.get_style_chain() | विरासत में प्राप्त स्टाइल नामों की श्रृंखला को पार्स करें |
NumberingInfo | नंबरिंग परिभाषा डेटा मॉडल |
NumberingLevel | फ़ॉर्मेट और प्रारंभिक मान के साथ स्तर परिभाषा |