Parsers

Parsers

Wewnętrzny API — Klasy na tej stronie nie są częścią publicznego API i nie są eksportowane z poziomu najwyższego aspose.words_foss pakietu. Są używane wewnętrznie przez potok konwersji dokumentów. Większość programistów powinna używać LdmMarkdownWriter/LdmPdfWriter klas oraz Document.text właściwość zamiast tego. Zobacz Core Management dla publicznego API. Te klasy są szczegółami implementacji i mogą ulec zmianie bez powiadomienia.

Aspose.Words FOSS dla Python zawiera specjalistyczne parsery, które wyodrębniają ustrukturyzowane dane z wewnętrznych elementów DOCX. NumberingParser obsługuje definicje numeracji list, a StyleParser wyodrębnia style dokumentu.


Parser numeracji

NumberingParser odczytuje definicje numeracji z pakietu DOCX i udostępnia je za pośrednictwem zapytania API. Użyj parse_numbering_part(), aby załadować numerację XML, a następnie zapytaj o właściwości list przy użyciu metod pomocniczych.

MetodaOpis
NumberingParser.parse_numbering_part()Parsuj element numeracji DOCX
NumberingParser.get_list_info()Pobierz informacje o określonej liście według identyfikatora
NumberingParser.get_level_info()Pobierz szczegóły poziomu dla listy na określonej głębokości
NumberingParser.is_ordered_list()Sprawdź, czy poziom listy jest numerowany czy wypunktowany
NumberingParser.get_start_value()Pobierz początkowy numer dla poziomu listy
NumberingParser.get_delimiter()Pobierz ciąg separatora dla poziomu listy

Parser stylów

StyleParser analizuje nazwy stylów do ustrukturyzowanych obiektów ParsedStyle. Rozpoznaje nagłówki, cytaty blokowe, bloki kodu oraz akapity list z nazw stylów DOCX.

MetodaOpis
StyleParser.parse()Przetwórz nazwę stylu na obiekt ParsedStyle
StyleParser.get_style_chain()Przetwórz łańcuch nazw stylów w celu uzyskania stylów dziedziczonych
StyleParser.is_setext_heading()Sprawdź, czy styl jest nagłówkiem w stylu Setext
StyleParser.extract_all_styles()Wyodrębnij poszczególne nazwy stylów z łańcucha rozdzielonego przecinkami

Model danych numeracji

Przetworzone dane numeracji są przechowywane w strukturalnych obiektach:

KlasaOpis
NumberingInfoDefinicja numeracji z num_id, abstract_num_id i levels
NumberingLevelDefinicja poziomu z właściwościami format, start i text
ListInfoInformacje o konkretnym wystąpieniu listy
ListLevelInfoSzczegóły formatowania specyficzne dla poziomu

Wskazówki i najlepsze praktyki

  • Wywołaj parse_numbering_part() raz po załadowaniu dokumentu, aby wypełnić wszystkie definicje list
  • Użyj is_ordered_list(), aby odróżnić listy numerowane od list wypunktowanych
  • Użyj get_style_chain(), aby przetworzyć odziedziczone łańcuchy stylów w jednym wywołaniu
  • Parsery numeracji i stylów są używane wewnętrznie przez potok konwersji dokumentów

Typowe problemy

ProblemPrzyczynaNapraw
Puste definicje numeracjiDokument nie zawiera listSprawdź wartość zwracaną get_list_info() przed dostępem do właściwości
Brakujący stylNazwa stylu nie rozpoznanaUżyj parse() z znaną nazwą stylu
Nieprawidłowy poziom listyNieprawidłowy parametr poziomuPoziomy list są indeksowane od zera

API Reference Podsumowanie

Klasa / MetodaOpis
NumberingParser.parse_numbering_part()Parsuj definicje numeracji DOCX
NumberingParser.get_list_info()Zapytaj o informacje o liście według ID
NumberingParser.is_ordered_list()Sprawdź, czy poziom listy jest uporządkowany
StyleParser.parse()Parsuj nazwę stylu do ustrukturyzowanych informacji
StyleParser.get_style_chain()Parsuj łańcuch dziedziczonych nazw stylów
NumberingInfoModel danych definicji numeracji
NumberingLevelDefinicja poziomu z formatem i wartością początkową

Zobacz także

 Polski