Parsers
Parsers
Inre eld - Klasserna på denna sida är inte en del av den offentliga API och exporteras inte från toppnivåerna.
aspose.words_fosspaket. de används intern av dokumentkonverteringsröret. De flesta utvecklare bör användaDocument.save()ochDocument.get_text()I stället se Kärnledning för den offentliga API. Dessa klasser är implementeringsdetaljer och kan ändras utan varning.
Aspose.Words FOSS for Python includes specialized parsers that extract structured data from DOCX internals. The NumberingParser handledar listan med numeriska definitioner, och StyleParser Utdrag av dokumentstilar.
Antal Parser
NumberingParser Läs numreringsdefinitionerna från en DOCX-paket och exponerar dem via en fråge API. parse_numbering_part() för att ladda numrering XML, sedan fråga om egenskaper med hjälpmetoder.
| Method | Beskrivning |
|---|---|
NumberingParser.parse_numbering_part() | Färja DOCX nummerelementet |
NumberingParser.get_list_info() | Få information om en specifik lista med ID |
NumberingParser.get_level_info() | Få nivådetaljer för en lista i en viss djup |
NumberingParser.is_ordered_list() | Kontrollera om en lista nivå är beställd eller skjutit |
NumberingParser.get_start_value() | Få startnummer för en lista nivå |
NumberingParser.get_delimiter() | Få delimitersträngen för en lista nivå |
Styl Parser
StyleParser Pars stil namn i strukturerad ParsedStyle Det identifierar rubriker, blockkvoter, kodblock och listparagrafer från DOCX-stilsnamn.
| Method | Beskrivning |
|---|---|
StyleParser.parse() | Parsa ett stilnamn i en ParsedStyle Objektet |
StyleParser.get_style_chain() | Parsa en kedja av stilnamn för arvade stilar |
StyleParser.is_setext_heading() | Kontrollera om en stil är ett Setext-stil heading |
StyleParser.extract_all_styles() | Extract individuella stilnamn från en comma-skild kedja |
Numrerande datamodell
Parsed nummerdata lagras i strukturerade objekt:
| Class | Beskrivning |
|---|---|
NumberingInfo | Numrering definition med num_id, abstract_num_id,och levels |
NumberingLevel | Definitionen av nivå med format, start,och text Fastigheter |
ListInfo | Information om en specifik lista instans |
ListLevelInfo | Nivåspecifika formateringsdetaljer |
Tips och bästa praxis
- Call
parse_numbering_part()en gång efter att ha laddat upp ett dokument för att populera alla listdefinitioner - Användning
is_ordered_list()att skilja nummerade listor från bulleted listorna - Användning
get_style_chain()att parsa arvade stilkedjor i ett enda samtal - Numrering och stilparsrar används intern av dokumentkonverteringsröret
Vanliga frågor
| Issue | Cause | Fixar |
|---|---|---|
| tomma numeriska definitioner | Dokumentet har inga listor | Check get_list_info() returvärde innan tillgång till fastigheter |
| Saknar stil | Stylnamn inte erkänns | Användning parse() med ett känt namn i stil |
| Felaktig lista nivåer | Fel parameter nivå | Lista nivåer är nollindexerade |
API Referens sammanfattning
| Klass / Metod | Beskrivning |
|---|---|
NumberingParser.parse_numbering_part() | Parse DOCX numeriska definitioner |
NumberingParser.get_list_info() | Söklista information genom ID |
NumberingParser.is_ordered_list() | Kontrollera om en lista nivå är beställd |
StyleParser.parse() | Parsa ett stilnamn i strukturerad information |
StyleParser.get_style_chain() | Parse en kedja av arvade stilnamn |
NumberingInfo | Numrering definition data modell |
NumberingLevel | Nivådefinition med format och startvärde |