Parsers
Parsers
内部 API — このページのクラスは公開されている API の一部ではなく、トップレベルからエクスポートされていません
aspose.words_fossパッケージです。これらは文書変換パイプラインで内部的に使用されます。ほとんどの開発者はLdmMarkdownWriter/LdmPdfWriterクラスとDocument.textプロパティを代わりに使用してください。参照 Core Management 公開 API を参照してください。これらのクラスは実装の詳細であり、予告なく変更される可能性があります。
Aspose.Words FOSS for Python は、DOCX の内部から構造化データを抽出する専門的なパーサーを含みます。NumberingParser はリスト番号付け定義を処理し、StyleParser は文書スタイルを抽出します。
番号付けパーサー
NumberingParser は DOCX パッケージから番号付け定義を読み取り、クエリ API を通じて公開します。parse_numbering_part() を使用して番号付け XML をロードし、ヘルパーメソッドでリストプロパティをクエリします。
| メソッド | 説明 |
|---|---|
NumberingParser.parse_numbering_part() | DOCX の番号付け要素を解析する |
NumberingParser.get_list_info() | IDで特定のリストに関する情報を取得する |
NumberingParser.get_level_info() | 指定された深さでリストのレベル詳細を取得する |
NumberingParser.is_ordered_list() | リストレベルが順序付きか箇条書きかを確認する |
NumberingParser.get_start_value() | リストレベルの開始番号を取得します |
NumberingParser.get_delimiter() | リストレベルの区切り文字列を取得します |
スタイルパーサー
StyleParser はスタイル名を構造化された ParsedStyle オブジェクトに解析します。DOCX のスタイル名から見出し、ブロック引用、コードブロック、リスト段落を識別します。
| メソッド | 説明 |
|---|---|
StyleParser.parse() | スタイル名を ParsedStyle オブジェクトに解析する |
StyleParser.get_style_chain() | 継承スタイル用にスタイル名のチェーンを解析する |
StyleParser.is_setext_heading() | スタイルが Setext スタイルの見出しかどうかを確認する |
StyleParser.extract_all_styles() | カンマ区切りのチェーンから個々のスタイル名を抽出する |
番号付けデータモデル
解析された番号付けデータは構造化オブジェクトに格納されます:
| クラス | 説明 |
|---|---|
NumberingInfo | 番号付け定義(num_id、abstract_num_id、およびlevels) |
NumberingLevel | レベル定義(format、start、およびtext のプロパティ) |
ListInfo | 特定のリストインスタンスに関する情報 |
ListLevelInfo | レベル固有の書式設定の詳細 |
ヒントとベストプラクティス
- ドキュメントを読み込んだ後、
parse_numbering_part()を一度呼び出してすべてのリスト定義を生成します is_ordered_list()を使用して、番号付きリストと箇条書きリストを区別します- 単一の呼び出しで継承されたスタイルチェーンを解析するには、
get_style_chain()を使用します - 番号付けとスタイルのパーサーは、ドキュメント変換パイプライン内で内部的に使用されます
一般的な問題
| 問題 | 原因 | 修正 |
|---|---|---|
| 空の番号付け定義 | ドキュメントにリストがありません | プロパティにアクセスする前に get_list_info() の戻り値を確認してください |
| スタイルが不足しています | スタイル名が認識されません | 既知のスタイル名とともに parse() を使用してください |
| 不正なリストレベル | レベルパラメータが間違っています | リストレベルはゼロベースです |
API Reference 概要
| クラス / メソッド | 説明 |
|---|---|
NumberingParser.parse_numbering_part() | DOCX の番号定義を解析する |
NumberingParser.get_list_info() | ID でリスト情報をクエリする |
NumberingParser.is_ordered_list() | リストレベルが順序付きかどうかを確認する |
StyleParser.parse() | スタイル名を構造化された情報に解析する |
StyleParser.get_style_chain() | 継承されたスタイル名のチェーンを解析する |
NumberingInfo | 番号付け定義データモデル |
NumberingLevel | フォーマットと開始値を持つレベル定義 |