PDF Parsėlis
PDFParsė
PDFParser Skaityti ir interpretuoti žalia PDF byto srauto, sukurti COS objektų grafikas dokumentui. tai yra esamo PDF parsisiųsti įėjimo taškas bito šaltinis į navigacijos objektą modelį.
PDFLexer
PDFLexer tokenizuoja PDF sintezę iš byto srauto, identifikuojant raktinius žodžius, vardai, juostelės, skaičiai ir kiti žodiniai elementai. tai pagrindinis skeneris Naudojamas pagal PDFParser.
PDF autorius
PDFWriter serializuoja COS objektą atgal į PDF byto srautą. kryžminio referencinio lentelės gamyba ir inkrementalios atnaujinimo logika.
Naudojant Parser API
Į The Document klasės statybininkas kreipiasi į parserį viduje, kai pateikiamas failas kelias arba srautas. tiesioginiam parsero prieigai, naudojant Document.getParser() Norėdami gauti PDFParser Įrašas, susijęs su įkrauta dokumentais:
try (Document doc = new Document("input.pdf")) {
PDFParser parser = doc.getParser();
// Access low-level document structure
}