PDF Parsėlis

PDFParsė

PDFParser Skaityti ir interpretuoti žalia PDF byto srauto, sukurti COS objektų grafikas dokumentui. tai yra esamo PDF parsisiųsti įėjimo taškas bito šaltinis į navigacijos objektą modelį.

PDFLexer

PDFLexer tokenizuoja PDF sintezę iš byto srauto, identifikuojant raktinius žodžius, vardai, juostelės, skaičiai ir kiti žodiniai elementai. tai pagrindinis skeneris Naudojamas pagal PDFParser.

PDF autorius

PDFWriter serializuoja COS objektą atgal į PDF byto srautą. kryžminio referencinio lentelės gamyba ir inkrementalios atnaujinimo logika.

Naudojant Parser API

Į The Document klasės statybininkas kreipiasi į parserį viduje, kai pateikiamas failas kelias arba srautas. tiesioginiam parsero prieigai, naudojant Document.getParser() Norėdami gauti PDFParser Įrašas, susijęs su įkrauta dokumentais:

try (Document doc = new Document("input.pdf")) {
    PDFParser parser = doc.getParser();
    // Access low-level document structure
}

Žr. taip pat

 Lietuvių