PDF Parser för

PDFParser

PDFParser läser och tolkar den rå PDF byteströmmen, konstruerar COS objektgrafik för dokumentet. Det är inresepunkten för att parsa en befintlig PDF byte källor till en navigabel objektmodell.

PDFLexer

PDFLexer tokeniserar PDF-syntaxen från en byteström, identifierar nyckelord, namn, strängar, siffror och andra lexiska element. Det är den underliggande skannern Används av PDFParser.

PDFförfattare

PDFWriter serialiserar COS-objektmodellen tillbaka till en PDF byteström. Det hanterar Cross-reference tabell generation och incremental uppdatering logik.

Använd Parser API

Den Document klassbyggaren inbjuder parserna internalt när en fil ges väg eller ström. för direkt parseråtkomst, användning Document.getParser() För att få den PDFParser fall som är förknippade med det laddade dokumentet:

try (Document doc = new Document("input.pdf")) {
    PDFParser parser = doc.getParser();
    // Access low-level document structure
}

See Also

 Svenska