Syntaksbevarende normalisering av én logisk PDF-sideinnholdsekvens og robust deteksjon av grensene til innebygde bilder
NormalizePdfContentSequence slår sammen de oppgitte innholdsstrømmene i array-rekkefølge og tokeniserer resultatet som én logisk sideinnholdsekvens
Den bevarer literale strenger, heksstrenger, navn, arrays, ordbøker, nyttelastene til innebygde bilder og ukjente operatorer, mens tokenseparasjonen kanoniseres; kommentarer kan fjernes og strukturell balanse kan kreves
CollectPdfContentResourceUses registrerer ressursnavnene som brukes av tekst-, XObject-, grafikktilstands-, fargeroms-, mønster-, skyggeleggings-, merket-innhold-egenskaps- og innebygd bilde-operatorer under det sentrale tokenbudsjettet
FindInlineImageBlock lokaliserer en komplett BI-, ID- og EI-blokk uten å behandle en EI-bytesekvens inne i bildets nyttelastdata som terminatoren
| Function | Description |
TPdfContentNormalizeOptions.Default | Aktiverer fjerning av kommentarer, balansevalidering, nyttig Flate-komprimering og hopping over utrygge sider; forbyr signerte omskrivinger og anvender de tre standardgrensene |
NormalizePdfContentSequence | Returnerer normaliserte bytes og en detaljert rapport, eller False med feilstatus og diagnostisk tekst |
CollectPdfContentResourceUses | Returnerer ressurskinden og det dekodede PDF-navnet for hver ressursbrukende innholdsoperator, eller False med diagnostisk tekst for feilformet eller over budsjett inndata |
FindInlineImageBlock | Returnerer offsettene til neste komplette blokk med innebygd bilde på eller etter StartPos |
| Type | Description |
TPdfContentNormalizeStatus | Utfalls- eller feilkategori for sekvens- og dokumentnormalisering |
TPdfContentNormalizeOptions | Normaliseringspolicy og byte- og tokengrenser per side |
TPdfContentNormalizeReport | Status, byte- og sidetotaler, strøm- og tokenmålinger, syntaksobservasjoner og diagnostisk tekst |
TPdfContentResourceKind | Ressursverdier pcrkFont, pcrkXObject, pcrkExtGState, pcrkColorSpace, pcrkPattern, pcrkShading og pcrkProperties |
TPdfContentResourceUse | Ett dekodet ressurs-Name sammen med dets Kind |
TPdfContentResourceUses | Dynamisk array av innsamlede ressursbruk i innholdsrekkefølge |
| Value | Meaning |
pcnsNotStarted | Rapporten er initialisert, men normaliseringen er ikke fullført |
pcnsCompleted | Normaliseringen fullførte med suksess |
pcnsInputLimitExceeded | Det logiske inndataet overskred MaxInputBytesPerPage, eller en konfigurert grense var ikke positiv |
pcnsOutputLimitExceeded | De normaliserte bytene ville overskride MaxOutputBytesPerPage |
pcnsTokenLimitExceeded | Innholdsekvensen overskred MaxTokensPerPage |
pcnsMalformedToken | Et PDF-innholdstoken kunne ikke leses fullstendig |
pcnsUnresolvedInlineImage | Grensen til en komplett nyttelast for innebygd bilde kunne ikke finnes |
pcnsUnbalancedState | Påkrevd balanse i grafikk-, tekst-, merket-innhold-, kompatibilitets-, array- eller ordbokomfang feilet |
pcnsUnsupportedFilter | Dokumentnivå-normalisering støtte på et innholdsstrømfilter den ikke kan dekode |
pcnsEncryptedDocument | Dokumentnivå-normalisering nektet kryptert inndata |
pcnsSignedDocument | Dokumentnivå-normalisering nektet signert inndata uten autorisasjon |
pcnsDocumentRewriteFailed | Den omsluttende PDF-objektgraf-omskrivingen eller verifiseringen feilet |
pcnsResourceBudgetExceeded | Fristen til den prosessbrede TPdfParserResourceBudget ble nådd før normaliseringen var fullført |
| Field | Description |
RemoveComments | Utelater PDF-kommentarer mens påkrevde tokengrenser bevares |
RequireBalancedState | Krever balanserte q/Q-, BT/ET-, merket-innhold-, kompatibilitets-, array- og ordbokomfang |
CompressOutput | Tillater at dokumentnivå-wrapperen Flate-komprimerer en normalisert sidestrøm når komprimering reduserer størrelsen |
SkipUnsafePages | Tillater at dokumentnivå-normaliseringen bevarer en side uendret etter et utrygt eller ustøttet resultat, i stedet for å avbryte dokumentomskrivingen |
AllowSignedDocument | Tillater eksplisitt en fullstendig omskriving av signert inndata, noe som ugyldiggjør eksisterende signaturbyteområder |
MaxInputBytesPerPage | Maksimal total mengde bytes på tvers av de oppgitte innholdsstrømmene for én side |
MaxOutputBytesPerPage | Maksimalt antall bytes tillatt i den normaliserte innholdsekvensen |
MaxTokensPerPage | Maksimalt antall tokens som undersøkes for én side |
| Field | Description |
Status | Gjeldende TPdfContentNormalizeStatus |
SourceByteCount | Totalt antall kildeinnholdbytes |
OutputByteCount | Totalt antall normaliserte eller omskrevne utdatabytes |
PageCount | Sider undersøkt av dokumentnivå-normaliseringen |
NormalizedPageCount | Sider som med suksess ble erstattet med normalisert innhold |
SkippedPageCount | Utrygge sider bevart uendret under skip-policyen |
InputStreamCount | Kildeinnholdsstrømmer slått sammen til logiske sidesekvenser |
OutputStreamCount | Normaliserte innholdsstrømmer produsert |
CoalescedArrayCount | Flere-strøm-/Contents-arrays erstattet av én enkelt normalisert strøm |
TokenCount | Tokens behandlet |
CommentCount | Kommentarer påtruffet, enten de er bevart eller fjernet |
InlineImageCount | Komplette blokker med innebygde bilder bevart |
UnknownOperatorCount | Ukjente operatorer bevart ordrett |
ErrorMessage | Diagnostisk tekst for den første feilen |