Normalizacija enega logičnega zaporedja vsebine strani PDF, ki ohranja sintakso, in robustno zaznavanje meja vgrajenih slik
NormalizePdfContentSequence združi podane tokove vsebine v vrstnem redu polja in rezultat tokenizira kot eno logično zaporedje vsebine strani
Ohranja dobesedne nize, šestnajstiške nize, imena, polja, slovarje, vsebino vgrajenih slik in neznane operaterje, pri čemer kanonizira ločevanje žetonov; komentarje je mogoče odstraniti, strukturno ravnovesje pa zahtevati
CollectPdfContentResourceUses zabeleži imena virov, ki jih porabijo operaterji besedila, XObject, stanja grafike, barvnega prostora, vzorca, senčenja, lastnosti označene vsebine in vgrajenih slik, pod osrednjim žetonskim proračunom
FindInlineImageBlock poišče popoln blok BI, ID in EI, ne da bi zaporedje bajtov EI znotraj podatkov vsebine slike obravnaval kot zaključevalnik
| Function | Description |
TPdfContentNormalizeOptions.Default | Omogoči odstranjevanje komentarjev, preverjanje ravnovesja, koristno stiskanje Flate in preskočenje nevarnih strani; prepove podpisane prepise in uveljavi tri privzete omejitve |
NormalizePdfContentSequence | Vrne normalizirane bajte in podrobno poročilo, ali False s stanjem napake in diagnostičnim besedilom |
CollectPdfContentResourceUses | Vrne vrsto vira in dekodirano ime PDF za vsak operater vsebine, ki porablja vire, ali False z diagnostičnim besedilom za napačno oblikovan vhod ali vhod čez proračun |
FindInlineImageBlock | Vrne odmike za naslednji popoln blok vgrajene slike na StartPos ali za njim |
| Type | Description |
TPdfContentNormalizeStatus | Izid ali kategorija napake za normalizacijo zaporedij in dokumentov |
TPdfContentNormalizeOptions | Pravilnik normalizacije ter bajtne in žetonske omejitve na stran |
TPdfContentNormalizeReport | Stanje, skupne bajti in strani, metrike tokov in žetonov, opažanja o sintaksi in diagnostično besedilo |
TPdfContentResourceKind | Vrednosti virov pcrkFont, pcrkXObject, pcrkExtGState, pcrkColorSpace, pcrkPattern, pcrkShading in pcrkProperties |
TPdfContentResourceUse | Dekodirano ime vira Name skupaj z njegovo vrsto Kind |
TPdfContentResourceUses | Dinamično polje zbranih rab virov v vrstnem redu vsebine |
| Value | Meaning |
pcnsNotStarted | Poročilo je bilo inicializirano, normalizacija pa se ni zaključila |
pcnsCompleted | Normalizacija se je uspešno zaključila |
pcnsInputLimitExceeded | Logični vhod je presegel MaxInputBytesPerPage ali pa nastavljena omejitev ni bila pozitivna |
pcnsOutputLimitExceeded | Normalizirani bajti bi presegli MaxOutputBytesPerPage |
pcnsTokenLimitExceeded | Zaporedje vsebine je preseglo MaxTokensPerPage |
pcnsMalformedToken | Žetona vsebine PDF ni bilo mogoče popolnoma prebrati |
pcnsUnresolvedInlineImage | Popolne meje vsebine vgrajene slike ni bilo mogoče najti |
pcnsUnbalancedState | Zahtevano ravnovesje obsegov grafike, besedila, označene vsebine, združljivosti, polj ali slovarjev ni uspelo |
pcnsUnsupportedFilter | Normalizacija na ravni dokumenta je naletela na filter toka vsebine, ki ga ne zna dekodirati |
pcnsEncryptedDocument | Normalizacija na ravni dokumenta je odklonila šifriran vhod |
pcnsSignedDocument | Normalizacija na ravni dokumenta je brez overitve odklonila podpisan vhod |
pcnsDocumentRewriteFailed | Obdajajoči prepis grafa objektov PDF ali njegovo preverjanje ni uspelo |
pcnsResourceBudgetExceeded | Rok proračuna TPdfParserResourceBudget na ravni procesa je potekel, preden se je normalizacija zaključila |
| Field | Description |
RemoveComments | Izpusti komentarje PDF, pri čemer ohrani zahtevane meje žetonov |
RequireBalancedState | Zahteva uravnotežene obsege q/Q, BT/ET, označene vsebine, združljivosti, polj in slovarjev |
CompressOutput | Dovoli ovojnici na ravni dokumenta, da normaliziran tok strani stisne s Flate, kadar stiskanje zmanjša njegovo velikost |
SkipUnsafePages | Dovoli normalizaciji na ravni dokumenta, da po nevarnem ali nepodprtem rezultatu stran ohrani nespremenjeno, namesto da bi preklicala prepis dokumenta |
AllowSignedDocument | Izrecno dovoli poln prepis podpisanega vhoda, kar razveljavi obstoječe bajtne obsege podpisov |
MaxInputBytesPerPage | Največ skupnih bajtov čez podane tokove vsebine za eno stran |
MaxOutputBytesPerPage | Največ bajtov, dovoljenih v normaliziranem zaporedju vsebine |
MaxTokensPerPage | Največje število žetonov, pregledanih za eno stran |
| Field | Description |
Status | Trenutni TPdfContentNormalizeStatus |
SourceByteCount | Skupni izvorni bajti vsebine |
OutputByteCount | Skupni normalizirani ali prepisani izhodni bajti |
PageCount | Strani, ki jih je pregledala normalizacija na ravni dokumenta |
NormalizedPageCount | Strani, uspešno zamenjane z normalizirano vsebino |
SkippedPageCount | Nevarne strani, ohranjene nespremenjene po pravilniku preskočenja |
InputStreamCount | Izvorni tokovi vsebine, združeni v logična zaporedja strani |
OutputStreamCount | Izdelani normalizirani tokovi vsebine |
CoalescedArrayCount | Večtokovna polja /Contents, zamenjana z enim normaliziranim tokom |
TokenCount | Obdelani žetoni |
CommentCount | Srečani komentarji, ohranjeni ali odstranjeni |
InlineImageCount | Ohranjeni popolni bloki vgrajenih slik |
UnknownOperatorCount | Neprepoznani operaterji, ohranjeni dobesedno |
ErrorMessage | Diagnostično besedilo prve napake |