Egy logikai PDF oldaltartalom-sorozat szintaxist megőrző normalizálása és robusztus beágyazott képhatár-felismerés
A NormalizePdfContentSequence a megadott tartalomfolyamokat tömbsorrendben fűzi össze, és az eredményt egyetlen logikai oldaltartalom-sorozatként tokenizálja
Megőrzi a literális sztringeket, a hexa sztringeket, a neveket, a tömböket, a szótárakat, a beágyazott képek tartalmát és az ismeretlen operátorokat, miközben kanonizálja a tokenek elválasztását; a megjegyzések eltávolíthatók és a szerkezeti kiegyensúlyozottság megkövetelhető
A CollectPdfContentResourceUses rögzíti a szöveg-, XObject-, grafikaállapot-, színtér-, minta-, árnyaló-, megjelölt-tartalom tulajdonság- és beágyazottkép-operátorok által felhasznált erőforrásneveket a közös tokenkeret alatt
A FindInlineImageBlock egy teljes BI, ID, EI blokkot keres fel anélkül, hogy a képtartalom adatain belüli EI bájtsorozatot lezárónak tekintené
| Function | Description |
TPdfContentNormalizeOptions.Default | Engedi a megjegyzések eltávolítását, a kiegyensúlyozottság ellenőrzését, a hasznos Flate tömörítést és a nem biztonságos oldalak kihagyását; aláírt átírásokat nem enged, és alkalmazza a három alapértelmezett korlátot |
NormalizePdfContentSequence | Normalizált bájtokat és részletes jelentést ad vissza, hiba esetén False értéket hibaállapottal és diagnosztikai szöveggel |
CollectPdfContentResourceUses | Minden erőforrást fogyasztó tartalomoperátorhoz visszaadja az erőforrás fajtáját és a dekódolt PDF-nevet, hibás vagy keretet túllépő bemenetnél pedig False értéket diagnosztikai szöveggel |
FindInlineImageBlock | A StartPos pozíción vagy utána lévő következő teljes beágyazottkép-blokk eltolásait adja vissza |
| Type | Description |
TPdfContentNormalizeStatus | Kimenetel- vagy hibakategória sorozat- és dokumentumszintű normalizáláshoz |
TPdfContentNormalizeOptions | Normalizálási szabályzat és oldalonkénti bájt- és tokenkorlátok |
TPdfContentNormalizeReport | Állapot, bájt- és oldalszám-összesítők, folyam- és tokenmetrikák, szintaxis-megfigyelések és diagnosztikai szöveg |
TPdfContentResourceKind | Erőforrásértékek: pcrkFont, pcrkXObject, pcrkExtGState, pcrkColorSpace, pcrkPattern, pcrkShading és pcrkProperties |
TPdfContentResourceUse | Egy dekódolt erőforrás Name neve a hozzá tartozó Kind fajtával |
TPdfContentResourceUses | A gyűjtött erőforrásfelhasználások dinamikus tömbje tartalom-sorrendben |
| Value | Meaning |
pcnsNotStarted | A jelentés előkészítve, de a normalizálás nem fejeződött be |
pcnsCompleted | A normalizálás sikeresen befejeződött |
pcnsInputLimitExceeded | A logikai bemenet túllépte a MaxInputBytesPerPage értéket, vagy egy beállított korlát nem volt pozitív |
pcnsOutputLimitExceeded | A normalizált bájtok túllépnék a MaxOutputBytesPerPage értéket |
pcnsTokenLimitExceeded | A tartalomsorozat túllépte a MaxTokensPerPage értéket |
pcnsMalformedToken | Egy PDF tartalomtokent nem lehetett teljesen beolvasni |
pcnsUnresolvedInlineImage | Egy teljes beágyazottkép-tartalom határát nem lehetett megtalálni |
pcnsUnbalancedState | A megkövetelt grafikai, szöveg-, megjelölt-tartalom-, kompatibilitási, tömb- vagy szótárhatály kiegyensúlyozottsága nem valósult meg |
pcnsUnsupportedFilter | A dokumentumszintű normalizálás olyan tartalomfolyam-szűrőbe ütközött, amelyet nem tud dekódolni |
pcnsEncryptedDocument | A dokumentumszintű normalizálás elutasította a titkosított bemenetet |
pcnsSignedDocument | A dokumentumszintű normalizálás felhatalmazás nélkül elutasította az aláírt bemenetet |
pcnsDocumentRewriteFailed | A befoglaló PDF objektumgráf-átírás vagy annak ellenőrzése hibázott |
pcnsResourceBudgetExceeded | A folyamat-szintű TPdfParserResourceBudget határidő a normalizálás befejezése előtt lejárt |
| Field | Description |
RemoveComments | Eltávolítja a PDF-megjegyzéseket, miközben megtartja a szükséges tokenhatárokat |
RequireBalancedState | Megköveteli a kiegyensúlyozott q/Q, BT/ET, megjelölt-tartalom, kompatibilitási, tömb- és szótárhatályokat |
CompressOutput | Lehetővé teszi a dokumentumszintű csomagolónak, hogy Flate-tömörítést alkalmazzon egy normalizált oldal folyamán, ha a tömörítés csökkenti a méretét |
SkipUnsafePages | Lehetővé teszi a dokumentumszintű normalizálásnak, hogy nem biztonságos vagy nem támogatott eredmény után egy oldalt változatlanul megőrizzön, ahelyett hogy megszakítaná a dokumentum átírását |
AllowSignedDocument | Explicit módon megengedi az aláírt bemenet teljes átírását, amely érvényteleníti a meglévő aláírásbájt-tartományokat |
MaxInputBytesPerPage | Legfeljebb ennyi bájt lehet összesen az egyik oldal megadott tartalomfolyamaiban |
MaxOutputBytesPerPage | A normalizált tartalomsorozatban megengedett legnagyobb bájtszám |
MaxTokensPerPage | Egy oldalhoz vizsgált tokenek legnagyobb száma |
| Field | Description |
Status | Aktuális TPdfContentNormalizeStatus érték |
SourceByteCount | Összes forrástartalombájt |
OutputByteCount | Összes normalizált vagy átírt kimeneti bájt |
PageCount | A dokumentumszintű normalizálás által vizsgált oldalak |
NormalizedPageCount | Sikeresen normalizált tartalomra cserélt oldalak |
SkippedPageCount | Nem biztonságos oldalak, amelyeket a kihagyási szabályzat változatlanul megőrzött |
InputStreamCount | Logikai oldal-sorozatokká fűzött forrástartalomfolyamok |
OutputStreamCount | Előállított normalizált tartalomfolyamok |
CoalescedArrayCount | Többfolyamos /Contents tömbök, amelyeket egyetlen normalizált folyam váltott fel |
TokenCount | Feldolgozott tokenek |
CommentCount | Megtalált megjegyzések, akár megtartva, akár eltávolítva |
InlineImageCount | Megőrzött teljes beágyazottkép-blokkok |
UnknownOperatorCount | Ismeretlen, szó szerint megőrzött operátorok |
ErrorMessage | Az első hiba diagnosztikai szövege |