Zachowująca składnię normalizacja jednej logicznej sekwencji treści strony PDF i solidne wykrywanie granic obrazów inline
NormalizePdfContentSequence łączy dostarczone strumienie treści w porządku tablicy i tokenizuje wynik jako jedną logiczną sekwencję treści strony
Zachowuje literały łańcuchowe, łańcuchy szesnastkowe, nazwy, tablice, słowniki, ładunki obrazów inline i nieznane operatory, kanonicznie traktując separatory tokenów; komentarze można usuwać, a zbalansowanie struktury wymuszać
CollectPdfContentResourceUses odnotowuje nazwy zasobów konsumowane przez operatory tekstu, XObject, stanu graficznego, przestrzeni kolorów, wzorca, cieniowania, właściwości treści oznaczonej i obrazów inline w ramach centralnego budżetu tokenów
FindInlineImageBlock lokalizuje kompletny blok BI, ID i EI, nie traktując sekwencji bajtów EI wewnątrz danych ładunku obrazu jako terminatora
| Function | Description |
TPdfContentNormalizeOptions.Default | Włącza usuwanie komentarzy, walidację zbalansowania, korzystną kompresję Flate i pomijanie niebezpiecznych stron; nie zezwala na przepisywanie podpisanych dokumentów i stosuje trzy domyślne limity |
NormalizePdfContentSequence | Zwraca znormalizowane bajty i szczegółowy raport albo False ze statusem niepowodzenia i tekstem diagnostycznym |
CollectPdfContentResourceUses | Zwraca rodzaj zasobu i zdekodowaną nazwę PDF dla każdego operatora treści konsumującego zasób albo False z tekstem diagnostycznym dla danych uszkodzonych lub przekraczających budżet |
FindInlineImageBlock | Zwraca przesunięcia następnego kompletnego bloku obrazu inline pod lub za StartPos |
| Type | Description |
TPdfContentNormalizeStatus | Wynik albo kategoria niepowodzenia dla normalizacji sekwencji i dokumentu |
TPdfContentNormalizeOptions | Polityka normalizacji oraz limity bajtów i tokenów na stronę |
TPdfContentNormalizeReport | Status, sumy bajtów i stron, metryki strumieni i tokenów, obserwacje składni oraz tekst diagnostyczny |
TPdfContentResourceKind | Wartości zasobów pcrkFont, pcrkXObject, pcrkExtGState, pcrkColorSpace, pcrkPattern, pcrkShading i pcrkProperties |
TPdfContentResourceUse | Jedna zdekodowana nazwa zasobu Name razem z jej Kind |
TPdfContentResourceUses | Tablica dynamiczna zebranych użyć zasobów w porządku treści |
| Value | Meaning |
pcnsNotStarted | Raport został zainicjalizowany, ale normalizacja się nie zakończyła |
pcnsCompleted | Normalizacja zakończyła się pomyślnie |
pcnsInputLimitExceeded | Logiczne wejście przekroczyło MaxInputBytesPerPage albo skonfigurowany limit nie był dodatni |
pcnsOutputLimitExceeded | Znormalizowane bajty przekroczyłyby MaxOutputBytesPerPage |
pcnsTokenLimitExceeded | Sekwencja treści przekroczyła MaxTokensPerPage |
pcnsMalformedToken | Token treści PDF nie dał się odczytać w całości |
pcnsUnresolvedInlineImage | Nie udało się znaleźć kompletnej granicy ładunku obrazu inline |
pcnsUnbalancedState | Wymagane zbalansowanie zakresów grafiki, tekstu, treści oznaczonej, kompatybilności, tablic lub słownika nie zostało spełnione |
pcnsUnsupportedFilter | Normalizacja dokumentowa napotkała filtr strumienia treści, którego nie umie zdekodować |
pcnsEncryptedDocument | Normalizacja dokumentowa odmówiła zaszyfrowanego wejścia |
pcnsSignedDocument | Normalizacja dokumentowa odmówiła podpisanego wejścia bez autoryzacji |
pcnsDocumentRewriteFailed | Otoczające przepisanie lub weryfikacja grafu obiektów PDF nie powiodła się |
pcnsResourceBudgetExceeded | Termin ogólnoprocesowego TPdfParserResourceBudget upłynął, zanim normalizacja się zakończyła |
| Field | Description |
RemoveComments | Pomija komentarze PDF, zachowując wymagane separatory tokenów |
RequireBalancedState | Wymaga zbalansowanych zakresów q/Q, BT/ET, treści oznaczonej, kompatybilności, tablic i słowników |
CompressOutput | Zezwala otoczce dokumentowej na kompresję Flate znormalizowanego strumienia strony, gdy kompresja zmniejsza jego rozmiar |
SkipUnsafePages | Zezwala normalizacji dokumentowej zachować stronę bez zmian po niebezpiecznym lub nieobsługiwanym wyniku zamiast przerywać przepisanie dokumentu |
AllowSignedDocument | Jawnie zezwala na pełne przepisanie podpisanego wejścia, co unieważnia istniejące zakresy bajtów podpisów |
MaxInputBytesPerPage | Maksymalna łączna liczba bajtów w dostarczonych strumieniach treści dla jednej strony |
MaxOutputBytesPerPage | Maksymalna liczba bajtów dozwolona w znormalizowanej sekwencji treści |
MaxTokensPerPage | Maksymalna liczba tokenów inspekcjonowanych dla jednej strony |
| Field | Description |
Status | Bieżący TPdfContentNormalizeStatus |
SourceByteCount | Łączna liczba bajtów treści źródłowej |
OutputByteCount | Łączna liczba bajtów wyjścia znormalizowanego lub przepisanego |
PageCount | Strony zinspekcjonowane przez normalizację dokumentową |
NormalizedPageCount | Strony pomyślnie zastąpione znormalizowaną treścią |
SkippedPageCount | Niebezpieczne strony zachowane bez zmian w ramach polityki pomijania |
InputStreamCount | Strumienie treści źródłowej połączone w logiczne sekwencje stron |
OutputStreamCount | Wyprodukowane znormalizowane strumienie treści |
CoalescedArrayCount | Wielostrumieniowe tablice /Contents zastąpione jednym znormalizowanym strumieniem |
TokenCount | Przetworzone tokeny |
CommentCount | Napotkane komentarze, niezależnie od tego, czy zachowane, czy usunięte |
InlineImageCount | Zachowane kompletne bloki obrazów inline |
UnknownOperatorCount | Nierozpoznane operatory zachowane dosłownie |
ErrorMessage | Tekst diagnostyczny pierwszego niepowodzenia |