Normalisasi satu sequence konten-halaman PDF logis yang mempertahankan sintaks serta deteksi batas inline-image yang andal
NormalizePdfContentSequence menyambung content stream yang diberikan sesuai urutan array dan menokenisasi hasilnya sebagai satu sequence konten-halaman logis
Unit ini mempertahankan literal string, hex string, name, array, kamus, payload inline-image, dan operator yang tidak dikenal sambil mengkanonikalisasi pemisahan token; komentar dapat dihapus dan keseimbangan struktural dapat diwajibkan
CollectPdfContentResourceUses mencatat nama resource yang dikonsumsi operator teks, XObject, graphics-state, colour-space, pattern, shading, properti marked-content, dan inline-image di bawah anggaran token terpusat
FindInlineImageBlock menemukan blok BI, ID, dan EI yang lengkap tanpa menganggap urutan byte EI di dalam data payload gambar sebagai terminator
| Function | Description |
TPdfContentNormalizeOptions.Default | Mengaktifkan penghapusan komentar, validasi keseimbangan, kompresi Flate yang menguntungkan, dan melewati halaman yang tidak aman; melarang penulisan ulang bertanda tangan dan menerapkan tiga batas bawaan |
NormalizePdfContentSequence | Mengembalikan byte ternormalisasi dan laporan terperinci, atau False dengan status kegagalan dan teks diagnostik |
CollectPdfContentResourceUses | Mengembalikan jenis resource dan name PDF terdekode untuk setiap operator konten yang mengonsumsi resource, atau False dengan teks diagnostik untuk input malformed atau melebihi anggaran |
FindInlineImageBlock | Mengembalikan offset untuk blok inline-image lengkap berikutnya pada atau setelah StartPos |
| Type | Description |
TPdfContentNormalizeStatus | Hasil atau kategori kegagalan untuk normalisasi sequence dan dokumen |
TPdfContentNormalizeOptions | Kebijakan normalisasi serta batas byte dan token per halaman |
TPdfContentNormalizeReport | Status, total byte dan halaman, metrik stream dan token, pengamatan sintaks, dan teks diagnostik |
TPdfContentResourceKind | Nilai resource pcrkFont, pcrkXObject, pcrkExtGState, pcrkColorSpace, pcrkPattern, pcrkShading, dan pcrkProperties |
TPdfContentResourceUse | Satu Name resource terdekode beserta Kind-nya |
TPdfContentResourceUses | Array dinamis penggunaan resource yang terkumpul dalam urutan konten |
| Value | Meaning |
pcnsNotStarted | Laporan telah diinisialisasi tetapi normalisasi belum selesai |
pcnsCompleted | Normalisasi selesai dengan sukses |
pcnsInputLimitExceeded | Input logis melampaui MaxInputBytesPerPage atau batas yang dikonfigurasi tidak positif |
pcnsOutputLimitExceeded | Byte ternormalisasi akan melampaui MaxOutputBytesPerPage |
pcnsTokenLimitExceeded | Sequence konten melampaui MaxTokensPerPage |
pcnsMalformedToken | Satu token konten PDF tidak dapat dibaca secara lengkap |
pcnsUnresolvedInlineImage | Batas payload inline-image yang lengkap tidak dapat ditemukan |
pcnsUnbalancedState | Keseimbangan cakupan graphics, teks, marked-content, kompatibilitas, array, atau kamus yang diwajibkan tidak terpenuhi |
pcnsUnsupportedFilter | Normalisasi tingkat dokumen menemui filter content stream yang tidak dapat didekodenya |
pcnsEncryptedDocument | Normalisasi tingkat dokumen menolak input terenkripsi |
pcnsSignedDocument | Normalisasi tingkat dokumen menolak input bertanda tangan tanpa otorisasi |
pcnsDocumentRewriteFailed | Penulisan ulang atau verifikasi graf objek PDF penampungnya gagal |
pcnsResourceBudgetExceeded | Deadline TPdfParserResourceBudget tingkat proses tercapai sebelum normalisasi selesai |
| Field | Description |
RemoveComments | Menghilangkan komentar PDF sambil mempertahankan batas token yang diperlukan |
RequireBalancedState | Mewajibkan cakupan q/Q, BT/ET, marked-content, kompatibilitas, array, dan kamus yang seimbang |
CompressOutput | Mengizinkan wrapper tingkat dokumen mengompresi Flate stream halaman ternormalisasi ketika kompresi mengurangi ukurannya |
SkipUnsafePages | Mengizinkan normalisasi tingkat dokumen mempertahankan halaman tidak berubah setelah hasil yang tidak aman atau tidak didukung, alih-alih membatalkan penulisan ulang dokumen |
AllowSignedDocument | Eksplisit mengizinkan penulisan ulang penuh input bertanda tangan, yang membatalkan rentang byte tanda tangan yang ada |
MaxInputBytesPerPage | Total byte maksimum lintas content stream yang diberikan untuk satu halaman |
MaxOutputBytesPerPage | Byte maksimum yang diizinkan dalam sequence konten ternormalisasi |
MaxTokensPerPage | Jumlah token maksimum yang diperiksa untuk satu halaman |
| Field | Description |
Status | TPdfContentNormalizeStatus saat ini |
SourceByteCount | Total byte konten sumber |
OutputByteCount | Total byte keluaran ternormalisasi atau tertulis ulang |
PageCount | Halaman yang diperiksa oleh normalisasi tingkat dokumen |
NormalizedPageCount | Halaman yang berhasil diganti dengan konten ternormalisasi |
SkippedPageCount | Halaman tidak aman yang dipertahankan tidak berubah di bawah kebijakan skip |
InputStreamCount | Content stream sumber yang disambung menjadi sequence halaman logis |
OutputStreamCount | Content stream ternormalisasi yang dihasilkan |
CoalescedArrayCount | Array /Contents multi-stream yang diganti satu stream ternormalisasi |
TokenCount | Token yang diproses |
CommentCount | Komentar yang ditemui, baik dipertahankan maupun dihapus |
InlineImageCount | Blok inline-image lengkap yang dipertahankan |
UnknownOperatorCount | Operator tak dikenal yang dipertahankan apa adanya |
ErrorMessage | Teks diagnostik untuk kegagalan pertama |