Normalizzazione che preserva la sintassi di un'unica sequenza logica di contenuti di pagina PDF e robusto rilevamento dei confini delle immagini inline
NormalizePdfContentSequence concatena gli stream di contenuti forniti in ordine di array e tokenizza il risultato come un'unica sequenza logica di contenuti di pagina
Preserva stringhe letterali, stringhe esadecimali, nomi, array, dizionari, payload di immagini inline e operatori sconosciuti mentre canonizza la separazione dei token; i commenti possono essere rimossi e l'equilibrio strutturale può essere richiesto
CollectPdfContentResourceUses registra i nomi delle risorse consumate dagli operatori di testo, XObject, stato grafico, spazio colore, pattern, shading, proprietà di contenuto marcatore e immagini inline, nel rispetto del budget centrale di token
FindInlineImageBlock individua un blocco completo BI, ID ed EI senza trattare una sequenza di byte EI interna ai dati del payload dell'immagine come terminatore
| Function | Description |
TPdfContentNormalizeOptions.Default | Attiva la rimozione dei commenti, la validazione dell'equilibrio, la compressione Flate quando vantaggiosa e il salto delle pagine non sicure; non consente riscritture di documenti firmati e applica i tre limiti predefiniti |
NormalizePdfContentSequence | Restituisce i byte normalizzati e un report dettagliato, oppure False con uno stato di fallimento e testo diagnostico |
CollectPdfContentResourceUses | Restituisce il tipo di risorsa e il nome PDF decodificato per ogni operatore di contenuto che consuma risorse, oppure False con testo diagnostico per input malformati o oltre budget |
FindInlineImageBlock | Restituisce gli offset del prossimo blocco completo di immagine inline a partire da StartPos inclusa |
| Type | Description |
TPdfContentNormalizeStatus | Esito o categoria di fallimento per la normalizzazione di sequenze e documenti |
TPdfContentNormalizeOptions | Policy di normalizzazione e limiti di byte e token per pagina |
TPdfContentNormalizeReport | Stato, totali di byte e pagine, metriche di stream e token, osservazioni sintattiche e testo diagnostico |
TPdfContentResourceKind | Valori di risorsa pcrkFont, pcrkXObject, pcrkExtGState, pcrkColorSpace, pcrkPattern, pcrkShading e pcrkProperties |
TPdfContentResourceUse | Un Name di risorsa decodificato insieme al suo Kind |
TPdfContentResourceUses | Array dinamico degli usi di risorse raccolti in ordine di contenuto |
| Value | Meaning |
pcnsNotStarted | Il report è stato inizializzato ma la normalizzazione non è stata completata |
pcnsCompleted | La normalizzazione è stata completata con successo |
pcnsInputLimitExceeded | L'input logico ha superato MaxInputBytesPerPage oppure un limite configurato non era positivo |
pcnsOutputLimitExceeded | I byte normalizzati supererebbero MaxOutputBytesPerPage |
pcnsTokenLimitExceeded | La sequenza di contenuti ha superato MaxTokensPerPage |
pcnsMalformedToken | Un token di contenuto PDF non poteva essere letto completamente |
pcnsUnresolvedInlineImage | Non è stato possibile trovare un confine completo del payload di un'immagine inline |
pcnsUnbalancedState | Il bilanciamento richiesto di ambiti grafici, di testo, di contenuto marcatore, di compatibilità, di array o di dizionario è fallito |
pcnsUnsupportedFilter | La normalizzazione a livello di documento ha incontrato un filtro di stream di contenuti che non sa decodificare |
pcnsEncryptedDocument | La normalizzazione a livello di documento ha rifiutato un input crittografato |
pcnsSignedDocument | La normalizzazione a livello di documento ha rifiutato un input firmato senza autorizzazione |
pcnsDocumentRewriteFailed | La riscrittura o la verifica del grafo di oggetti PDF che contiene la sequenza è fallita |
pcnsResourceBudgetExceeded | La scadenza del TPdfParserResourceBudget a livello di processo è stata raggiunta prima che la normalizzazione fosse completata |
| Field | Description |
RemoveComments | Omette i commenti PDF conservando i confini di token necessari |
RequireBalancedState | Richiede l'equilibrio degli ambiti q/Q, BT/ET, di contenuto marcatore, di compatibilità, di array e di dizionario |
CompressOutput | Consente al wrapper a livello di documento di comprimere Flate uno stream di pagina normalizzato quando la compressione ne riduce le dimensioni |
SkipUnsafePages | Consente alla normalizzazione a livello di documento di preservare una pagina invariata dopo un risultato non sicuro o non supportato invece di interrompere la riscrittura del documento |
AllowSignedDocument | Consente esplicitamente una riscrittura completa dell'input firmato, che invalida gli intervalli di byte delle firme esistenti |
MaxInputBytesPerPage | Numero massimo totale di byte attraverso gli stream di contenuti forniti per una pagina |
MaxOutputBytesPerPage | Numero massimo di byte consentito nella sequenza di contenuti normalizzata |
MaxTokensPerPage | Numero massimo di token esaminati per una pagina |
| Field | Description |
Status | TPdfContentNormalizeStatus corrente |
SourceByteCount | Totale dei byte di contenuto sorgente |
OutputByteCount | Totale dei byte di output normalizzati o riscritti |
PageCount | Pagine esaminate dalla normalizzazione a livello di documento |
NormalizedPageCount | Pagine sostituite con successo con contenuti normalizzati |
SkippedPageCount | Pagine non sicure preservate invariate sotto la policy di salto |
InputStreamCount | Stream di contenuti sorgente concatenati in sequenze logiche di pagina |
OutputStreamCount | Stream di contenuti normalizzati prodotti |
CoalescedArrayCount | Array /Contents multi-stream sostituiti da un unico stream normalizzato |
TokenCount | Token elaborati |
CommentCount | Commenti incontrati, siano essi conservati o rimossi |
InlineImageCount | Blocchi completi di immagini inline preservati |
UnknownOperatorCount | Operatori non riconosciuti preservati alla lettera |
ErrorMessage | Testo diagnostico per il primo fallimento |