Normalización que preserva la sintaxis de una secuencia lógica de contenido de página PDF y detección robusta de límites de imágenes en línea
NormalizePdfContentSequence une los flujos de contenido suministrados en el orden de la matriz y tokeniza el resultado como una única secuencia lógica de contenido de página
Preserva cadenas literales, cadenas hexadecimales, nombres, matrices, diccionarios, cargas de imágenes en línea y operadores desconocidos mientras canoniza la separación de tokens; los comentarios pueden eliminarse y puede exigirse el equilibrio estructural
CollectPdfContentResourceUses registra los nombres de recursos consumidos por los operadores de texto, XObject, estado de gráficos, espacio de color, patrón, sombreado, propiedad de contenido marcado e imagen en línea bajo el presupuesto central de tokens
FindInlineImageBlock localiza un bloque BI, ID y EI completo sin tratar una secuencia de bytes EI dentro de los datos de la carga de la imagen como el terminador
| Función | Descripción |
TPdfContentNormalizeOptions.Default | Habilita la eliminación de comentarios, la validación de equilibrio, la compresión Flate beneficiosa y el salto de páginas no seguras; no permite reescrituras firmadas y aplica los tres límites predeterminados |
NormalizePdfContentSequence | Devuelve los bytes normalizados y un informe detallado, o False con un estado de fallo y texto de diagnóstico |
CollectPdfContentResourceUses | Devuelve la clase de recurso y el nombre PDF decodificado de cada operador de contenido que consume recursos, o False con texto de diagnóstico para entradas malformadas o fuera de presupuesto |
FindInlineImageBlock | Devuelve los desplazamientos del siguiente bloque de imagen en línea completo en o después de StartPos |
| Tipo | Descripción |
TPdfContentNormalizeStatus | Categoría de resultado o de fallo para la normalización de secuencias y documentos |
TPdfContentNormalizeOptions | Política de normalización y límites de bytes y tokens por página |
TPdfContentNormalizeReport | Estado, totales de bytes y páginas, métricas de flujos y tokens, observaciones de sintaxis y texto de diagnóstico |
TPdfContentResourceKind | Valores de recurso pcrkFont, pcrkXObject, pcrkExtGState, pcrkColorSpace, pcrkPattern, pcrkShading y pcrkProperties |
TPdfContentResourceUse | Un Name de recurso decodificado junto con su Kind |
TPdfContentResourceUses | Matriz dinámica de usos de recursos recopilados en orden de contenido |
| Valor | Significado |
pcnsNotStarted | El informe se ha inicializado pero la normalización no se ha completado |
pcnsCompleted | La normalización se completó con éxito |
pcnsInputLimitExceeded | La entrada lógica excedió MaxInputBytesPerPage o un límite configurado no era positivo |
pcnsOutputLimitExceeded | Los bytes normalizados excederían MaxOutputBytesPerPage |
pcnsTokenLimitExceeded | La secuencia de contenido excedió MaxTokensPerPage |
pcnsMalformedToken | No se pudo leer por completo un token de contenido PDF |
pcnsUnresolvedInlineImage | No se pudo encontrar un límite completo de la carga de una imagen en línea |
pcnsUnbalancedState | Falló el equilibrio exigido de ámbitos de gráficos, texto, contenido marcado, compatibilidad, matrices o diccionarios |
pcnsUnsupportedFilter | La normalización a nivel de documento encontró un filtro de flujo de contenido que no puede decodificar |
pcnsEncryptedDocument | La normalización a nivel de documento rechazó una entrada cifrada |
pcnsSignedDocument | La normalización a nivel de documento rechazó una entrada firmada sin autorización |
pcnsDocumentRewriteFailed | La reescritura o verificación del grafo de objetos PDF que envuelve falló |
pcnsResourceBudgetExceeded | Se alcanzó el plazo del TPdfParserResourceBudget de todo el proceso antes de completar la normalización |
| Campo | Descripción |
RemoveComments | Omite los comentarios PDF conservando los límites de tokens requeridos |
RequireBalancedState | Exige ámbitos equilibrados de q/Q, BT/ET, contenido marcado, compatibilidad, matrices y diccionarios |
CompressOutput | Permite que el envoltorio a nivel de documento comprima con Flate un flujo de página normalizado cuando la compresión reduce su tamaño |
SkipUnsafePages | Permite que la normalización a nivel de documento preserve una página sin cambios tras un resultado no seguro o no admitido, en lugar de abortar la reescritura del documento |
AllowSignedDocument | Permite explícitamente una reescritura completa de la entrada firmada, lo que invalida los rangos de bytes de firma existentes |
MaxInputBytesPerPage | Máximo total de bytes a través de los flujos de contenido suministrados para una página |
MaxOutputBytesPerPage | Máximo de bytes permitido en la secuencia de contenido normalizada |
MaxTokensPerPage | Número máximo de tokens inspeccionados para una página |
| Campo | Descripción |
Status | TPdfContentNormalizeStatus actual |
SourceByteCount | Total de bytes de contenido de origen |
OutputByteCount | Total de bytes de salida normalizados o reescritos |
PageCount | Páginas inspeccionadas por la normalización a nivel de documento |
NormalizedPageCount | Páginas reemplazadas con éxito por contenido normalizado |
SkippedPageCount | Páginas no seguras preservadas sin cambios bajo la política de salto |
InputStreamCount | Flujos de contenido de origen unidos en secuencias lógicas de página |
OutputStreamCount | Flujos de contenido normalizados producidos |
CoalescedArrayCount | Matrices /Contents de múltiples flujos reemplazadas por un único flujo normalizado |
TokenCount | Tokens procesados |
CommentCount | Comentarios encontrados, tanto retenidos como eliminados |
InlineImageCount | Bloques de imágenes en línea completos preservados |
UnknownOperatorCount | Operadores no reconocidos preservados textualmente |
ErrorMessage | Texto de diagnóstico del primer fallo |