GetTextBlockCharUnicodeFlags
Texto, extracción, diagnóstico, Unicode
Descripción
Devuelve los marcadores de mapeo Unicode y de reserva de un carácter de un bloque de texto del documento seleccionado
Sintaxis
Delphi
Function TPDFlib.GetTextBlockCharUnicodeFlags(TextBlockListID, Index, CharIndex: Integer): Integer;Parámetros
| TextBlockListID | Manejador devuelto por ExtractPageTextBlocks |
|---|---|
| Index | Índice de bloque de texto basado en uno |
| CharIndex | Posición de unidad de código UTF-16 basada en uno dentro del texto del bloque |
Valores devueltos
| -1 | El manejador, el índice de bloque o el índice de carácter no es válido |
|---|---|
| 0 o marcadores | No se aplica ningún mapeo de glifo de origen o el resultado contiene uno o más marcadores de diagnóstico Unicode |
Marcadores
PDF_TEXT_CHAR_UNICODE_EXPLICIT | El carácter se produjo mediante un mapeo ToUnicode explícito y válido |
|---|---|
PDF_TEXT_CHAR_UNICODE_FALLBACK | El carácter se produjo mediante una reserva de codificación de fuente, de glifo, de CID o de código bruto |
PDF_TEXT_CHAR_UNICODE_MISSING_TOUNICODE | La fuente no tiene entrada ToUnicode |
PDF_TEXT_CHAR_UNICODE_UNMAPPED | Un CMap ToUnicode válido no tiene mapeo para el código de origen |
PDF_TEXT_CHAR_UNICODE_INVALID | El CMap ToUnicode no es utilizable o el mapeo seleccionado no es UTF-16 válido |
PDF_TEXT_CHAR_UNICODE_REPLACEMENT | El texto devuelto contiene U+FFFD porque no había ninguna reserva utilizable |
Observaciones
Use pruebas de bits porque un resultado de reserva también lleva el motivo missing, unmapped o invalid
Los indicadores se retienen durante la extracción y se consultan en tiempo constante sin volver a analizar el contenido de la página
Un escalar Unicode suplementario ocupa dos posiciones UTF-16 y ambas posiciones llevan los mismos indicadores