GetTextBlockCharUnicodeFlags
Texte, extraction, diagnostic, Unicode
Description
Renvoie les indicateurs de mappage Unicode et de repli d'un caractère d'un bloc de texte du document sélectionné
Syntaxe
Delphi
Function TPDFlib.GetTextBlockCharUnicodeFlags(TextBlockListID, Index, CharIndex: Integer): Integer;Paramètres
| TextBlockListID | Handle renvoyé par ExtractPageTextBlocks |
|---|---|
| Index | Index de bloc de texte à base 1 |
| CharIndex | Position à base 1 en unités de code UTF-16 dans le texte du bloc |
Valeurs de retour
| -1 | Le handle, l'index de bloc ou l'index de caractère est invalide |
|---|---|
| 0 ou indicateurs | Aucun mappage de glyphe source ne s'applique ou le résultat contient un ou plusieurs indicateurs de diagnostic Unicode |
Indicateurs
PDF_TEXT_CHAR_UNICODE_EXPLICIT | Le caractère a été produit par un mappage ToUnicode explicite et valide |
|---|---|
PDF_TEXT_CHAR_UNICODE_FALLBACK | Le caractère a été produit par un repli d'encodage de police, de glyphe, de CID ou de code brut |
PDF_TEXT_CHAR_UNICODE_MISSING_TOUNICODE | La police n'a pas d'entrée ToUnicode |
PDF_TEXT_CHAR_UNICODE_UNMAPPED | Un CMap ToUnicode valide n'a pas de mappage pour le code source |
PDF_TEXT_CHAR_UNICODE_INVALID | Le CMap ToUnicode est inutilisable ou le mappage sélectionné est un UTF-16 invalide |
PDF_TEXT_CHAR_UNICODE_REPLACEMENT | Le texte renvoyé contient U+FFFD faute de repli utilisable |
Remarques
Utilisez des tests au niveau des bits car un résultat de repli porte aussi le motif missing, unmapped ou invalid
Les indicateurs sont conservés pendant l'extraction et interrogés en temps constant sans réanalyser le contenu de la page
Un scalaire Unicode supplémentaire occupe deux positions UTF-16 et les deux positions portent les mêmes indicateurs