GetTextBlockCharUnicodeFlags
Tekst, wyodrębnianie, diagnostyka, Unicode
Opis
Zwraca flagi mapowania Unicode i rozwiązań zapasowych dla jednego znaku w bloku tekstu wybranego dokumentu
Składnia
Delphi
Function TPDFlib.GetTextBlockCharUnicodeFlags(TextBlockListID, Index, CharIndex: Integer): Integer;Parametry
| TextBlockListID | Uchwyt zwrócony przez ExtractPageTextBlocks |
|---|---|
| Index | Indeks bloku tekstu liczony od 1 |
| CharIndex | Pozycja jednostki kodu UTF-16 licząca od 1 wewnątrz tekstu bloku |
Wartości zwracane
| -1 | Uchwyt, indeks bloku lub indeks znaku jest nieprawidłowy |
|---|---|
| 0 lub flagi | Nie stosuje się mapowania glifu źródłowego albo wynik zawiera jedną lub więcej flag diagnostycznych Unicode |
Flagi
PDF_TEXT_CHAR_UNICODE_EXPLICIT | Znak powstał z jawnego, prawidłowego mapowania ToUnicode |
|---|---|
PDF_TEXT_CHAR_UNICODE_FALLBACK | Znak powstał z rozwiązania zapasowego: kodowania czcionki, glifu, CID lub surowego kodu |
PDF_TEXT_CHAR_UNICODE_MISSING_TOUNICODE | Czcionka nie ma wpisu ToUnicode |
PDF_TEXT_CHAR_UNICODE_UNMAPPED | Prawidłowa mapa CMap ToUnicode nie ma mapowania dla kodu źródłowego |
PDF_TEXT_CHAR_UNICODE_INVALID | Mapa CMap ToUnicode jest bezużyteczna albo wybrane mapowanie jest nieprawidłowym UTF-16 |
PDF_TEXT_CHAR_UNICODE_REPLACEMENT | Zwrócony tekst zawiera U+FFFD, ponieważ nie było dostępnego użytecznego rozwiązania zapasowego |
Uwagi
Używaj testów bitowych, bo wynik awaryjny też niesie przyczynę missing, unmapped lub invalid
Flagi są zatrzymywane podczas ekstrakcji i odpytywane w stałym czasie bez ponownego parsowania treści strony
Skalar Unicode uzupełniający zajmuje dwie pozycje UTF-16 i obie pozycje niosą te same flagi