GetTextBlockCharUnicodeFlags

Tekst, wyodrębnianie, diagnostyka, Unicode

Opis

Zwraca flagi mapowania Unicode i rozwiązań zapasowych dla jednego znaku w bloku tekstu wybranego dokumentu

Składnia

Delphi

Function TPDFlib.GetTextBlockCharUnicodeFlags(TextBlockListID, Index, CharIndex: Integer): Integer;

Parametry

TextBlockListIDUchwyt zwrócony przez ExtractPageTextBlocks
IndexIndeks bloku tekstu liczony od 1
CharIndexPozycja jednostki kodu UTF-16 licząca od 1 wewnątrz tekstu bloku

Wartości zwracane

-1Uchwyt, indeks bloku lub indeks znaku jest nieprawidłowy
0 lub flagiNie stosuje się mapowania glifu źródłowego albo wynik zawiera jedną lub więcej flag diagnostycznych Unicode

Flagi

PDF_TEXT_CHAR_UNICODE_EXPLICITZnak powstał z jawnego, prawidłowego mapowania ToUnicode
PDF_TEXT_CHAR_UNICODE_FALLBACKZnak powstał z rozwiązania zapasowego: kodowania czcionki, glifu, CID lub surowego kodu
PDF_TEXT_CHAR_UNICODE_MISSING_TOUNICODECzcionka nie ma wpisu ToUnicode
PDF_TEXT_CHAR_UNICODE_UNMAPPEDPrawidłowa mapa CMap ToUnicode nie ma mapowania dla kodu źródłowego
PDF_TEXT_CHAR_UNICODE_INVALIDMapa CMap ToUnicode jest bezużyteczna albo wybrane mapowanie jest nieprawidłowym UTF-16
PDF_TEXT_CHAR_UNICODE_REPLACEMENTZwrócony tekst zawiera U+FFFD, ponieważ nie było dostępnego użytecznego rozwiązania zapasowego

Uwagi

Używaj testów bitowych, bo wynik awaryjny też niesie przyczynę missing, unmapped lub invalid

Flagi są zatrzymywane podczas ekstrakcji i odpytywane w stałym czasie bez ponownego parsowania treści strony

Skalar Unicode uzupełniający zajmuje dwie pozycje UTF-16 i obie pozycje niosą te same flagi