ExtractFilePageContentToString

Extrakce, Vlastnosti stránky

Popis

Extrahuje nezpracovaný datový proud obsahu zadané stránky z externího souboru PDF a vrátí jej jako řetězec; tato funkce používá backend pro přímý přístup, čímž se vyhne načítání celého dokumentu do paměti, což je ideální pro velké soubory

Syntaxe

Delphi

Function TPDFlib.ExtractFilePageContentToString(Const InputFileName, Password: WideString; Page: Integer): AnsiString;

ActiveX

Function PDFlib::ExtractFilePageContentToString(InputFileName As String, Password As String, Page As Long) As String

DLL

const char * DLExtractFilePageContentToString(int InstanceID, const wchar_t * InputFileName, const wchar_t * Password, int Page);

Parametry

InputFileNameCesta ke zdrojovému souboru PDF
PasswordHeslo pro otevření souboru; pokud soubor není chráněn, předejte prázdný řetězec
PageČíslo stránky, kterou chcete extrahovat (indexováno od 1)

Návratové hodnoty

Empty stringNepodařilo se otevřít soubor, neplatná stránka nebo došlo k chybě extrakce
Content stringNezpracovaný datový proud obsahu PDF dané stránky

Poznámky

Vrácený řetězec obsahuje surové PDF instrukce popisu stránky (například kreslicí operátory a pozicování textu). Chcete-li místo toho extrahovat lidsky čitelný text, použijte ExtractFilePageText

Příklad

var Content: AnsiString;
Content := PDF.ExtractFilePageContentToString('sample.pdf', '', 1);
if Content <> '' then
  // Process the content instructions...

Viz také

ExtractFilePageText, ExtractFilePageTextBlocks