ExtractFilePageContentToString
Extrakce, Vlastnosti stránky
Popis
Extrahuje nezpracovaný datový proud obsahu zadané stránky z externího souboru PDF a vrátí jej jako řetězec; tato funkce používá backend pro přímý přístup, čímž se vyhne načítání celého dokumentu do paměti, což je ideální pro velké soubory
Syntaxe
Delphi
Function TPDFlib.ExtractFilePageContentToString(Const InputFileName, Password: WideString; Page: Integer): AnsiString;ActiveX
Function PDFlib::ExtractFilePageContentToString(InputFileName As String, Password As String, Page As Long) As StringDLL
const char * DLExtractFilePageContentToString(int InstanceID, const wchar_t * InputFileName, const wchar_t * Password, int Page);Parametry
| InputFileName | Cesta ke zdrojovému souboru PDF |
|---|---|
| Password | Heslo pro otevření souboru; pokud soubor není chráněn, předejte prázdný řetězec |
| Page | Číslo stránky, kterou chcete extrahovat (indexováno od 1) |
Návratové hodnoty
| Empty string | Nepodařilo se otevřít soubor, neplatná stránka nebo došlo k chybě extrakce |
|---|---|
| Content string | Nezpracovaný datový proud obsahu PDF dané stránky |
Poznámky
Vrácený řetězec obsahuje surové PDF instrukce popisu stránky (například kreslicí operátory a pozicování textu). Chcete-li místo toho extrahovat lidsky čitelný text, použijte ExtractFilePageText
Příklad
var Content: AnsiString;
Content := PDF.ExtractFilePageContentToString('sample.pdf', '', 1);
if Content <> '' then
// Process the content instructions...