SearchTextBatch

テキスト, 抽出

説明

要求された各ページのテキストブロックが常駐している間に複数のテキストクエリを検索し、クエリごとに 1 回の抽出パスを行うことを回避します

一致項目はページ、テキストブロック、クエリ配列の順に出力されます

構文

Function TPDFlib.SearchTextBatch(Const Queries: Array Of TPDFlibSearchQuery; Const PageRange: WideString; Var Hits: Array Of TPDFlibSearchBatchHit): Integer;

パラメータ

Queriesゼロから始まる各クエリインデックスのクエリテキストとオプションです。空のクエリテキストは無視されます
PageRangeすべてのページを示す空文字列、または 1 から始まるページ範囲式
Hits呼び出し元が指定する結果バッファー

戻り値

Hits が結果セットより小さい場合でも、クエリとテキストブロックの一致総数を返します

パフォーマンス

各ページはクエリ配列全体に対して 1 回だけ抽出され、大文字小文字を区別しないテキストはブロックごとに 1 回だけ正規化され、ヒットジオメトリは 1 つ以上のクエリに一致するブロックごとに 1 回だけ計算されます

例

SetLength(Queries, 2);
Queries[0].Query := 'invoice';
Queries[0].Options := [soWholeWord];
Queries[1].Query := 'overdue';
Queries[1].Options := [];
SetLength(Hits, 128);
Total := PDF.SearchTextBatch(Queries, '', Hits);

関連項目

SearchTextBatchEach、TPDFlibSearchQuery、TPDFlibSearchBatchHit、SearchText