OCRPageEx
OCR, renderização, edição de documentos
Descrição
Checa a política de texto existente, renderiza uma página para PNG quando necessário, invoca o provider de OCR selecionado e aplica o resultado como uma camada de texto invisível própria
Sintaxe
Delphi
Function TPDFlib.OCRPageEx(Page: Integer; DPI: Double; Const Language,
FontName: WideString; MinConfidence: Double; Options: Integer): Integer;
ActiveX
Function PDFlib::OCRPageEx(Page As Long, DPI As Double, Language As String,
FontName As String, MinConfidence As Double, Options As Long) As Long
DLL
int DLOCRPageEx(int InstanceID, int Page, double DPI, const wchar_t* Language,
const wchar_t* FontName, double MinConfidence, int Options);
int DLOCRPageExA(int InstanceID, int Page, double DPI, const char* Language,
const char* FontName, double MinConfidence, int Options);
Parâmetros
| Page | A página alvo, de base um |
|---|---|
| DPI | A resolução raster positiva finita enviada ao provider |
| Language | Uma dica de idioma definida pelo provider; o provider Tesseract configurado usa nomes de trained data como eng |
| FontName | Uma fonte TrueType incorporável ou uma string vazia para seleção de fallback |
| MinConfidence | O limite inclusivo de confiança de palavra, de 0 a 1 |
| Options | As políticas de camada bit a bit definidas pela ApplyOCRTextLayerEx; zero anexa, 1 pula texto existente não próprio e 2 substitui camadas de OCR próprias |
Valores retornados
| 1 | O resultado foi aplicado, a página foi pulada, ou nenhuma palavra atingiu o limite |
|---|---|
| 0 | Renderização, execução do provider, validação do resultado, gravação da camada ou cancelamento impediram a conclusão |
Observações
Use a ConfigureTesseractOCR para o adaptador de engine fornecido, ou atribua um callback OnOCRPage próprio da aplicação
A checagem de texto existente roda antes da renderização e da execução do provider, então uma página pulada não precisa de um engine de OCR
Somente streams de OCR antigos próprios são ignorados por essa checagem; uma camada de texto invisível de terceiros ou texto escondido em um Form XObject invocado ainda conta como texto existente
Habilite a detecção de orientação explicitamente para scans que precisam de uma correção verificada de um quarto de volta; confiança de orientação baixa falha sem alterar a camada de OCR
Leia a GetOCRDiagnosticsJSON para ver a ação da camada e os relatórios mais recentes de reconhecimento e de orientação do engine configurado
Veja também
OCRPage, OCRDocumentEx, ApplyOCRTextLayerEx, ConfigureTesseractOCR, LastOCRError