OCRPageEx

OCR, renderización, edición de documentos

Descripción

Comprueba la directiva de texto existente, renderiza una página a PNG cuando hace falta, invoca el proveedor de OCR seleccionado y aplica el resultado como una capa de texto invisible propia

Sintaxis

Delphi

Function TPDFlib.OCRPageEx(Page: Integer; DPI: Double; Const Language,
  FontName: WideString; MinConfidence: Double; Options: Integer): Integer;

ActiveX

Function PDFlib::OCRPageEx(Page As Long, DPI As Double, Language As String,
  FontName As String, MinConfidence As Double, Options As Long) As Long

DLL

int DLOCRPageEx(int InstanceID, int Page, double DPI, const wchar_t* Language,
  const wchar_t* FontName, double MinConfidence, int Options);
int DLOCRPageExA(int InstanceID, int Page, double DPI, const char* Language,
  const char* FontName, double MinConfidence, int Options);

Parámetros

PageLa página de destino basada en uno
DPILa resolución ráster finita y positiva suministrada al proveedor
LanguageUna indicación de idioma definida por el proveedor; el proveedor de Tesseract configurado utiliza nombres de datos entrenados como eng
FontNameUna fuente TrueType incrustable o una cadena vacía para seleccionar una fuente de sustitución
MinConfidenceEl umbral inclusivo de confianza de palabra de 0 a 1
OptionsLas directivas de capa bit a bit definidas por ApplyOCRTextLayerEx; cero añade, 1 omite el texto existente ajeno a la biblioteca y 2 reemplaza las capas de OCR propias

Valores devueltos

1Se aplicó el resultado, la página se omitió o ninguna palabra alcanzó el umbral
0La renderización, la ejecución del proveedor, la validación del resultado, la escritura de la capa o la cancelación impidieron completar la operación

Observaciones

Utilice ConfigureTesseractOCR para el adaptador del motor suministrado o asigne una devolución de llamada OnOCRPage propiedad de la aplicación

La comprobación de texto existente se ejecuta antes de la renderización y de la ejecución del proveedor, de modo que una página omitida no necesita un motor de OCR

Solo los flujos de OCR propios anteriores ignora esa comprobación; una capa de texto invisible externa o texto oculto en un Form XObject invocado también cuenta como texto existente

Active la detección de orientación explícitamente para los escaneos que necesiten una corrección verificada de cuarto de vuelta; una confianza de orientación baja falla sin cambiar la capa de OCR

Lea GetOCRDiagnosticsJSON para conocer la acción sobre la capa y los últimos informes de reconocimiento y orientación del motor configurado

Véase también

OCRPage, OCRDocumentEx, ApplyOCRTextLayerEx, ConfigureTesseractOCR, LastOCRError