OCRPageEx
OCR, renderización, edición de documentos
Descripción
Comprueba la directiva de texto existente, renderiza una página a PNG cuando hace falta, invoca el proveedor de OCR seleccionado y aplica el resultado como una capa de texto invisible propia
Sintaxis
Delphi
Function TPDFlib.OCRPageEx(Page: Integer; DPI: Double; Const Language,
FontName: WideString; MinConfidence: Double; Options: Integer): Integer;
ActiveX
Function PDFlib::OCRPageEx(Page As Long, DPI As Double, Language As String,
FontName As String, MinConfidence As Double, Options As Long) As Long
DLL
int DLOCRPageEx(int InstanceID, int Page, double DPI, const wchar_t* Language,
const wchar_t* FontName, double MinConfidence, int Options);
int DLOCRPageExA(int InstanceID, int Page, double DPI, const char* Language,
const char* FontName, double MinConfidence, int Options);
Parámetros
| Page | La página de destino basada en uno |
|---|---|
| DPI | La resolución ráster finita y positiva suministrada al proveedor |
| Language | Una indicación de idioma definida por el proveedor; el proveedor de Tesseract configurado utiliza nombres de datos entrenados como eng |
| FontName | Una fuente TrueType incrustable o una cadena vacía para seleccionar una fuente de sustitución |
| MinConfidence | El umbral inclusivo de confianza de palabra de 0 a 1 |
| Options | Las directivas de capa bit a bit definidas por ApplyOCRTextLayerEx; cero añade, 1 omite el texto existente ajeno a la biblioteca y 2 reemplaza las capas de OCR propias |
Valores devueltos
| 1 | Se aplicó el resultado, la página se omitió o ninguna palabra alcanzó el umbral |
|---|---|
| 0 | La renderización, la ejecución del proveedor, la validación del resultado, la escritura de la capa o la cancelación impidieron completar la operación |
Observaciones
Utilice ConfigureTesseractOCR para el adaptador del motor suministrado o asigne una devolución de llamada OnOCRPage propiedad de la aplicación
La comprobación de texto existente se ejecuta antes de la renderización y de la ejecución del proveedor, de modo que una página omitida no necesita un motor de OCR
Solo los flujos de OCR propios anteriores ignora esa comprobación; una capa de texto invisible externa o texto oculto en un Form XObject invocado también cuenta como texto existente
Active la detección de orientación explícitamente para los escaneos que necesiten una corrección verificada de cuarto de vuelta; una confianza de orientación baja falla sin cambiar la capa de OCR
Lea GetOCRDiagnosticsJSON para conocer la acción sobre la capa y los últimos informes de reconocimiento y orientación del motor configurado
Véase también
OCRPage, OCRDocumentEx, ApplyOCRTextLayerEx, ConfigureTesseractOCR, LastOCRError