GetOCRDiagnosticsJSON
OCR, 진단
설명
가장 최근 OCR 단계와 레이어 동작을 설명하는 버전 1 JSON을 반환하고, 가능하면 현재 지정된 인스턴스 소유 엔진의 보고서도 담습니다
구문
Delphi
Function TPDFlib.GetOCRDiagnosticsJSON: WideString;
ActiveX
Function PDFlib::GetOCRDiagnosticsJSON() As String
DLL
const wchar_t* DLGetOCRDiagnosticsJSON(int InstanceID);
const char* DLGetOCRDiagnosticsJSONA(int InstanceID);
반환 값
version, phase, status, complete, errorCode, error를 담은 JSON 객체이며, 해당할 때는 페이지 수와 단어 수도 포함됩니다
레이어 상태
| notStarted | 이 인스턴스에서 시작된 OCR 작업이 없습니다 |
|---|---|
| configured | 엔진 구성이 승인되었습니다. 학습 데이터 모델이 페이지를 인식할 수 있다는 뜻은 아닙니다 |
| skipped | 페이지에 소유 아닌 기존 텍스트가 있으며 reason은 existingText입니다 |
| empty | 임계값을 넘은 단어가 없으며 기존 OCR 레이어는 그대로 유지됩니다 |
| appended | 새 소유 OCR 레이어가 추가되었습니다 |
| replaced | 소유된 이전 OCR 레이어가 하나 이상 교체되었습니다 |
| error | 작업이 실패했으며 오류 필드를 확인하십시오 |
| cancelled | 공급자가 현재 작업을 취소했습니다 |
엔진 보고서
선택적 provider 객체는 최신 status, complete, exitCode, error와 엔진 log를 담습니다
공급자 상태 코드는 0 성공, 1 사용 불가, 2 잘못된 입력, 3 잘못된 출력, 4 실패, 5 시간 초과, 6 출력 한도입니다
선택적 orientation 객체는 orientationDegrees, rotateClockwise, confidence와 자체 완료 및 오류 필드를 포함합니다
방향 상태 코드는 0 성공, 1 사용 불가, 2 잘못된 입력, 3 잘못된 출력, 4 실패, 5 시간 초과, 6 출력 한도, 7 신뢰도 낮음입니다
완료 플래그는 항상 확인하십시오. 새로 구성된 엔진은 기본 숫자 상태가 0이어도 인식을 완료하지 않은 상태입니다
비고
이 보고서는 OCR을 다시 실행하거나 선택된 페이지를 바꾸지 않습니다
구성된 엔진의 보고서는 최신 실행을 설명하므로 이후 페이지가 건너뛰어지면 이전 엔진 보고서가 남을 수 있습니다. 최상위 페이지 동작이 최신 페이지 판단을 알려 줍니다
OCRDocumentEx는 마지막으로 시도한 페이지의 보고서를 남기고, 처리된 페이지 수는 정수 반환 값으로 알려 줍니다
errorCode는 LastErrorCode를 반영합니다. 다른 API 호출이 라이브러리의 마지막 오류 코드를 바꿀 수 있으므로 진단은 OCR 호출 직후에 읽으십시오
DLL 와이드 포인터는 인스턴스의 와이드 반환 버퍼 수명을 따르고, A 변형은 UTF-8을 반환하며 대응되는 ANSI 반환 버퍼 수명을 따릅니다
참고 항목
OCRPageEx, OCRDocumentEx, ConfigureTesseractOCR, LastOCRError