Тип THPDFOCRTextLayerOptions
Управляет качеством распознавания, поведением выбора страниц, группировкой слоёв, отменой и жёсткими ограничениями по ресурсам
Значения по умолчанию
DPIравно 300, аMinimumConfidence— 0.5SkipPagesWithTextравноTrueReplaceExistingOCRTextLayerравноFalse; установитеTrue, чтобы заново распознать страницы с уже помеченным OCR-слоем HotPDF и атомарно заменить этот слойUseOptionalContentGroupравноFalse, имя —OCR Text Layer, а видимость по умолчанию —TrueMaxPageCountравно 10000, аMaxPixelsPerPage— 100000000MaxTotalPixelsравно 1000000000,MaxWordsPerPage— 100000, аMaxTotalWords— 1000000MaxTextCodeUnitsравно 16777216, аMaxContentBytes— 1073741824CancellationTokenравноnilи в этом случае берётся token операции документа
Вызывайте THPDFOCRTextLayerOptions.Default, прежде чем переопределять отдельные поля
MaxTotalWords ограничивает принятые результаты, включая слова, которые позже будут отброшены за низкий confidence или неверную геометрию; каждый следующий запрос движка получает остаток лимита слов
Когда бюджет слов или UTF-16 исчерпан до следующей подходящей страницы, операция сообщает otlsBudgetExceeded, не отрисовывая эту страницу и не публикуя частичный текст; последняя страница может израсходовать ровно оставшийся бюджет
Замена обходит SkipPagesWithText только на страницах, содержащих помеченный OCR-поток HotPDF; остальные страницы по-прежнему следуют опции skip
Слои, созданные до появления маркера потока, и слои из других инструментов сохраняются; пустой результат распознавания тоже сохраняет существующий слой