验证策略与 WTPDF
验证策略为现有结构预检引擎添加可执行的文档要求,并保留文本、JSON、HTML 和 CSV 报告格式
内置策略
GetBuiltInValidationPolicy 识别 default、compact、strict、wtpdf-reuse、wtpdf-accessibility、wtpdf-validated-reuse 和 wtpdf-validated-accessibility
WTPDF 策略强制执行 PDF 2.0、结构树、非空文档语言、带 dc:title 的 XMP 元数据、嵌入字体和匹配的 PDF 声明的机器可验证核心要求,而可访问性策略还要求 DisplayDocTitle=true
这些检查是受支持规则的确定性准入门,不能替代完整的语义 WTPDF、PDF/UA-2 或 ISO/TS 32005 验证器
声明元数据
ReadWTPDFMetadata 从 Catalog XMP 提取复用、可访问性和已验证声明状态以及 claimBy、claimDate、claimCredentials 和 claimReport
读取器接受当前注册表 URI 和原始 WTPDF 1.0 示例发出的斜杠形式,但报告当前规范 URI 形式
公开支持类型
THPDFWTPDFConformanceLevel 选择无 WTPDF 声明、复用或可访问性验证,而 THPDFWTPDFMetadata 返回 XMP 中找到的声明和声明详情
THPDFValidationJob 和 THPDFValidationJobs 描述有序的批次输入,THPDFValidationJobStatus、THPDFValidationJobResult 和 THPDFValidationJobResults 返回有序的验证结果
THPDFValidationBatchOptions 控制报告格式、工作线程和队列限制、快速失败行为和取消
THPDFMetadataFixMode 选择检查、增量修复或同步,THPDFMetadataFixResult 报告元数据有效性和更改的属性数量
有界批次执行
RunValidationBatch 以调用方控制的工作线程和队列限制并发验证独立文件,保留源顺序,支持快速失败和取消,并为每个作业记录经过的时间和源感知的错误上下文
非正的工作线程限制选择活动处理器数,非正的队列限制选择每个工作线程四个作业
独立元数据修复
FixPDFMetadata 独立于结构预检修复使用 mfmInspectOnly、mfmAddMissing 或 mfmSynchronize
添加缺失模式保留现有属性并在元数据缺失时创建基本数据包,而同步模式从已加载的 Info 字典重写常见的 Dublin Core、PDF 和 XMP 属性并保留无关的 RDF 描述