Reconnaissance OCR et codes-barres intégrés
Les surcharges sans moteur de ApplyLoadedOCRTextLayer et DecodeLoadedPageBarcodes utilisent les modules de reconnaissance intégrés et bornés de HotPDF
Portée de l'OCR
Le backend OCR intégré reconnaît les lettres et chiffres ASCII imprimés par machine, y compris en casse mixte, grâce à une binarisation d'Otsu avec repli sur fenêtre locale, à une extraction des glyphes par composantes connexes et à un appariement borné de modèles en niveaux de gris contre des modèles de glyphes multi-polices mis en cache
Des modèles réguliers, gras, italiques et gras italiques couvrent Arial, Times New Roman, Courier New, Tahoma et Segoe UI sans installation OCR externe
Le module de reconnaissance normalise le texte clair sur un fond majoritairement sombre et accepte le texte délavé lorsque la plage de niveaux de gris atteint au moins 16 niveaux sur 255, tout en préservant le bitmap de l'appelant et les coordonnées de ses mots
Le regroupement des hauteurs au niveau de la ligne et la préférence accordée au contexte de casse séparent les formes majuscules et minuscules, les points du i et du j sont fusionnés avec leur fût, le bruit de speckle en dessous d'une aire de composante minimale est ignoré, et les espaces entre les mots sont détectés par un regroupement bimodal des écarts
Les mots reconnus indiquent les lignes de base et les hauteurs de capitales par ligne, ce qui permet à ApplyLoadedOCRTextLayer de placer le texte interrogeable avec précision
Les scènes naturelles, les polices non prises en charge, le texte très petit et les formes ambiguës ne renvoient toujours aucun mot deviné, et tout mot contenant un glyphe retenu non reconnu est omis en entier plutôt que de perdre des caractères en silence
Les fonds uniformes et les images dont la plage de niveaux de gris est inférieure à 16 niveaux ne renvoient aucun résultat ; la sélection automatique de la polarité suppose que le fond occupe la majeure partie de la page
Une image valide sans aucun mot reconnu se termine avec succès par un tableau de résultats vide, y compris les pages blanches, à faible contraste ou avec du texte non pris en charge ; les lots de documents scannés passent aux pages suivantes, tandis que les demandes invalides, l'annulation et les limites épuisées échouent toujours
Le FPC Windows lit les bitmaps d'entrée de 24 bits et de 32 bits sans changer leur format de pixel ni rejeter les pixels d'origine
Portée des codes-barres
Le backend linéaire intégré décode Code 39, Code 128 jeux A/B/C avec les contrôles SHIFT et FNC, EAN-8, EAN-13, UPC-A et UPC-E avec leurs sommes de contrôle requises
Les QR Code des versions 1 à 40 prennent en charge les orientations par quarts de tour et miroir, l'échantillonnage en perspective basé sur les motifs de repère, la récupération du format BCH et la correction Reed-Solomon des codewords endommagés dans la limite de la capacité de chaque bloc
Data Matrix ECC 200 prend en charge les tailles carrées de 10 à 144 modules, les six tailles rectangulaires standard, plusieurs régions et blocs, et les charges utiles ASCII, C40, Text, X12, EDIFACT et Base256
PDF417 prend en charge la compaction texte, numérique et byte avec la correction Reed-Solomon GF(929) aux niveaux de correction d'erreur 0 à 8
Les charges utiles byte conservent leurs octets bruts et respectent les jeux de caractères ECI pris en charge, dont UTF-8 ; les valeurs ECI non prises en charge échouent explicitement
Chaque analyse d'image intégrée rapporte un seul symbole reconnu ; utilisez le pipeline page et région ou un décodeur applicatif lorsque plusieurs symboles d'un même raster doivent être détectés
Data Matrix prend en charge l'échantillonnage en perspective roté et trapézoïdal, endommagements corrigeables des modules de données compris ; le DMRE reste hors du décodeur, et la récupération PDF417 exige que les motifs de localisation de chaque ligne restent reconnaissables
Un endommagement qui détruit la géométrie des localisateurs ou dépasse la capacité de correction ne renvoie aucun résultat, et des symboles qui se touchent ou se chevauchent peuvent empêcher la localisation indépendante
Budgets et atomicité
La reconnaissance est limitée aux images de 4096 par 4096 et à 4 194 304 pixels, avec des limites fixes de temps, de résultats, de texte et d'octets bruts
L'OCR intégré vérifie son échéance de deux secondes et son jeton d'annulation pendant la conversion des pixels, la binarisation, l'extraction des composantes connexes, la normalisation des glyphes et l'analyse des lignes ; un plafond de 8 192 composantes borne l'analyse du bruit dense
L'annulation se propage dans les pipelines OCR et codes-barres existants, qui ne publient les résultats qu'une fois la demande complète réussie