Reconnaissance OCR et codes-barres intégrés

Les surcharges sans moteur de ApplyLoadedOCRTextLayer et DecodeLoadedPageBarcodes utilisent les modules de reconnaissance intégrés et bornés de HotPDF

Portée de l'OCR

Le backend OCR intégré reconnaît les lettres et chiffres ASCII imprimés par machine, y compris en casse mixte, grâce à une binarisation d'Otsu avec repli sur fenêtre locale, à une extraction des glyphes par composantes connexes et à un appariement borné de modèles en niveaux de gris contre des modèles de glyphes multi-polices mis en cache

Des modèles réguliers, gras, italiques et gras italiques couvrent Arial, Times New Roman, Courier New, Tahoma et Segoe UI sans installation OCR externe

Le module de reconnaissance normalise le texte clair sur un fond majoritairement sombre et accepte le texte délavé lorsque la plage de niveaux de gris atteint au moins 16 niveaux sur 255, tout en préservant le bitmap de l'appelant et les coordonnées de ses mots

Le regroupement des hauteurs au niveau de la ligne et la préférence accordée au contexte de casse séparent les formes majuscules et minuscules, les points du i et du j sont fusionnés avec leur fût, le bruit de speckle en dessous d'une aire de composante minimale est ignoré, et les espaces entre les mots sont détectés par un regroupement bimodal des écarts

Les mots reconnus indiquent les lignes de base et les hauteurs de capitales par ligne, ce qui permet à ApplyLoadedOCRTextLayer de placer le texte interrogeable avec précision

Les scènes naturelles, les polices non prises en charge, le texte très petit et les formes ambiguës ne renvoient toujours aucun mot deviné, et tout mot contenant un glyphe retenu non reconnu est omis en entier plutôt que de perdre des caractères en silence

Les fonds uniformes et les images dont la plage de niveaux de gris est inférieure à 16 niveaux ne renvoient aucun résultat ; la sélection automatique de la polarité suppose que le fond occupe la majeure partie de la page

Une image valide sans aucun mot reconnu se termine avec succès par un tableau de résultats vide, y compris les pages blanches, à faible contraste ou avec du texte non pris en charge ; les lots de documents scannés passent aux pages suivantes, tandis que les demandes invalides, l'annulation et les limites épuisées échouent toujours

Le FPC Windows lit les bitmaps d'entrée de 24 bits et de 32 bits sans changer leur format de pixel ni rejeter les pixels d'origine

Portée des codes-barres

Le backend linéaire intégré décode Code 39, Code 128 jeux A/B/C avec les contrôles SHIFT et FNC, EAN-8, EAN-13, UPC-A et UPC-E avec leurs sommes de contrôle requises

Les QR Code des versions 1 à 40 prennent en charge les orientations par quarts de tour et miroir, l'échantillonnage en perspective basé sur les motifs de repère, la récupération du format BCH et la correction Reed-Solomon des codewords endommagés dans la limite de la capacité de chaque bloc

Data Matrix ECC 200 prend en charge les tailles carrées de 10 à 144 modules, les six tailles rectangulaires standard, plusieurs régions et blocs, et les charges utiles ASCII, C40, Text, X12, EDIFACT et Base256

PDF417 prend en charge la compaction texte, numérique et byte avec la correction Reed-Solomon GF(929) aux niveaux de correction d'erreur 0 à 8

Les charges utiles byte conservent leurs octets bruts et respectent les jeux de caractères ECI pris en charge, dont UTF-8 ; les valeurs ECI non prises en charge échouent explicitement

Chaque analyse d'image intégrée rapporte un seul symbole reconnu ; utilisez le pipeline page et région ou un décodeur applicatif lorsque plusieurs symboles d'un même raster doivent être détectés

Data Matrix prend en charge l'échantillonnage en perspective roté et trapézoïdal, endommagements corrigeables des modules de données compris ; le DMRE reste hors du décodeur, et la récupération PDF417 exige que les motifs de localisation de chaque ligne restent reconnaissables

Un endommagement qui détruit la géométrie des localisateurs ou dépasse la capacité de correction ne renvoie aucun résultat, et des symboles qui se touchent ou se chevauchent peuvent empêcher la localisation indépendante

Budgets et atomicité

La reconnaissance est limitée aux images de 4096 par 4096 et à 4 194 304 pixels, avec des limites fixes de temps, de résultats, de texte et d'octets bruts

L'OCR intégré vérifie son échéance de deux secondes et son jeton d'annulation pendant la conversion des pixels, la binarisation, l'extraction des composantes connexes, la normalisation des glyphes et l'analyse des lignes ; un plafond de 8 192 composantes borne l'analyse du bruit dense

L'annulation se propage dans les pipelines OCR et codes-barres existants, qui ne publient les résultats qu'une fois la demande complète réussie