Ingebouwde OCR en barcodeherkenning

Enginevrije overloads van ApplyLoadedOCRTextLayer en DecodeLoadedPageBarcodes gebruiken de begrensde ingebouwde herkenners van HotPDF

OCR-bereik

De ingebouwde OCR-backend herkent machinaal afgedrukte ASCII-letters en cijfers, inclusief tekst met gemengde hoofd- en kleine letters, via Otsu-binarisering met een lokaal-venster-terugval, extractie van glyphs met verbonden componenten en begrensde grijswaarden-sjabloonvergelijking tegen in cache opgeslagen glyph-sjablonen van meerdere lettertypes

Reguliere, vette, cursieve en vet-cursieve sjablonen dekken Arial, Times New Roman, Courier New, Tahoma en Segoe UI af, zonder externe OCR-installatie

De recognizer normaliseert lichte tekst op een overwegend donkere achtergrond en accepteert vervaagde tekst zolang het grijswaardenbereik minstens 16 van de 255 niveaus beslaat, waarbij de bitmap van de aanroeper en diens woordcoördinaten onaangetast blijven

Hoogteclustering op regelniveau en contextvoorkeur op basis van hoofd- of kleine letters scheiden hoofd- en kleineletters; de stippen van i en j worden samengevoegd met hun stammen, ruis van spikkels onder een minimumcomponentoppervlak wordt genegeerd, en woordafstanden worden gedetecteerd door bimodale afstandclustering

Herkende woorden rapporteren per regel basislijnen en kapitaalhoogtes zodat ApplyLoadedOCRTextLayer doorzoekbare tekst nauwkeurig kan plaatsen

Natuurlijke scènes, niet-ondersteunde lettertypes, zeer kleine tekst en dubbelzinnige vormen leveren nog steeds geen geraden woord op, en elk woord dat een niet-herkend achtergehouden glyph bevat, wordt als geheel weggelaten in plaats van stilletjes tekens te verliezen

Uniforme achtergronden en afbeeldingen met een grijswaardenbereik onder de 16 niveaus leveren geen resultaat op; automatische polariteitskeuze gaat ervan uit dat de achtergrond het grootste deel van de pagina beslaat

Een geldige afbeelding zonder herkende woorden slaagt met een lege resultaten-array, inclusief lege pagina's, pagina's met laag contrast en pagina's met niet-ondersteunde tekst; batches van gescande documenten gaan door naar latere pagina's, terwijl ongeldige verzoeken, annulering en uitgeputte limieten nog steeds falen

FPC op Windows leest invoerbitmaps van zowel 24 bit als 32 bit zonder hun pixelformaat te wijzigen of de originele pixels te laten vallen

Barcode-bereik

De ingebouwde lineaire backend decodeert Code 39, Code 128-sets A/B/C met SHIFT- en FNC-besturingstekens, EAN-8, EAN-13, UPC-A en UPC-E met hun verplichte checksums

QR Code-versies 1 tot 40 ondersteunen kwartslag- en spiegeloriëntaties, op finderbepalers gebaseerde perspectiefbemonstering, BCH-formaatherstel en Reed-Solomon-correctie van beschadigde codewoorden binnen de capaciteit van elk blok

Data Matrix ECC 200 ondersteunt vierkante formaten van 10 tot 144 modules, de zes standaard rechthoekige formaten, meerdere regio's en blokken, en ASCII-, C40-, Text-, X12-, EDIFACT- en Base256-payloads

PDF417 ondersteunt text-, numeric- en byte-compaction met GF(929) Reed-Solomon-correctie op errorcorrectieniveaus 0 tot en met 8

Byte-payloads behouden hun ruwe bytes en respecteren ondersteunde ECI-tekensets, inclusief UTF-8; niet-ondersteunde ECI-waarden falen expliciet

Elke ingebouwde afbeeldingsscan lokaliseert meerdere gescheiden ondersteunde symbolen, houdt herhaalde payloads op verschillende posities bij en rapporteert per-symbol bounds en confidence; Raster-barcodescanning van meerdere symbolen levert de native helper, geprojecteerde Data Matrix-hoekpunten en scanbudgetten

Data Matrix ondersteunt gedraaide en trapeziumvormige projectieve sampling, inclusief corrigeerbare beschadiging van datamodules; DMRE valt buiten de decoder en PDF417-herstel vereist dat de locator-patterns van elke rij herkenbaar blijven

Beschadiging die de locator-geometrie vernietigt of de correctiecapaciteit overschrijdt levert geen resultaat op, en aan elkaar grenzende of overlappende symbolen kunnen onafhankelijke lokalisatie verhinderen

Budgetten en atomariteit

Herkenning is beperkt tot 4096 bij 4096 afbeeldingen en 4.194.304 pixels met vaste tijds-, resultaat-, tekst- en onbewerkte-bytelimieten

Ingebouwde OCR controleert zijn deadline van twee seconden en zijn annuleringstoken tijdens pixelconversie, thresholding, componentextractie, glyphnormalisatie en regelanalyse; een plafond van 8.192 componenten begrenst de analyse van dichte ruis

Annulering plant zich voort door de bestaande OCR- en barcodepijplijnen, die resultaten alleen publiceren nadat het volledige verzoek is geslaagd