Ingebouwde OCR en barcodeherkenning
Enginevrije overloads van ApplyLoadedOCRTextLayer en DecodeLoadedPageBarcodes gebruiken de begrensde ingebouwde herkenners van HotPDF
OCR-bereik
De ingebouwde OCR-backend herkent machinaal afgedrukte ASCII-letters en cijfers, inclusief tekst met gemengde hoofd- en kleine letters, via Otsu-binarisering met een lokaal-venster-terugval, extractie van glyphs met verbonden componenten en begrensde grijswaarden-sjabloonvergelijking tegen in cache opgeslagen glyph-sjablonen van meerdere lettertypes
Reguliere, vette, cursieve en vet-cursieve sjablonen dekken Arial, Times New Roman, Courier New, Tahoma en Segoe UI af, zonder externe OCR-installatie
De recognizer normaliseert lichte tekst op een overwegend donkere achtergrond en accepteert vervaagde tekst zolang het grijswaardenbereik minstens 16 van de 255 niveaus beslaat, waarbij de bitmap van de aanroeper en diens woordcoördinaten onaangetast blijven
Hoogteclustering op regelniveau en contextvoorkeur op basis van hoofd- of kleine letters scheiden hoofd- en kleineletters; de stippen van i en j worden samengevoegd met hun stammen, ruis van spikkels onder een minimumcomponentoppervlak wordt genegeerd, en woordafstanden worden gedetecteerd door bimodale afstandclustering
Herkende woorden rapporteren per regel basislijnen en kapitaalhoogtes zodat ApplyLoadedOCRTextLayer doorzoekbare tekst nauwkeurig kan plaatsen
Natuurlijke scènes, niet-ondersteunde lettertypes, zeer kleine tekst en dubbelzinnige vormen leveren nog steeds geen geraden woord op, en elk woord dat een niet-herkend achtergehouden glyph bevat, wordt als geheel weggelaten in plaats van stilletjes tekens te verliezen
Uniforme achtergronden en afbeeldingen met een grijswaardenbereik onder de 16 niveaus leveren geen resultaat op; automatische polariteitskeuze gaat ervan uit dat de achtergrond het grootste deel van de pagina beslaat
Een geldige afbeelding zonder herkende woorden slaagt met een lege resultaten-array, inclusief lege pagina's, pagina's met laag contrast en pagina's met niet-ondersteunde tekst; batches van gescande documenten gaan door naar latere pagina's, terwijl ongeldige verzoeken, annulering en uitgeputte limieten nog steeds falen
FPC op Windows leest invoerbitmaps van zowel 24 bit als 32 bit zonder hun pixelformaat te wijzigen of de originele pixels te laten vallen
Barcode-bereik
De ingebouwde lineaire backend decodeert Code 39, Code 128-sets A/B/C met SHIFT- en FNC-besturingstekens, EAN-8, EAN-13, UPC-A en UPC-E met hun verplichte checksums
QR Code-versies 1 tot 40 ondersteunen kwartslag- en spiegeloriëntaties, op finderbepalers gebaseerde perspectiefbemonstering, BCH-formaatherstel en Reed-Solomon-correctie van beschadigde codewoorden binnen de capaciteit van elk blok
Data Matrix ECC 200 ondersteunt vierkante formaten van 10 tot 144 modules, de zes standaard rechthoekige formaten, meerdere regio's en blokken, en ASCII-, C40-, Text-, X12-, EDIFACT- en Base256-payloads
PDF417 ondersteunt text-, numeric- en byte-compaction met GF(929) Reed-Solomon-correctie op errorcorrectieniveaus 0 tot en met 8
Byte-payloads behouden hun ruwe bytes en respecteren ondersteunde ECI-tekensets, inclusief UTF-8; niet-ondersteunde ECI-waarden falen expliciet
Elke ingebouwde afbeeldingsscan lokaliseert meerdere gescheiden ondersteunde symbolen, houdt herhaalde payloads op verschillende posities bij en rapporteert per-symbol bounds en confidence; Raster-barcodescanning van meerdere symbolen levert de native helper, geprojecteerde Data Matrix-hoekpunten en scanbudgetten
Data Matrix ondersteunt gedraaide en trapeziumvormige projectieve sampling, inclusief corrigeerbare beschadiging van datamodules; DMRE valt buiten de decoder en PDF417-herstel vereist dat de locator-patterns van elke rij herkenbaar blijven
Beschadiging die de locator-geometrie vernietigt of de correctiecapaciteit overschrijdt levert geen resultaat op, en aan elkaar grenzende of overlappende symbolen kunnen onafhankelijke lokalisatie verhinderen
Budgetten en atomariteit
Herkenning is beperkt tot 4096 bij 4096 afbeeldingen en 4.194.304 pixels met vaste tijds-, resultaat-, tekst- en onbewerkte-bytelimieten
Ingebouwde OCR controleert zijn deadline van twee seconden en zijn annuleringstoken tijdens pixelconversie, thresholding, componentextractie, glyphnormalisatie en regelanalyse; een plafond van 8.192 componenten begrenst de analyse van dichte ruis
Annulering plant zich voort door de bestaande OCR- en barcodepijplijnen, die resultaten alleen publiceren nadat het volledige verzoek is geslaagd