Waarom hierdie hulpmiddel nuttig is
Herwin kiesbare teks uit beeld-enigste verklarings, briewe of geargiveerde skanderings wanneer die PDF geen bruikbare ingebedde tekslaag het nie.
Kies ’n volledige, QA-goedgekeurde uitgawe wat vir hierdie webwerf gepubliseer is.
Render tot tien bladsye uit 'n geskandeerde PDF en herken hul Engelse teks opeenvolgend in een plaaslike OCR-werker sonder om die dokument op te laai.
Gereed. Jou werkdata bly in hierdie blaaier.
Lêers bly op hierdie toestel. Verwerking gebruik slegs blaaier-API's; niks word na YTSave, die media-API of 'n proxy opgelaai nie.
Herwin kiesbare teks uit beeld-enigste verklarings, briewe of geargiveerde skanderings wanneer die PDF geen bruikbare ingebedde tekslaag het nie.
Gepinde PDF.js lewer elke begrensde bladsy in volgorde; een gepinde Tesseract.js-werker herken die doek, laat dit vry, en beweeg na die volgende bladsy onder 'n totale pixelbegroting.
Kies 'n drietalige geskandeerde brief, gebruik 1.5× outomatiese uitleg, hersien elke bladsyskeier en vertrouensopsomming, en laai dan een UTF-8-tekslêer af.
Die berekening is deterministies en verduidelik valideringsfoute in plaas daarvan om ongeldig invoer stilweg te verander.
Invoer en uitset bly in hierdie oortjie. Kopieer en aflaai gebeur deur blaaiers se API's sonder 'n bedieneroplaai.
Elke uitvoering rapporteer sy instrumentmodus, tydstempel en invoer/uitset grootte sodat getransformeerde data nagegaan kan word.