Szöveg kibontása a beolvasott PDF-ekből az OCR segítségével
A nem kereshető beolvasott PDF-fájlokat és képeket helyileg szerkeszthető egyszerű szöveggé alakíthatja a többnyelvű WebAssembly OCR-munkások segítségével.
Azonnal kivonja a szöveget a beolvasásokból
Fejlett optikai karakterfelismerő (OCR) technológiánk segítségével szerkeszthető szöveget vonhat ki a beolvasott dokumentumokból és képekből.
Szöveg kibontása az OCR segítségével
Feltöltés Scan
Válassza ki a beolvasott PDF- vagy képfájlt.
Futtassa az OCR-t
Válassza ki a nyelvet, és indítsa el az OCR folyamatot.
Másolás vagy letöltés
A kivont szöveget azonnal megkapja.
Többnyelvű támogatás
OCR motorunk több nyelvet és összetett karakterkészletet ismer fel nagy pontossággal.
Privát OCR feldolgozás
Más OCR-eszközökkel ellentétben nem küldjük el dokumentumait felhő API-kba. A szöveg kinyerése közvetlenül az eszközön történik.
Nagy pontosságú
Kiváló felismerési arány a tiszta beolvasáshoz.
Tesseract OCR architektúra: ügyféloldali neurális felismerés
A WebAssembly által összeállított Tesseract OCR-t adaptív kétmenetes karakterosztályozással és többnyelvű neurális nyelvi modellekkel valósítja meg közvetlenül a böngészőben, felhőfüggőségek nélkül.
Academic Reference: Ray Smith (Google Research, IEEE ICDAR 2007)
Gyakran Ismételt Kérdések
Támogatja a kézzel írt szöveget?
OCR-ünket nyomtatott szövegre optimalizáltuk. A kézzel írt szövegek pontossága kisebb lehet.
Feltöltődnek a fájljaim?
Nem, az OCR motor teljes egészében az Ön böngészőjében fut a WebAssembly használatával.
Képből is tudok szöveget kivonni?
Igen, feltölthet PNG, JPG vagy beolvasott PDF fájlokat.