Extract text from an image — supports Portuguese, English and Spanish. Powered by Tesseract.js, 100% in your browser.
Dette verktøyet bruker Tesseract.js — den mest brukte åpen kildekode OCR-motoren, kompilert til WebAssembly — for å gjenkjenne tekst i bilder. Det støtter over 100 språk; dette grensesnittet tilbyr portugisisk, engelsk og spansk. Gjenkjenningen kjører helt i nettleseren din.
Første bruk laster ned OCR-motoren og trente språkdata (~4 MB per språk) fra et CDN. Etter det lagres dataene i nettleserens hurtigbuffer. Gjenkjenningsnøyaktigheten avhenger av bildekvaliteten — rene, høykontrastskann gir de beste resultatene.
Vanlige bruksområder: ekstrahere tekst fra et skjermbilde, digitalisere et trykt dokument eller kvittering, eller kopiere tekst fra et bilde av en tavle. Verktøyet fungerer best med trykt tekst; håndskriftsgjenkjenning er begrenset.
Bildet forblir lokalt. OCR-motoren og språkdataene lastes ned fra et CDN (cdn.jsdelivr.net) ved første bruk, men bildet ditt lastes aldri opp.
Svært nøyaktig for ren trykt tekst (aviser, bøker, skjermbilder). Mindre nøyaktig for håndskrift, lavoppløselige bilder eller tekst på komplekse bakgrunner.
Ikke direkte. Konverter PDF-en til bilder først med PDF-til-bilde-verktøyet, og kjør deretter OCR på hver side.
Tesseract-motoren (~4 MB per språk) lastes ned én gang. Påfølgende kjøringer er mye raskere fordi dataene er hurtigbufret.
Vai.la gjør enhver URL om til en kortlenke med klikkstatistikk, QR Code og din egen biolink.
Vai.la er ikke ansvarlig for hvordan verktøyene brukes, eller for beslutninger tatt på grunnlag av resultatene.