Extract text from an image — supports Portuguese, English and Spanish. Powered by Tesseract.js, 100% in your browser.
Alat ini menggunakan Tesseract.js — mesin OCR open-source yang paling banyak digunakan, dikompilasi ke WebAssembly — untuk mengenali teks dalam gambar. Ini mendukung lebih dari 100 bahasa; antarmuka ini menawarkan Portugis, Inggris, dan Spanyol. Pengenalan berjalan sepenuhnya di browser Anda.
Penggunaan pertama mengunduh mesin OCR dan data bahasa terlatih (~4 MB per bahasa) dari CDN. Setelah itu, data di-cache oleh browser Anda. Akurasi pengenalan bergantung pada kualitas gambar — pindaian bersih dengan kontras tinggi menghasilkan hasil terbaik.
Penggunaan umum: mengekstrak teks dari tangkapan layar, mendigitalkan dokumen cetak atau kuitansi, atau menyalin teks dari foto papan tulis. Alat ini bekerja paling baik dengan teks cetak; pengenalan tulisan tangan terbatas.
Gambar itu sendiri tetap lokal. Mesin OCR dan data bahasa diunduh dari CDN (cdn.jsdelivr.net) pada penggunaan pertama, tetapi gambar Anda tidak pernah diunggah.
Sangat akurat untuk teks cetak bersih (koran, buku, screenshot). Kurang akurat untuk tulisan tangan, foto resolusi rendah, atau teks pada latar belakang kompleks.
Tidak secara langsung. Konversi PDF menjadi gambar terlebih dahulu menggunakan alat PDF ke Gambar, lalu OCR setiap halaman.
Mesin Tesseract (~4 MB per bahasa) diunduh satu kali. Proses selanjutnya jauh lebih cepat karena data sudah di-cache.
Vai.la mengubah URL apa pun menjadi tautan pendek dengan statistik klik, QR Code, dan biolink Anda sendiri.
Vai.la tidak bertanggung jawab atas cara alat-alat ini digunakan maupun atas keputusan yang diambil berdasarkan hasilnya.