Extraia texto de uma imagem — suporta Português, Inglês e Espanhol. Powered by Tesseract.js, 100% no seu navegador.
Esta ferramenta usa Tesseract.js — o motor OCR open-source mais usado, compilado para WebAssembly — para reconhecer texto em imagens. Suporta mais de 100 idiomas; esta interface oferece Português, Inglês e Espanhol. O reconhecimento roda inteiramente no seu navegador.
O primeiro uso baixa o motor OCR e os dados de idioma treinados (~4 MB por idioma) de um CDN. Depois disso, os dados ficam em cache no navegador. A precisão do reconhecimento depende da qualidade da imagem — digitalizações limpas e de alto contraste produzem os melhores resultados.
Usos comuns: extrair texto de uma captura de tela, digitalizar um documento impresso ou recibo, ou copiar texto de uma foto de quadro branco. A ferramenta funciona melhor com texto impresso; o reconhecimento de manuscrito é limitado.
A imagem permanece local. O motor OCR e os dados de idioma são baixados de um CDN (cdn.jsdelivr.net) no primeiro uso, mas sua imagem nunca é enviada.
Muito preciso para texto impresso limpo (jornais, livros, capturas de tela). Menos preciso para manuscrito, fotos de baixa resolução ou texto em fundos complexos.
Não diretamente. Converta o PDF em imagens primeiro, depois faça OCR de cada página.
O motor Tesseract (~4 MB por idioma) é baixado uma vez. Execuções seguintes são muito mais rápidas porque os dados ficam em cache.
O Vai.la transforma qualquer URL em um link curto com estatísticas de cliques, QR Code e seu próprio biolink.
O Vai.la não se responsabiliza pelo uso das ferramentas nem por decisões tomadas com base nos seus resultados.