Extract text from an image — supports Portuguese, English and Spanish. Powered by Tesseract.js, 100% in your browser.
Cet outil utilise Tesseract.js — le moteur OCR open-source le plus utilisé, compilé en WebAssembly — pour reconnaître le texte dans les images. Il prend en charge plus de 100 langues ; cette interface propose le portugais, l'anglais et l'espagnol. La reconnaissance s'exécute entièrement dans votre navigateur.
La première utilisation télécharge le moteur OCR et les données linguistiques entraînées (~4 Mo par langue) depuis un CDN. Ensuite, les données sont mises en cache par votre navigateur. La précision de la reconnaissance dépend de la qualité de l'image — les numérisations nettes et à fort contraste produisent les meilleurs résultats.
Usages courants : extraire du texte d'une capture d'écran, numériser un document imprimé ou un reçu, ou copier du texte depuis une photo de tableau blanc. L'outil fonctionne mieux avec du texte imprimé ; la reconnaissance de l'écriture manuscrite est limitée.
L'image reste locale. Le moteur OCR et les données linguistiques sont téléchargés depuis un CDN (cdn.jsdelivr.net) lors de la première utilisation, mais votre image n'est jamais envoyée.
Très précis pour du texte imprimé propre (journaux, livres, captures d'écran). Moins précis pour l'écriture manuscrite, les photos basse résolution ou le texte sur des fonds complexes.
Pas directement. Convertissez d'abord le PDF en images avec l'outil PDF vers Image, puis appliquez l'OCR à chaque page.
Le moteur Tesseract (~4 Mo par langue) est téléchargé une seule fois. Les exécutions suivantes sont beaucoup plus rapides car les données sont mises en cache.
Vai.la transforme n'importe quelle URL en lien court avec statistiques de clics, QR Code et votre propre biolink.
Vai.la n'est pas responsable de l'utilisation des outils ni des décisions prises sur la base de leurs résultats.