Extraire le texte d’une image (OCR)
Récupérez le texte d’une photo de document, d’une capture d’écran, d’une lettre scannée ou d’un PDF scanné complet au lieu de tout retaper. Tesseract, un moteur OCR open source éprouvé, le lit directement dans votre navigateur, en français, anglais, allemand, espagnol, chinois, hindi et 10 autres langues. Le résultat s’affiche dans un éditeur pour corriger un mot avant de le copier.
Comment ça marche
- Déposez une image ou un PDF scanné, ou collez une capture d’écran avec Ctrl+V.
- Choisissez la langue du texte.
- Vérifiez le texte, puis copiez-le ou téléchargez-le en .txt.
Questions fréquentes
Quelle est la précision ?
Un texte imprimé sur une photo ou un scan net et droit est en général reconnu presque parfaitement. L’écriture manuscrite, les très petits textes, les ombres marquées et les polices fantaisie donnent plus d’erreurs.
Peut-il lire un PDF ?
Oui. Les PDF scannés sont lus page par page. Si un PDF contient déjà du vrai texte, vous pouvez en général le sélectionner et le copier directement dans votre lecteur PDF.
Mon fichier est-il envoyé en ligne ?
Non. La reconnaissance de texte se fait sur votre appareil ; seules les données de langue sont téléchargées, une seule fois.