Image vers texte (OCR)
Glissez une ou plusieurs images (PNG, JPG, WebP, BMP) et extrayez-en le texte. Choisissez une langue - ou jusqu'à trois pour les pages multilingues - puis copiez ou téléchargez le texte extrait en fichier .txt. La reconnaissance se fait entièrement dans votre navigateur via Tesseract.js, avec prise en charge de plus de 100 langues.
Toute la reconnaissance se fait dans le navigateur via Tesseract.js. Les images et le texte ne sont jamais téléversés.
Comment utiliser ce image vers texte (ocr)
- Glissez des images dans la zone ou cliquez pour sélectionner (PNG, JPG, WebP, BMP). Plusieurs images à la fois sont possibles.
- Choisissez la langue du document - ou ajoutez une deuxième ou troisième langue pour les pages multilingues.
- Cliquez sur Reconnaître. Au premier passage, les données linguistiques sont téléchargées (~5-10 Mo par langue, puis mises en cache).
- Lisez le texte reconnu par image avec l'indicateur de confiance, ou copiez/téléchargez le résultat combiné en fichier .txt.
Questions fréquentes
Quelles langues sont prises en charge ?
Plus de 100 langues via Tesseract.js, dont le français, l'anglais, l'allemand, l'espagnol, l'italien, le portugais, le néerlandais, le polonais, le tchèque, le russe, l'arabe, l'hindi, le japonais, le chinois (simplifié et traditionnel), le coréen, le turc, le vietnamien, l'indonésien, le thaï, l'ukrainien, le grec, l'hébreu, le bengali et l'ourdou. Vous pouvez combiner jusqu'à trois langues pour les documents multilingues.
Quelle est la précision de la reconnaissance de texte ?
Tesseract.js atteint généralement 85-95 % de précision sur des scans propres et contrastés de texte imprimé. La confiance baisse pour les photos déformées, les reflets, l'écriture manuscrite ou la basse résolution. Chaque image reçoit un score de confiance pour repérer immédiatement les résultats faibles.
Pourquoi ma note manuscrite ressort-elle sous forme de charabia ?
Tesseract.js est entraîné sur du texte imprimé — caractères composés, épaisseur de trait uniforme, espacement régulier. L'écriture manuscrite viole les trois. L'écriture cursive est pratiquement illisible pour le moteur. Pour les notes manuscrites, utilisez un OCR spécialisé pour l'écriture manuscrite (Apple Notes, Google Lens, OneNote), pas un outil basé sur Tesseract.
Y a-t-il une limite de taille de fichier ?
Il n'y a pas de limite stricte, mais les très grandes images (>10 Mo ou plus larges qu'environ 4000 px) nécessitent beaucoup de mémoire et fonctionnent lentement sur mobile. Pour une vitesse et une précision optimales, scannez les documents à 1500-3000 px sur le côté long.