Image en texte

Déposez une image, choisissez la langue de ce qui est écrit et appuyez sur le bouton. Un scan ou une capture ressort en général mot pour mot ; une photo prise à main levée ressort presque juste et mérite une relecture.

ou déposez-les ici

Une image avec du texte — un scan, une capture ou une photo. JPG, PNG, WebP, HEIC, jusqu’à 50 Mo

Le texte reconnu est rendu tel qu’il a été lu — rien n’est corrigé automatiquement, car une correction plausible sur un chiffre est une erreur que vous ne pourriez plus repérer. La mise en page n’est pas conservée non plus : colonnes, tableaux et en-têtes ressortent en lignes ordinaires. Le moteur et le fichier de langue sont servis depuis ce site, pas depuis celui d’un tiers, et l’image n’est jamais téléversée — un document photographié sur un bureau est exactement le genre de fichier qui ne doit pas voyager.

Comment faire

  1. Faites glisser une image sur la zone ci-dessous, ou appuyez sur « Choisir un fichier » — JPG, PNG, WebP et HEIC du téléphone.
  2. Choisissez la langue du texte. La mauvaise langue est la raison la plus fréquente pour qu’on ne trouve rien.
  3. Appuyez sur « Lire le texte », puis copiez-le ou enregistrez-le en fichier .txt.

Bon à savoir

Ce qu’elle lit vraiment, mesuré et non promis

Sur un scan propre ou une capture, le texte ressort caractère pour caractère. Sur une photo prise à main levée — un peu penchée, éclairée inégalement, compressée par l’appareil — entre un et dix caractères sur cent sortent faux, et le russe s’en tire nettement moins bien que l’anglais sur la même image. Les erreurs sont du genre prévisible : un « g » lu « § », un trait d’union devenu tiret, deux mots collés. C’est pourquoi la page vous dit dans lequel des deux cas vous êtes, au lieu de rendre le texte comme s’il avait été tapé.

Rien n’est corrigé, et c’est délibéré

Il serait facile de remarquer que « 37-70 » sur un ticket est presque sûrement « 37,70 » et de le corriger en silence. C’est exactement ce que cette page ne fait pas. Une correction plausible sur un chiffre est une erreur que vous ne pourrez plus repérer en relisant — et c’est sur les chiffres qu’elle coûte le plus cher. Vous obtenez ce qui a été lu. La mise en page n’est pas conservée non plus : colonnes, tableaux et titres courants reviennent en lignes ordinaires, car une image ne contient aucune information sur ce qui était quoi.

Questions fréquentes

Mon image est-elle envoyée quelque part ?

Non, ni elle ni rien d’autre. Le moteur de reconnaissance et le fichier de langue sont servis depuis ce site plutôt que depuis un CDN tiers : sinon, le simple fait de votre visite serait connu d’un autre. L’image, elle, ne quitte jamais le navigateur. Un document photographié sur un bureau est exactement le genre de fichier qui ne doit pas voyager.

Sait-elle lire l’écriture manuscrite ?

Pas utilement. Le moteur est entraîné sur du texte imprimé ou tapé ; sur une écriture cursive il produit quelque chose qui ressemble à des mots et qui est faux pour l’essentiel. Des capitales d’imprimerie tracées très régulièrement passent parfois. Le reste est un pile ou face, et un pile ou face déguisé en résultat vaut moins qu’un refus.

Pourquoi le premier lancement télécharge-t-il trois mégaoctets ?

Parce que la reconnaissance tourne sur votre appareil, et cela demande un moteur et un modèle de la langue. Ensemble, environ trois mégaoctets, annoncés avant le bouton et non après. Le navigateur garde les deux : la deuxième image démarre aussitôt, et fonctionne même sans connexion.

J’ai un PDF scanné, pas une image.

Transformez-le d’abord en images avec la page « PDF en JPG » et apportez-les ici. Si le PDF possède une vraie couche de texte — c’est le cas de la plupart des documents faits sur ordinateur — alors « PDF en Word » vous donnera le texte sans aucune reconnaissance, et sans ses erreurs.

Outils similaires