OCR Gratuit · sans inscription · sans filigrane

Convertir une image en texte (OCR)

Transformez une photo en texte, ou une capture d'écran et une page numérisée en texte modifiable. Le moteur OCR tourne dans votre navigateur : vos images ne quittent jamais votre appareil.

Updated Krawly Editorial TeamIn-house engineers, writers & reviewers

ou déposez vos fichiers ici · collez avec Ctrl+V

JPG, PNG, WEBP, BMP, GIF · jusqu'à 50 MB chacun · 20 fichiers max.

Traité dans votre navigateur — aucun fichier n'est envoyé

Réponse rapide

Pour convertir une image en texte, déposez un fichier JPG, PNG, WebP, BMP ou GIF dans l'outil Image en texte de Krawly, choisissez la langue du texte (jusqu'à 3 à la fois) et lancez l'OCR. Le moteur Tesseract lit l'image localement dans votre navigateur et renvoie un texte modifiable, à copier ou à télécharger en fichier .txt. Rien n'est envoyé en ligne et aucune inscription n'est demandée.

Comment utiliser l'outil Image en texte (OCR)

  1. 1

    Ajoutez vos images

    Glissez des fichiers JPG, PNG, WebP, BMP ou GIF dans la zone de dépôt, ou cliquez pour les choisir. Vous pouvez ajouter jusqu'à 20 images par traitement, par exemple une série de captures d'écran ou de pages photographiées.

  2. 2

    Choisissez la langue du texte

    L'anglais est sélectionné par défaut. Choisissez la langue dans laquelle votre texte est écrit, ou jusqu'à trois langues si l'image les mélange, comme le français et l'anglais sur un menu bilingue.

  3. 3

    Lancez l'OCR

    Cliquez sur « Extraire le texte ». Lors du premier lancement, votre navigateur télécharge le moteur OCR et le modèle de langue, puis les met en cache. Chaque image est traitée sur votre appareil et obtient sa propre zone de texte avec un score de confiance moyen.

  4. 4

    Relisez et corrigez

    Les résultats sont modifiables. Corrigez directement dans la zone de texte les caractères mal lus avant d'utiliser le texte ; un score de confiance faible indique qu'une ligne mérite d'être vérifiée de près.

  5. 5

    Copiez ou téléchargez

    Cliquez sur « Tout copier » pour placer le texte dans le presse-papiers, ou sur « Télécharger le .txt » pour enregistrer les résultats. Si vous traitez plusieurs images, le téléchargement les réunit dans un seul fichier .txt avec un en-tête par image.

Comment fonctionne la conversion d'une image en texte (OCR) ?

OCR signifie reconnaissance optique de caractères : un logiciel examine les pixels d'une image, repère les zones qui contiennent de l'écriture et détermine quels caractères elles représentent. Le résultat est un vrai texte que vous pouvez rechercher, modifier, coller dans un document ou importer dans un tableur, au lieu d'une image de texte qu'il faudrait sinon retaper à la main.

Krawly utilise Tesseract, un moteur OCR open source de longue date. Il a d'abord été développé chez Hewlett-Packard, publié en open source en 2005, puis amélioré avec le soutien de Google. Ici, il fonctionne sous la forme de Tesseract.js, une version compilée en WebAssembly qui s'exécute dans une page web sans aucun serveur. Pour simplifier, le moteur nettoie l'image pour obtenir un texte sombre sur fond clair, découpe la page en blocs, en lignes et en mots, puis reconnaît chaque ligne avec un modèle entraîné pour la langue choisie.

C'est pour cette dernière étape que le choix de la langue compte. Chaque langue a son propre modèle, avec son alphabet, ses lettres accentuées et ses formes de mots courantes. Si vous demandez au moteur de lire de l'anglais alors que l'image est en polonais ou en vietnamien, il essaiera quand même, mais les lettres avec diacritiques seront mal reconnues. Pour un texte français, sélectionner le français est indispensable pour bien obtenir les é, è, à, ç et autres accents. Choisir la bonne langue, ou une combinaison de trois au maximum, est l'un des moyens les plus simples d'obtenir un résultat plus propre.

Comment extraire un texte fiable d'une photo ou d'une capture d'écran

L'OCR fonctionne le mieux sur un texte imprimé net, bien contrasté et aux lignes droites. Les captures d'écran sont généralement idéales, car le texte y est net et parfaitement horizontal. Pour les numérisations, environ 300 DPI est un bon objectif : assez pour que les petites lettres aient des contours propres, sans créer de fichiers énormes. Si vous photographiez une page avec votre téléphone, remplissez le cadre avec le document, tenez l'appareil parallèle à la feuille et évitez l'ombre de votre main ou du téléphone.

Le contraste compte plus que la couleur. Un texte noir sur papier blanc est facile ; un texte gris clair sur fond beige, ou un texte blanc sur une photo chargée, est bien plus difficile. Si le résultat est médiocre, recadrez l'image sur la zone de texte, faites-la pivoter pour que les lignes soient horizontales et augmentez le contraste dans un éditeur photo avant de relancer l'OCR. Les lignes de travers, courbées ou déformées par la perspective, comme sur une page photographiée près de la reliure d'un livre, sont une cause fréquente de mots manquants.

Un texte très petit pose aussi souvent problème. Quand les lettres ne font que quelques pixels de haut, il n'y a pas assez de détails pour distinguer un e d'un c ou un l d'un 1. Zoomer avant de faire la capture d'écran, ou numériser à une résolution plus élevée, aide généralement plus que n'importe quelle retouche après coup. Gardez en tête qu'agrandir une image déjà petite ne peut pas ajouter de détails qui n'ont jamais été capturés.

Ce que l'OCR ne sait pas faire : écriture manuscrite, tableaux et mise en page

Tesseract est conçu pour le texte imprimé. L'écriture manuscrite, les notes en cursive, les signatures et les polices très stylisées ou décoratives donnent généralement des résultats médiocres, voire inutilisables. Il en va de même pour les photos en basse résolution, floues ou très compressées. Si votre image entre dans l'un de ces cas, attendez-vous à corriger une bonne partie du résultat à la main, ou à retaper le texte.

Le résultat est du texte brut. Les colonnes, les tableaux, le gras et l'italique, les tailles de police et les images ne sont pas conservés. Un article sur deux colonnes est mis à plat en lignes de texte, et un tableau devient des rangées de mots séparés par des espaces : vous devrez peut-être remettre la structure en ordre après l'avoir collé ailleurs. Cet outil ne produit ni documents Word ni feuilles de calcul.

Chaque image reçoit aussi un pourcentage de confiance moyen. C'est la propre estimation du moteur sur sa certitude quant aux mots reconnus, pas une garantie de précision, mais c'est un signal utile : un score nettement plus bas signifie généralement que l'image doit être plus nette, plus droite ou recadrée plus serré.

Peut-on faire l'OCR de captures d'écran, de pièces d'identité et de reçus en toute sécurité ?

On passe souvent des documents sensibles à l'OCR : tickets de caisse pour une note de frais, captures d'écran de conversations ou d'applications bancaires, factures, contrats, cartes d'identité et courriers. Beaucoup de services d'OCR en ligne envoient ces images sur un serveur pour les traiter. Krawly, non. La reconnaissance se fait entièrement dans votre navigateur avec JavaScript et WebAssembly, et vos images ne sont jamais envoyées aux serveurs de Krawly.

Les seuls éléments que votre navigateur télécharge sont des fichiers programme : le moteur Tesseract et le modèle de chaque langue choisie, quelques mégaoctets chacun. Après le premier lancement, ils sont mis en cache, si bien que les lancements suivants démarrent plus vite. L'image et le texte reconnu restent dans la mémoire de la page, rien n'est conservé, et fermer l'onglet efface tout.

Comme le travail se fait sur votre appareil, la vitesse dépend de votre matériel. Un ordinateur portable récent traite une capture d'écran rapidement ; un téléphone plus ancien met plus de temps sur de grandes photos. L'outil fonctionne dans les versions récentes de Chrome, Edge, Firefox et Safari, sur ordinateur comme sur mobile, et il est gratuit, sans inscription, sans e-mail et sans limite quotidienne.

Conseils pour de meilleurs résultats

  • Pour extraire le texte d'une image chargée, recadrez-la sur la zone utile avant de lancer l'OCR. Retirer logos, photos et bordures de page laisse moins de choses à mal lire au moteur.
  • Sélectionnez toutes les langues présentes dans l'image, jusqu'à trois. Un document français contenant des citations en anglais se lit mieux avec les deux langues sélectionnées.
  • Pour les captures d'écran, zoomez sur la page avant de capturer afin que les lettres soient plus grandes et plus nettes.
  • Vérifiez les lignes avec des caractères inhabituels, des chiffres et de la ponctuation : 0 et O, 1 et l, ou rn et m sont des confusions classiques de l'OCR.
  • Une photo d'iPhone au format HEIC ? Convertissez-la d'abord avec l'outil HEIC en JPG, puis lancez l'OCR sur le JPG.
  • Pour un PDF numérisé, utilisez PDF en texte plutôt que de faire une capture de chaque page. L'outil lit le texte intégré lorsqu'il existe et ne lance l'OCR que là où c'est nécessaire.

Questions fréquentes

L'outil peut-il lire l'écriture manuscrite ?

Pas de manière fiable. Le moteur Tesseract est conçu pour le texte imprimé : les notes manuscrites, la cursive et les signatures donnent généralement des caractères incomplets ou erronés. Des majuscules d'imprimerie très soignées fonctionnent parfois en partie. Pour l'écriture manuscrite, retaper le texte est souvent plus rapide que corriger le résultat de l'OCR.

Comment copier le texte d'une image ?

Déposez l'image dans l'outil, choisissez la langue du texte et cliquez sur « Extraire le texte ». Une fois la reconnaissance terminée, corrigez si besoin le résultat dans la zone de texte, puis cliquez sur « Tout copier » pour le placer dans le presse-papiers. C'est aussi le moyen le plus simple de passer une capture d'écran en texte.

Quelles langues sont prises en charge ?

Anglais, espagnol, portugais, français, allemand, italien, néerlandais, turc, polonais, russe, ukrainien, arabe, hindi, japonais, chinois (simplifié), chinois (traditionnel), coréen, vietnamien et indonésien. Vous pouvez sélectionner jusqu'à trois langues à la fois pour les images qui les mélangent.

Mes images sont-elles envoyées sur un serveur ?

Non. L'OCR tourne dans votre navigateur grâce à Tesseract compilé en WebAssembly. Votre navigateur télécharge le moteur et les fichiers de langue, mais vos images et le texte extrait ne quittent jamais votre appareil. Rien n'est conservé, et fermer l'onglet efface tout.

Pourquoi le premier lancement est-il plus lent ?

La première fois que vous utilisez l'outil, votre navigateur télécharge le moteur OCR et le modèle de chaque langue sélectionnée, quelques mégaoctets par langue. Ces fichiers sont ensuite mis en cache, si bien que les lancements suivants avec les mêmes langues démarrent beaucoup plus vite. Choisir une nouvelle langue déclenche un téléchargement unique de son modèle.

Combien d'images peut-on convertir à la fois ?

Jusqu'à 20 images par traitement, de 50 Mo maximum chacune. Chaque image obtient sa propre zone de texte modifiable, et « Télécharger le .txt » réunit tous les résultats dans un seul fichier texte avec un en-tête par image. Il n'y a pas de limite quotidienne : vous pouvez relancer un traitement aussitôt.

Quels formats d'image peut-on utiliser ?

JPG, PNG, WebP, BMP et GIF, jusqu'à 50 Mo chacun. Les captures d'écran enregistrées en PNG sont généralement les plus propres, car le texte y est net. Les photos HEIC d'iPhone ne sont pas acceptées directement : convertissez-les d'abord avec l'outil HEIC en JPG, puis lancez l'OCR sur le JPG.

Les tableaux et la mise en forme sont-ils conservés ?

Non. Le résultat est du texte brut. Les colonnes sont mises à plat, les tableaux deviennent des lignes de mots séparés par des espaces, et les polices, le gras et les images disparaissent. Vous pouvez modifier le texte dans la zone de résultat avant de le copier, ou le remettre en forme dans votre propre éditeur.

Que signifie le pourcentage de confiance ?

C'est la confiance moyenne du moteur sur les mots qu'il a reconnus dans l'image. Ce n'est pas une mesure de précision, mais un score plus bas indique souvent que l'image est floue, de travers, peu contrastée ou dans une autre langue que celle sélectionnée.

Confidentiel par conception. Chaque convertisseur Krawly tourne dans votre navigateur grâce à JavaScript et WebAssembly. Vos fichiers ne sont ni envoyés, ni stockés, ni vus par personne : quand vous fermez l'onglet, ils disparaissent.

Convertisseurs associés

Voir les 21 convertisseurs gratuits