Image vers texte (OCR)
Récupère le texte modifiable d'une photo, d'un scan ou d'une capture d'écran. Rien ne quitte ton appareil.
Comment ça marche
L'outil OCR de DocuZero lit le texte présent dans une image — une page scannée, la photo d'un tableau, une capture d'écran d'article — et le transforme en texte copiable, modifiable et cherchable. Le moteur de reconnaissance (Tesseract) tourne en WebAssembly directement dans ton navigateur, donc l'image elle-même n'est jamais envoyée où que ce soit.
Comment extraire le texte d'une image
Dépose ton image dans la zone ci-dessus — soit en la glissant, soit en cliquant pour parcourir ; le JPG, le PNG et le WEBP sont acceptés. Choisis la langue du texte dans le menu déroulant, puis appuie sur Extraire le texte. Au premier lancement, le moteur OCR se charge (la barre de progression affiche « Chargement du moteur OCR… »), puis la reconnaissance prend le relais et indique son pourcentage au fur et à mesure. Quand c'est terminé, le texte apparaît dans un encadré en lecture seule avec deux actions : Copier le place dans le presse-papiers, et Télécharger .txt l'enregistre dans un fichier texte brut nommé ocr-export.txt.
Comment obtenir des résultats précis
La qualité de l'OCR dépend surtout de l'image, pas du moteur. Quelques réflexes font une grosse différence :
Résolution. Vise un texte d'au moins 20 à 30 pixels de haut. Si tu n'arrives pas à lire les lettres confortablement en zoomant, le moteur OCR non plus.
Redresser et recadrer. Des photos de travers obligent le moteur à deviner où commencent et finissent les lignes. Recadre sur la zone de texte et redresse la page avant de lancer la reconnaissance.
Contraste. Du texte foncé sur fond clair fonctionne le mieux. Les ombres portées sur une page photographiée sont la cause la plus fréquente de mots manquants.
L'imprimé bat le manuscrit. Le moteur est entraîné sur du texte imprimé ; les majuscules bâties passent, l'écriture cursive largement pas.
Un exemple concret
Imagine que tu as animé un atelier et photographié le paperboard portant le plan d'action pendant que la salle se vidait. Ouvre cette photo ici, choisis Français (ou Français + Anglais si le paperboard mélange les deux), appuie sur Extraire le texte, et les sept points d'action ressortent en texte propre en quelques secondes — prêts à être collés dans l'outil de suivi des tâches de ton équipe. Le même geste fonctionne pour un contrat signé dont tu veux citer une clause, un bloc d'adresse coincé dans une capture d'écran, ou un menu photographié que tu veux garder en texte cherchable.
Ce que tu peux attendre
L'outil prend une seule image (image/* — JPG, PNG, WEBP) et renvoie du texte brut ; il ne tente pas de reconstruire la mise en page. Il lit ligne par ligne, donc les paragraphes et les retours à la ligne ressortent approximatifs, et les tableaux ou colonnes arrivent aplatis, prêts à être remis en ordre à la main.
Quatre choix de langue sont proposés : français, anglais, les deux combinés, ou arabe. Aucune limite de taille n'est imposée, mais les images très volumineuses ou en haute résolution prennent plus de temps, car la reconnaissance s'exécute sur le processeur de ton appareil. La première reconnaissance est plus lente, le temps que le moteur se charge ; ensuite il reste en mémoire et les images suivantes sont traitées plus vite. Quoi que tu fournisses, l'image et le texte ne quittent jamais ton navigateur.
Problèmes courants et solutions
Image floue ou en basse résolution et mots manquants ? Utilise la version la plus nette dont tu disposes — le texte doit faire au moins 20 à 30 pixels de haut pour que le moteur ait une chance de le lire. Des caractères accentués brouillés ? Le moteur applique un modèle de langue, donc choisis la bonne : Français, Anglais, ou Français + Anglais quand la source mélange les deux. Des lignes coupées ou fusionnées sur une photo penchée ? Redresse la page et recadre sur la zone de texte avant de lancer la reconnaissance. La reconnaissance traîne sur une grande image ? Recadre sur la zone de texte, et sache que la toute première exécution est plus lente, le moteur se chargeant.
Questions fréquentes
Quelles langues sont prises en charge ?
Français, anglais, arabe, et leurs combinaisons. D'autres langues peuvent être ajoutées sur demande.
Y a-t-il une limite de taille de fichier ?
Aucune limite stricte n'est imposée, mais des images très volumineuses ou en très haute résolution prendront plus de temps à traiter, car tout s'exécute sur le processeur de ton propre appareil.
Ça fonctionne sur de l'écriture manuscrite ?
Les moteurs OCR sont conçus pour du texte imprimé. La reconnaissance de l'écriture manuscrite est beaucoup moins fiable et les résultats varient fortement.
Il lit les PDF directement ?
Pas dans cet outil — exporte d'abord la page en image, ou utilise PDF vers texte si le PDF possède une couche de texte.
Pourquoi la première reconnaissance est-elle plus longue ?
Le moteur de reconnaissance est téléchargé et initialisé au premier lancement ; ensuite il reste en mémoire et les images suivantes sont traitées plus vite.
La mise en page est-elle conservée ?
Il lit ligne par ligne, donc les paragraphes et les retours à la ligne sont approximatifs. Les tableaux et les colonnes ressortent aplatis — remets le texte en ordre ensuite si besoin.