OCR d’image
Transformer le texte d’une image en texte modifiable
L’OCR d’image extrait les mots d’une capture d’écran, d’une photo ou d’un document scanné. Vous obtenez du texte à copier ou un fichier TXT ou Markdown. Choisissez le format avant l’extraction, puis relisez les noms, chiffres et références : la reconnaissance peut confondre des caractères ressemblants.
Coût: Des options gratuites sont disponibles. Les options Pro ou l’utilisation au-delà du quota gratuit peuvent nécessiter des crédits ; consultez le guide ci-dessous.
Comment extraire le texte d’une image
Importer une image
Déposez un fichier JPG, PNG, WebP, HEIC, HEIF, AVIF, BMP ou TIFF sur l’aperçu, ou cliquez sur Téléchargez une image pour extraire le texte. La limite est de 200 MB. Files permet de sélectionner une image déjà utilisée dans un autre outil.
Choisir le format du texte
Dans OCR, gardez TXT pour du texte brut ou sélectionnez Markdown pour conserver la structure sous forme de balises. Ce choix s’applique à l’extraction : réglez-le avant de lancer le traitement.
Choisir l’indice de langue
Indice de langue commence sur Auto-detect, la détection automatique. Sélectionner une langue peut aider à distinguer des caractères ambigus ; ce choix utilise aussi un autre moteur de reconnaissance.
Lancer l’extraction
Cliquez sur Extract text. L’image reste dans l’aperçu et le texte obtenu apparaît dessous, dans Texte extrait, avec son nombre de caractères. Le résultat est également ajouté au gestionnaire de fichiers partagé.
Relire et enregistrer
Comparez les noms, montants, dates et codes avec l’image. Copier place le texte dans le presse-papiers ; Télécharger enregistre un fichier UTF-8 nommé
ocr-result.txtouocr-result.md.
Format de sortie et indice de langue
Les deux réglages du panneau OCR concernent la reconnaissance et le texte obtenu. Ils ne modifient pas l’image importée.
- TXT
- Le choix initial donne du texte brut, sans mise en forme Markdown. Les tableaux reconnus deviennent des lignes dont les cellules sont séparées par des tabulations, pour les répartir en colonnes dans un tableur. Les caractères appartenant au texte lui-même, comme
#hashtags,__init__ou<div>dans une capture de code, sont conservés. Convient aux courriers, reçus, messages et citations. - Markdown
- Conserve la structure reconnue : titres marqués par
#, listes, emphase et tableaux. Utilisez-le pour transférer un document structuré vers un éditeur de notes ou un wiki. Un éditeur compatible affiche la mise en forme ; un éditeur de texte simple montre la syntaxe du fichier.md. - Indice de langue : Auto-detect
- Envoie l’image au modèle spécialisé GLM-OCR de Z.ai. Celui-ci détecte les langues et les écritures automatiquement, sans recevoir d’indice de langue manuel.
- Indice de langue : une langue précise
- Le menu propose English, German, Spanish, French, Italian, Portuguese, Russian, Japanese, Chinese, Arabic et Hindi. Pour un texte français, choisissez French. L’image est alors envoyée à Google Gemini, avec un indice sur la langue, l’écriture et le sens de lecture. Cela peut aider pour les caractères communs au chinois et au japonais ou pour l’arabe lu de droite à gauche. Le modèle reçoit l’instruction de transcrire sans traduire, résumer ni corriger, en conservant aussi les passages dans d’autres langues.
Quel service reçoit l’image ?
Le traitement passe par nos serveurs, qui transmettent l’image complète à un service d’IA externe. Auto-detect utilise GLM-OCR de Z.ai ; une langue sélectionnée utilise l’API Google Gemini. Si Gemini atteint une limite de requêtes ou de quota, la même demande est envoyée au modèle Gemini via OpenRouter. Tenez compte de cet envoi pour un passeport, un relevé bancaire ou tout autre document confidentiel.
Passer d’Auto-detect à une langue précise change le moteur, et peut donc donner une autre lecture du texte. Si une ligne est mal reconnue, comparez les deux résultats avec l’original. Chaque nouvelle extraction compte comme une utilisation distincte.
Préparer une image lisible
La netteté des caractères et le cadrage de la source comptent davantage qu’une correction après extraction.
Recadrer sur le texte utile
Les menus, filigranes et panneaux de l’arrière-plan peuvent aussi être transcrits. Avec Recadrer une image, gardez uniquement la zone à lire avant de lancer l’OCR.
Remettre la page à l’endroit
Des lignes droites et horizontales facilitent la reconnaissance. Corrigez une photo tournée ou inclinée avec Pivoter une image avant l’extraction.
Faire une capture plutôt que photographier un écran
Une capture garde des lettres nettes et un éclairage uniforme. Une photo de moniteur ajoute des reflets, des bandes de moiré et de la perspective, qui peuvent rendre les lettres et les chiffres ambigus.
Utiliser OCR PDF pour plusieurs pages
Cet outil traite une image par extraction. Si vos scans sont déjà regroupés dans un PDF, OCR PDF peut traiter toutes les pages ou une sélection en une demande.
Formats, utilisations et conservation
- Formats acceptés
- JPG, PNG, WebP, HEIC, HEIF, AVIF, BMP et TIFF. GIF n’est pas accepté.
- Résultat
- Texte brut (.txt) ou Markdown (.md), en UTF-8 ; copie dans le presse-papiers
- Taille maximale
- 200 MB par image
- Images par traitement
- 1
- Traitement
- Sur nos serveurs, avec reconnaissance externe par Z.ai GLM-OCR ou Google Gemini. Limite de 30 minutes, sans nouvelle tentative automatique.
- Utilisations et crédits
- Une extraction compte pour une utilisation. Les quotas gratuits portent sur les dernières 24 heures et la dernière heure. Au-delà, les invités doivent se connecter ; chaque image supplémentaire coûte 1 crédit. Le nombre d’utilisations gratuites dépend du quota en vigueur.
- Filigrane
- Aucun
- Conservation des fichiers
- Les fichiers enregistrés sur nos serveurs sont supprimés après 48 heures pour les invités et 30 jours pour les comptes gratuits. Les offres payantes peuvent les conserver plus longtemps. Ces durées ne définissent pas la conservation des fournisseurs externes.
Questions fréquentes
L’OCR traduit-il le texte ?
Non. Il transcrit le texte dans sa langue d’origine. Indice de langue aide à lire des caractères ambigus ; il ne demande pas une traduction. Les passages rédigés dans d’autres langues restent dans leur langue.
Pourquoi certaines lettres ou certains chiffres sont-ils faux ?
Des caractères petits, flous ou peu contrastés, les ombres et une prise de vue inclinée compliquent la lecture. Vérifiez notamment 0 et O, 1 et l, ou rn et m. Utilisez une source plus nette, recadrez sur le texte ou comparez une extraction automatique à une extraction avec une langue sélectionnée.
Faut-il choisir TXT ou Markdown ?
TXT convient pour coller le texte dans un courriel, un formulaire ou un tableur ; les tableaux reconnus utilisent des cellules séparées par des tabulations. Markdown garde une structure de titres, listes et tableaux, utile pour un éditeur de notes ou un wiki. Choisissez avant l’extraction.
Mon image est-elle envoyée à un tiers ?
Oui. Auto-detect l’envoie à GLM-OCR de Z.ai. Une langue choisie l’envoie à Google Gemini, ou à Gemini via OpenRouter si une limite de requêtes ou de quota est atteinte. Nos fichiers enregistrés suivent la conservation du site : 48 heures pour les invités, 30 jours pour les comptes gratuits et davantage selon l’offre payante.
Que faire si aucun texte n’est extrait ?
Le traitement signale une erreur lorsqu’aucun texte lisible n’est obtenu. Vérifiez que les caractères sont suffisamment grands et nets. Retirez les zones sans rapport avec Recadrer une image, puis relancez l’extraction sur cette source plus claire.