Extraire le texte d'une image avec l'IA (OCR) : le guide complet
Une note manuscrite, un reçu papier, de l'anglais dans une capture d'écran, un panneau sur une photo — le retapage que vous avez toujours fait à la main est, en 2026, presque entièrement inutile grâce à l'IA. Ce guide part de la différence entre l'OCR par IA et l'OCR traditionnel (lire caractère par caractère vs comprendre la page entière par le sens), puis trie trois options (IA conversationnelle généraliste / outils dédiés comme Google Lens / API et OSS tels que Mistral OCR et PaddleOCR-VL) selon l'usage. Il compare ChatGPT (GPT-5.5), Gemini 3.1 Pro et Claude (Opus 4.8) par point fort (manuscrit → famille GPT, structuration de tableaux → famille Claude, nombreuses pages → long contexte de Gemini, OCR brut → modèles spécialisés ; il n'y a pas de champion absolu), donne trois prompts prêts à l'emploi (transcrire sans casser, tableau en Markdown, reçu en JSON, tous avec une règle « ne rien inventer »), le meilleur choix par cas (manuscrit, reçus, PDF, tableaux complexes, texte vertical/ancien, formules et code), six conseils de précision avec la qualité d'image comme 80 % du résultat, et la seule plus grande faiblesse de l'OCR par IA — inventer de façon plausible ce qu'il ne peut pas lire (confrontez toujours montants, dates et noms à l'original) — plus des précautions de confidentialité sur l'envoi de données confidentielles, le droit d'auteur et l'usage pour l'entraînement. Ce que vous pouvez laisser à l'IA, c'est seulement la « lecture » ; confirmer revient à l'humain qui a vu l'original.