Reconnaissance optique de caractères
Une technologie qui transforme des images de texte, scans, photos ou PDF, en données modifiables et recherchables.
La reconnaissance optique de caractères, ou OCR, lit le texte d’une image, page scannée, photo de reçu ou PDF, et le transforme en texte numérique qu’un ordinateur peut rechercher et traiter. Elle existe depuis des décennies, mais l’IA moderne l’a rendue bien plus performante.
L’OCR actuelle ne se contente pas de copier les mots. Les meilleurs modèles fournissent une carte structurée du document : emplacement des blocs, nature de chaque élément, titre, tableau, signature, et niveau de confiance. Certains lisent des dizaines de pages en un passage.
L’OCR est l’une des applications professionnelles les plus utiles et les moins médiatisées de l’IA : transformer factures, contrats et archives en données structurées. Plusieurs bons modèles fonctionnent localement, évitant aux documents sensibles de quitter vos systèmes.
-
Mistral OCR 4.1 peut désormais pointer vers le paragraphe exact qu'il lit
-
Les petits modèles lisent mieux les vieux livres que les grands, et cela coûte deux dollars pour mille pages
-
Comment interroger un PDF de 100 pages et vérifier que ses réponses ne sont pas inventées
-
Microsoft et Mistral s’allient pour construire l’IA en Europe et y conserver les données
-
L’« Unlimited OCR » de Baidu lit des documents de 40 pages d’un seul coup, en apprenant à oublier
-
Cet outil open source dissimule du texte dans des images pour réduire la facture de Claude jusqu’à 70 %