Toutes les news taguées avec ce sujet.
Un nouveau corpus de 343 000 paires image-texte vise à combler le retard de l'OCR pour la langue persane, complexe et sous-dotée en données.
Une solution de reconnaissance optique de caractères performante et prête à l'emploi.
DeepSeek annonce DeepSeek-OCR, un modèle performant pour l'extraction de texte à partir d'images.
Pleias publie un modèle spécialisé dans le nettoyage et la correction de textes numérisés issus de documents patrimoniaux.
Le laboratoire français met à jour son moteur OCR, promettant une meilleure précision sur documents complexes et multilingues.