Reconnaissez le texte dans les fichiers PDF scannés ou les images grâce à l'OCR.
Lire le tutoriel →Conçu pour la rapidité, la confidentialité et la simplicité.
Traitez vos fichiers en quelques secondes avec notre moteur optimisé
Fichiers traités localement, jamais téléversés sur des serveurs
Utilisez-le sur tout appareil, tout navigateur, à tout moment
Transformez les PDF numérisés en texte sélectionnable et recherchable. Parce que taper depuis des captures d'écran, c'est pas amusant.
Vous avez un PDF numérisé sur lequel vous ne pouvez pas sélectionner ou rechercher le texte ? L'OCR (Reconnaissance Optique de Caractères) corrige ça en reconnaissant le texte et en le rendant numérique.
Les logiciels d'OCR de bureau étaient autrefois chers et compliqués. Vous achetiez une boîte d'ABBYY FineReader ou d'Adobe Acrobat Pro, vous l'installiez, vous vous battez avec les paramètres, et vous attendiez une éternité pendant que ça traitait. De nos jours, vous n'avez plus besoin de tout ça. Un outil d'OCR en ligne est plus rapide, plus simple et gratuit. Il suffit de déposer votre fichier et ça fait son travail. Le meilleur atout de l'OCR de PDFNeo, c'est qu'il s'exécute entièrement dans votre navigateur. Votre document numérisé n'est jamais téléchargé sur un serveur. Réfléchissez-y — si vous faites de l'OCR sur un contrat confidentiel, des dossiers médicaux ou des documents personnels, voulez-vous vraiment les envoyer dans le cloud d'une entreprise pour traitement ? Bien sûr que non. Le traitement local signifie une confidentialité totale. Et ça marche sur n'importe quel appareil avec un navigateur. Téléphone, tablette, Chromebook — tout.
Rendre les documents numérisés recherchables. Vous avez numérisé une pile de documents papier et maintenant ce ne sont que des PDF image. Vous ne pouvez pas rechercher un nom, vous ne pouvez pas copier un paragraphe, vous ne trouvez rien. L'OCR les transforme en vrais PDF recherchables.
Extraire du texte d'images ou de captures d'écran. Vous avez une capture d'écran de texte ou une photo d'un tableau blanc avec des notes et vous voulez le texte réel. L'OCR lit le texte de l'image pour que vous puissiez le copier et le coller quelque part d'utile.
Numériser de vieilles archives papier. Vous avez des cartons de vieux documents — factures, contrats, lettres — et vous voulez les numériser pour pouvoir retrouver les choses. Numérisez-les tous, passez l'OCR, et soudain vous pouvez chercher des années de papier en quelques secondes.
Rendre les PDF accessibles. Les PDF numérisés ne sont pas accessibles aux lecteurs d'écran parce qu'il n'y a pas de vrai texte, juste des images de texte. L'OCR ajoute la couche de texte dont les technologies d'assistance ont besoin pour lire le document à voix haute.
Nettoyez vos numérisations d'abord. Meilleure est la qualité de l'image d'entrée, meilleurs sont les résultats OCR. Redressez les pages penchées, enlevez la poussière et les petits points, assurez-vous que le texte est net. Un peu de nettoyage avant l'OCR évite beaucoup de corrections après.
Connaissez la langue de votre document. L'OCR fonctionne mieux quand elle sait quelle langue attendre. Si votre document est en espagnol, en allemand ou dans n'importe quelle langue autre que l'anglais, les résultats pourraient être moins précis. La plupart des moteurs OCR sont d'abord optimisés pour l'anglais.
Relisez le résultat, surtout pour les documents importants. L'OCR est bonne — vraiment bonne de nos jours — mais ce n'est pas parfait. Les chiffres, les lettres qui se ressemblent (l contre 1, O contre 0) et les polices inhabituelles peuvent la tromper. Vérifiez toujours le texte critique comme les noms, les dates et les montants.
Commencez par la résolution la plus haute que vous ayez. L'OCR a besoin de texte clair pour fonctionner. Si vous avez le choix entre une numérisation à 72 DPI et une à 300 DPI, prenez celle à 300 DPI à chaque fois. La différence de précision est le jour et la nuit.
Pour des numérisations propres et de haute qualité avec des polices standard, la précision est généralement de 95 à 99 %. Pour des numérisations de moindre qualité, du texte manuscrit ou des polices inhabituelles, la précision diminue. Relisez toujours les documents importants.
Pas bien. L'OCR est conçue pour le texte imprimé. L'écriture manuscrite varie trop d'une personne à l'autre. Tenez-vous-en aux documents dactylographiés ou imprimés pour de meilleurs résultats.
Non. Tout s'exécute localement dans votre navigateur à l'aide de bibliothèques OCR JavaScript. Votre document ne quitte jamais votre appareil. Fermez l'onglet et il disparaît de la mémoire.
Pas du tout. L'OCR ajoute une couche de texte invisible par-dessus l'image originale. L'image numérisée elle-même reste exactement telle quelle. Vous voyez toujours le document original — vous pouvez juste maintenant sélectionner le texte dessus.
Le moteur OCR fonctionne mieux avec l'anglais. Il peut gérer d'autres langues à écriture latine avec des degrés de précision variables. Les écritures non latines comme le chinois, l'arabe ou le japonais peuvent avoir une prise en charge limitée.
Pour l'instant, l'outil fait de l'OCR sur l'ensemble du document. Si vous n'avez besoin que d'une page, extrayez d'abord cette page avec l'outil d'extraction, puis lancez l'OCR seulement sur cette page.
Ça dépend de la longueur et de la qualité du document. Une seule page peut prendre quelques secondes. Un livre de 100 pages peut prendre quelques minutes. La vitesse de traitement de votre appareil joue aussi.