Qu'est-ce que l'OCR, et pourquoi en a-t-on besoin ?
Un PDF scanné n'est en réalité qu'une image de la page — vous voyez le texte, mais vous ne pouvez pas le sélectionner, le chercher ni le copier. L'OCR (reconnaissance optique de caractères) lit ces pixels et reconstruit le vrai texte sous l'image. Le résultat est un PDF identique visuellement, mais désormais cherchable, copiable et compatible avec les lecteurs d'écran.
Pourquoi le faire dans le navigateur ?
La plupart des services d'OCR en ligne envoient votre document sur leurs serveurs — problématique pour un contrat, une pièce d'identité ou tout document privé. iWorkPDF exécute le moteur d'OCR (le logiciel open-source tesseract.js) localement dans votre navigateur. Votre fichier ne quitte jamais votre appareil. Seuls le moteur et le modèle de langue sont téléchargés, comme n'importe quelle application web.
Guide étape par étape
Déposez votre PDF scanné ou votre image
Ouvrez l'outil OCR et déposez un PDF scanné, ou une photo (JPG/PNG) d'un document.
Choisissez la langue
Sélectionnez la langue du document — Auto (anglais + français), anglais ou français. La bonne langue améliore nettement la précision.
Lancez et téléchargez
Cliquez sur « Lancer l'OCR ». La première fois, un petit modèle de langue se télécharge ; ensuite, il faut quelques secondes par page. Vous obtenez un PDF cherchable et un score de confiance de lecture.
Conseils pour de meilleurs résultats
- Utilisez le scan de meilleure qualité possible — des pages nettes, bien éclairées et droites se reconnaissent le mieux.
- Sélectionnez la bonne langue plutôt qu'Auto quand vous la connaissez.
- Les polices très stylisées ou l'écriture manuscrite sont plus difficiles à reconnaître que le texte imprimé.
FAQ
Mon document est-il envoyé quelque part ?
Non. L'OCR s'exécute à 100% dans votre navigateur. Seuls le moteur open-source et le modèle de langue sont récupérés depuis un CDN — votre fichier reste sur votre appareil.
Quelles langues sont prises en charge ?
L'anglais et le français, plus un mode Auto qui gère les deux à la fois.
Pourquoi la première exécution est-elle plus longue ?
La première fois, votre navigateur télécharge le modèle de langue (quelques Mo). Ensuite il est mis en cache, donc les OCR suivants sont plus rapides.