Faire la reconnaissance OCR d'un PDF numérisé en toute confidentialité — reconnaissez le texte dans votre navigateur

Sélectionnez un PDF numérisé et une langue ; chaque page est restituée et reconnue localement par Tesseract (compilé en WebAssembly), et le texte reconnu s'affiche et peut être téléchargé sous forme de fichier .txt.

Quick answer

What it does
Sélectionnez un PDF numérisé et une langue ; chaque page est restituée et reconnue localement par Tesseract (compilé en WebAssembly), et le texte reconnu s'affiche et peut être téléchargé sous forme de fichier .txt.
Free?
Yes — 100% free, no account or sign-up.
Files uploaded?
No — everything is processed in your browser.
Works offline?
Yes — once the page has loaded.
Best for
Un(e) comptable applique l'OCR sur une facture numérisée pour copier les montants ligne par ligne dans un tableur sans ressaisir.
Good to know
L'anglais et le chinois traditionnel sont pris en charge dans cette version.

How it works

  1. Sélectionnez un PDF numérisé sur votre appareil et choisissez la langue du document.
  2. Le fichier est chargé en mémoire du navigateur — aucune donnée ne quitte votre navigateur.
  3. pdf.js restitue chaque page en image dans un Web Worker.
  4. Tesseract OCR — compilé en WebAssembly et servi depuis ce site — reconnaît localement le texte de chaque page ; le modèle de langue est lui aussi chargé depuis ce site, et non depuis un CDN tiers.
  5. Le texte reconnu s'affiche page par page et est proposé au téléchargement en fichier .txt.

When to use this tool

  • Un(e) comptable applique l'OCR sur une facture numérisée pour copier les montants ligne par ligne dans un tableur sans ressaisir.
  • Un(e) étudiant(e) applique l'OCR sur un document de cours numérisé pour obtenir un texte consultable et copiable pour ses notes.
  • Un(e) archiviste convertit des documents en chinois traditionnel numérisés en texte consultable pour une bibliothèque numérique.
  • La précision de l'OCR dépend de la qualité de la numérisation — les pages floues, inclinées ou basse résolution peuvent produire des erreurs ; considérez le résultat comme un brouillon au mieux de l'effort.

Frequently asked questions

En quoi cet outil diffère-t-il des autres outils PDF en ligne ?
La plupart des outils PDF en ligne envoient vos fichiers vers un serveur distant pour les traiter. Cet outil traite tout localement dans votre navigateur, en JavaScript côté client. Vos fichiers ne sont transmis à aucun serveur, ce qui veut dire que le contenu de vos documents reste sous votre contrôle.
Mes fichiers PDF sont-ils envoyés sur un serveur ?
Non. Vos fichiers sont lus directement par votre navigateur. Vos fichiers ne sont jamais transmis sur le réseau. L'outil fonctionne entièrement dans l'onglet de navigateur que vous avez ouvert.
Puis-je vérifier que les fichiers ne sont pas envoyés ?
Oui. Ouvrez les outils de développement de votre navigateur (F12), allez dans l'onglet Réseau, puis surveillez les requêtes sortantes pendant que vous utilisez l'outil. Vous verrez qu'aucune donnée de fichier ne quitte votre navigateur. Le site peut enregistrer un comptage anonyme des pages vues, qui n'inclut jamais vos fichiers et peut être désactivé.
Cet outil fonctionne-t-il hors ligne ?
Oui. Une fois la page chargée, l'outil traite vos fichiers entièrement dans votre navigateur ; les fonctionnalités de l'outil ne nécessitent aucune connexion réseau. Vous pouvez vous déconnecter d'Internet et continuer à l'utiliser.
Que se passe-t-il si j'actualise la page ?
Comme rien n'est stocké sur un serveur, actualiser la page réinitialise votre session en cours. Les fichiers que vous aviez sélectionnés devront l'être à nouveau.
Cet outil conserve-t-il mes fichiers ?
Non. Les fichiers ne restent en mémoire du navigateur que tant que la page est ouverte. Fermer ou actualiser la page les supprime. L'outil n'écrit rien sur le disque et n'envoie rien à un serveur.
Cet outil peut-il déverrouiller les PDF protégés par mot de passe ?
Non. Cet outil ne tente pas de retirer ni de contourner la protection par mot de passe d'un PDF. Si vous connaissez le mot de passe, l'outil Déverrouiller un PDF de ce site peut le retirer localement ; cet outil pourra ensuite traiter le fichier.
Quelles technologies cet outil utilise-t-il ?
Cet outil utilise pdf.js pour restituer les pages et le moteur OCR Tesseract compilé en WebAssembly (tesseract.js) exécuté dans un Web Worker de même origine — vos fichiers ne quittent jamais votre navigateur.
Cet outil utilise-t-il WebAssembly ?
Oui — c'est l'un des rares outils ici à le faire. Le moteur OCR Tesseract est du C++ compilé en WebAssembly et s'exécute dans votre navigateur ; le binaire .wasm est servi depuis ce site et rien n'est envoyé où que ce soit.
Pourquoi la première exécution est-elle plus lente que les suivantes ?
À la première utilisation, votre navigateur télécharge le moteur OCR et le modèle de langue depuis ce site (quelques mégaoctets) et les compile. Ils sont ensuite mis en cache, de sorte que les exécutions suivantes démarrent beaucoup plus vite.
Comment appliquer l'OCR à un PDF numérisé ici ?
Choisissez un PDF numérisé sur votre appareil, sélectionnez la langue du document (anglais ou chinois traditionnel), puis cliquez sur Reconnaître. Chaque page est rendue et lue localement et, une fois l'opération terminée, vous pouvez prévisualiser le texte et l'enregistrer dans un fichier .txt.
Pourquoi le texte reconnu est-il un simple fichier .txt au lieu d'un PDF consultable ?
Cet outil produit les mots reconnus sous forme de texte brut plutôt que d'écrire une couche de texte invisible dans le PDF, si bien que votre PDF numérisé d'origine reste inchangé. Si vous avez besoin des mots à l'intérieur de la page, vous les copieriez depuis le fichier .txt enregistré ou depuis l'aperçu à l'écran, qui liste le texte page par page.
Puis-je traiter deux langues dans le même document, et que se passe-t-il si je choisis la mauvaise ?
Vous sélectionnez une seule langue pour l'ensemble du document avant la reconnaissance ; un fichier mêlant anglais et chinois traditionnel privilégiera donc celle que vous avez choisie. La qualité de la reconnaissance dépend aussi de la numérisation elle-même : les pages inclinées, à basse résolution ou manuscrites tendent à donner de mauvais résultats, quelle que soit la langue.
L'outil OCR PDF est-il gratuit ?
L'outil OCR PDF est entièrement gratuit — aucun compte, aucune inscription, et aucune limite sur le nombre de PDF numérisés traités, et ce sera toujours ainsi. Chaque page est reconnue directement dans votre navigateur grâce au moteur OCR Tesseract compilé en WebAssembly, de sorte que vos documents numérisés — qu'il s'agisse de contrats, de pièces d'identité ou de dossiers médicaux — ne sont jamais envoyés nulle part.

Related tools

  • Extraire le texte
  • Comptage de mots
  • PDF vers images
  • Compresser le PDF
  • Éditeur PDF tout-en-un
  • Accueil
  • Éditeur PDF tout-en-un
  • Fusionner des PDF
  • Diviser le PDF
  • Faire pivoter le PDF
  • Ajouter un filigrane
  • Images vers PDF
  • PDF vers images
  • Numéros de page
  • Compresser le PDF
  • Extraire le texte
  • Modifier les métadonnées
  • Organiser les pages
  • Insérer des pages blanches
  • Extraire des pages
  • N-up (pages par feuille)
  • PDF en niveaux de gris
  • Rogner le PDF
  • Inverser les pages
  • Redimensionner (A4/Letter)
  • Ajouter en-tête et pied de page
  • Aplatir le formulaire
  • Diviser toutes les N pages
  • Infos et métadonnées du PDF
  • Apposer image / signature
  • Supprimer des pages
  • Filigrane en mosaïque
  • Livret
  • Dupliquer des pages
  • Joindre un fichier
  • Mettre à l'échelle en pourcentage
  • Supprimer les pages blanches
  • Fusion entrelacée
  • Ajouter une bordure de page
  • Extraire les pages paires / impaires
  • PDF vers image longue
  • Diviser les pages en deux
  • Ajouter des marges
  • Signer le PDF
  • Comparer les PDF
  • Découpe en poster
  • Comptage de mots
  • Réparer le PDF
  • Remplir un formulaire PDF
  • Diviser par signets
  • Rechercher et surligner
  • Extraire les images
  • Caviarder le PDF
  • OCR (numérisé vers texte)
  • Protéger le PDF
  • Déverrouiller le PDF
  • À propos
  • Politique de confidentialité
  • Contact
  • Comment ça fonctionne
  • Outils PDF locaux ou en ligne
  • Les outils PDF en ligne sont-ils sûrs ?