FileKeeps

OCR de PDF numérisé

Reconnaissez et extrayez le texte de PDF numérisés ou d'images sans couche texte · 100 % traité dans votre navigateur

On-Device

1. Choisir un PDF

2. Langue

Langue de reconnaissance

Les données linguistiques sont téléchargées une seule fois lors de la première utilisation et mises en cache dans votre navigateur. Les fichiers ne sont jamais envoyés vers un serveur.

3. Exécuter

Reconnaît et extrait le texte de PDF scannés ou d'images sans couche de texte. Chaque page est rastérisée et reconnue via tesseract.js ; les fichiers ne sont jamais envoyés vers un serveur.

Ce que vous pouvez faire

  • Extraire le texte de PDF scannés ou de photos
  • Reconnaissance coréen+anglais, anglais, japonais, chinois
  • Visualiser le résultat, le copier ou l'enregistrer en TXT
  • Traitement par lots (30 premières pages)
  • 100 % dans le navigateur — aucun téléchargement

Comment utiliser

  1. 1Ajoutez un PDF scanné
  2. 2Choisissez la langue et cliquez sur « Reconnaître le texte »
  3. 3Copiez le résultat ou téléchargez-le au format TXT

Formats pris en charge · PDF (entrée) → texte / TXT