OCR de PDF numérisé
Reconnaissez et extrayez le texte de PDF numérisés ou d'images sans couche texte · 100 % traité dans votre navigateur
1. Choisir un PDF
2. Langue
Langue de reconnaissance
Les données linguistiques sont téléchargées une seule fois lors de la première utilisation et mises en cache dans votre navigateur. Les fichiers ne sont jamais envoyés vers un serveur.
3. Exécuter
Reconnaît et extrait le texte de PDF scannés ou d'images sans couche de texte. Chaque page est rastérisée et reconnue via tesseract.js ; les fichiers ne sont jamais envoyés vers un serveur.
Ce que vous pouvez faire
- ✓Extraire le texte de PDF scannés ou de photos
- ✓Reconnaissance coréen+anglais, anglais, japonais, chinois
- ✓Visualiser le résultat, le copier ou l'enregistrer en TXT
- ✓Traitement par lots (30 premières pages)
- ✓100 % dans le navigateur — aucun téléchargement
Comment utiliser
- 1Ajoutez un PDF scanné
- 2Choisissez la langue et cliquez sur « Reconnaître le texte »
- 3Copiez le résultat ou téléchargez-le au format TXT
Formats pris en charge · PDF (entrée) → texte / TXT
Outils associés