OCR PDF
Transformez un PDF numérisé en un document consultable ou un fichier texte brut. La reconnaissance s'exécute localement et conserve vos pages PDF originales inchangées.
- 1Télécharger
- 2Paramètres
- 3Processus
- 4Télécharger
Paramètres
Maintenez Ctrl ou Cmd pour sélectionner plusieurs langues.
Convertir les pages numérisées en PDF consultable ou en texte brut
Choisissez une sortie qui correspond à ce que vous devez faire ensuite. Un PDF consultable conserve les pages originales disponibles pour visualisation tout en facilitant la recherche du texte reconnu, tandis que le texte brut est préférable lorsque vous souhaitez principalement extraire des mots pour des notes, des modifications ou une réutilisation.
Sélectionnez la bonne langue avant la reconnaissance
Le choix de la langue utilisée dans le document aide le moteur OCR à interpréter plus précisément les lettres, les accents, la ponctuation et les modèles de mots. Plusieurs langues peuvent être sélectionnées pour les PDF contenant du texte bilingue ou des sections écrites dans différentes langues.
Conserver l'apparence de la page d'origine
OCR se concentre sur la reconnaissance des mots affichés sur chaque page plutôt que sur la refonte du document. Les pages PDF originales restent visuellement inchangées, ce qui rend la sortie PDF consultable adaptée lorsque vous souhaitez conserver les numérisations, les signatures, les tampons, les illustrations et le formatage de page existant.
Foire aux questions
Pourquoi le langage OCR est-il important ?
Les langues utilisent différents jeux de caractères, accents, règles de ponctuation et modèles de mots. La sélection de la bonne langue donne au moteur de reconnaissance un meilleur contexte. Une langue incompatible peut entraîner l'interprétation de caractères valides comme des lettres ou des symboles d'apparence similaire.
Puis-je reconnaître un PDF contenant plusieurs langues ?
Oui. Le sélecteur de langue permet de choisir plusieurs langues. Sélectionnez toutes les langues qui apparaissent de manière significative dans le document, mais évitez d'ajouter des langues sans rapport, car une sélection plus ciblée peut réduire l'ambiguïté lors de la reconnaissance.
Pourquoi certains mots sont-ils mal reconnus ?
Les erreurs de reconnaissance sont plus probables lorsque les pages sont floues, inclinées, de faible résolution, fortement compressées, tachées, pâles ou photographiées sous un éclairage inégal. Les polices inhabituelles, le texte sur les images, les colonnes étroites, les tampons et les notes manuscrites peuvent également rendre les caractères plus difficiles à identifier.
OCR peut-il reconnaître un texte manuscrit ?
OCR est généralement plus fiable avec un texte clair imprimé ou dactylographié. Une écriture soignée peut être partiellement reconnue, mais les résultats peuvent varier considérablement selon les styles d'écriture. Les noms, signatures, notes et numéros manuscrits doivent être vérifiés manuellement plutôt que traités comme des transcriptions exactes.
Fractionner le PDF
Fusionner le PDF
Organiser le PDF
Extraire les pages
Supprimer des pages
Outil multifonction PDF
Compresser le PDF
Réparer le PDF
OCR PDF
PDF vers Word
PDF vers Excel
PDF vers PowerPoint
PDF en images
PDF en JPG
PDF en PNG
PDF vers WebP
PDF en PDF/A
Pixelliser le PDF
Word en PDF
Excel vers PDF
PowerPoint en PDF
Images au format PDF
JPG en PDF
PNG en PDF
WebP en PDF
PSD en PDF
HEIC en PDF
Markdown à PDF
EPUB en PDF
MOBI en PDF
FB2 en PDF
CBZ en PDF
DJVU en PDF
XPS en PDF
ODT en PDF
RTF en PDF
TIFF en PDF
Rotation du PDF
Ajouter des numéros de page
Ajouter un filigrane
Recadrer le PDF
Créateur de formulaire
Modifier le PDF
Protéger le PDF
Déverrouiller le PDF
Signer le PDF