Comment rendre un PDF numérisé interrogeable sur Mac
Aperçu et Texte en direct savent lire le texte d'une page numérisée, mais ils ne l'enregistrent pas dans le PDF : la recherche et Spotlight n'y voient toujours qu'une image. OCR PDF de File Acture reconnaît le texte sur votre Mac et l'intègre sous forme de calque invisible, ce qui vous donne une copie interrogeable identique au scan.
Mise à jour le 23 septembre 20266 min de lectureTesté avec File Acture 1.0.9 sur macOS 26
Par l'équipe File Acture
Vous avez numérisé une pile de reçus ou un contrat signé, et voilà que Commande-F ne trouve rien. C'est que le scanner a enregistré chaque page comme une image. L'OCR, pour reconnaissance optique de caractères, lit les lettres de cette image et les stocke comme du vrai texte : le fichier devient interrogeable sans changer d'apparence.
Pourquoi ne peut-on ni chercher ni copier le texte d'un PDF numérisé ?
Vous ne pouvez pas faire de recherche dans un PDF numérisé parce qu'il contient une photo de chaque page, et non les lettres elles-mêmes. Les scanners à plat, les applications de numérisation sur téléphone et les photocopieurs de bureau enregistrent en général les pages ainsi, sauf s'ils font de l'OCR pendant la numérisation.
Le résultat ressemble à un document mais se comporte comme un album photo. Commande-F dans Aperçu ne trouve rien, Spotlight ne peut pas retrouver le fichier d'après son contenu, vous ne pouvez pas copier un numéro de compte dans un e-mail, et les lecteurs d'écran n'ont rien à lire.
Aperçu peut-il faire l'OCR d'un PDF sur Mac ?
Aperçu ne sait pas ajouter de calque de texte à un PDF, il ne peut donc pas rendre un scan interrogeable. Texte en direct, dans macOS, vous laisse sélectionner du texte à l'intérieur des images, ce qui dépanne bien pour récupérer un numéro de téléphone ou une adresse.
L'ennui, c'est que rien n'est écrit dans le fichier. Spotlight, les autres applications et la personne à qui vous envoyez le PDF reçoivent toujours une image. Pour un document que vous fouillerez plus tard ou que vous confierez à quelqu'un, le texte doit être intégré au PDF lui-même.
Comment faire l'OCR d'un PDF sur Mac avec File Acture
OCR PDF de File Acture passe la reconnaissance de texte Vision d'Apple sur chaque page numérisée et intègre le résultat en calque de texte invisible par-dessus l'image d'origine. La page a exactement la même allure qu'avant, mais vous pouvez y chercher, sélectionner des lignes et les copier.
Vous choisissez la Langue du document : Détection automatique, ou l'une des suivantes : anglais, turc, allemand, français, espagnol, italien, portugais, russe, chinois, japonais et coréen. Précision propose Précis, la valeur par défaut, qui lit plus soigneusement, et Rapide, qui convient aux longues séries de pages imprimées et propres. Les pages qui contiennent déjà du texte sont recopiées telles quelles : un PDF mêlant pages saisies et pages numérisées ne se retrouve donc pas avec du texte en double.
Un PDF protégé par mot de passe fait apparaître un champ Mot de passe, et la copie interrogeable est de nouveau protégée par le même mot de passe. Le titre, l'auteur, le sujet et les mots-clés du document sont conservés, et chaque copie est enregistrée avec « -searchable » ajouté à son nom. Vous pouvez traiter plusieurs PDF en une fois, et vos fichiers d'origine restent inchangés.
Comment vérifier que l'OCR a fonctionné ?
Ouvrez la copie interrogeable et appuyez sur Commande-F : les mots visibles sur la page devraient se surligner à leur place. Vous pouvez aussi glisser sur une ligne pour la sélectionner, ou coller un paragraphe copié dans une note pour voir exactement ce qui a été reconnu. Spotlight indexe le texte des PDF : une fois son travail fait, taper une phrase du document retrouve le fichier.
Conseils pour de meilleurs résultats OCR sur Mac
L'OCR ne vaut que ce que vaut le scan : des pages droites et nettes donnent le meilleur texte.
- Choisissez la langue. La Détection automatique convient à beaucoup de documents, mais indiquer la langue dit au moteur à quoi s'attendre, ce qui compte surtout pour le chinois, le japonais, le coréen et le russe.
- Numérisez à 300 ppp. Si vous maîtrisez le scanner, 300 ppp est un bon réglage pour du texte. Beaucoup plus bas, les petits caractères deviennent des formes floues difficiles à lire.
- Redressez les pages d'abord. Remettez les pages couchées à l'endroit avec Faire pivoter les pages avant de lancer l'OCR.
- Des photos de documents ? Réunissez-les dans un seul PDF avec Images en PDF, puis lancez l'OCR sur le résultat.
- Gardez l'original. La copie OCR est redessinée page par page : les liens, les signets et les champs de formulaire ne suivent pas.
- Surveillez la taille du fichier. L'OCR ajoute du texte, il ne réduit pas les images. Si la copie est trop lourde à envoyer, passez-la dans Compresser un PDF : le calque de texte reste en place.
Est-il sûr de faire de l'OCR en ligne ?
Les services d'OCR en ligne ont besoin de votre document sur leurs serveurs, ce qui compte pour des relevés bancaires, des courriers médicaux et des copies de pièces d'identité. File Acture fait la reconnaissance de texte sur votre Mac, les pages ne le quittent donc jamais, et Pro fonctionne sans connexion Internet et ne se connecte que de temps en temps pour renouveler sa licence.
La version gratuite comprend 3 utilisations sur chaque Mac, avec jusqu'à 5 PDF par utilisation. Pour de longues archives de scans, consultez les tarifs.
Comment rendre un PDF numérisé interrogeable avec File Acture
- 1
Ouvrez OCR PDF
Choisissez OCR PDF dans la barre latérale et faites glisser vos PDF numérisés, ou cliquez sur Choisir des fichiers….
- 2
Réglez la langue
Sous Reconnaissance, prenez la Langue du document et laissez Précision sur Précis.
- 3
Saisissez le mot de passe si on le demande
Si un PDF est protégé, tapez son mot de passe dans le champ Mot de passe qui apparaît.
- 4
Lancez la reconnaissance
Cliquez sur Reconnaître le texte. Chaque copie est enregistrée avec « -searchable » dans son nom.
- 5
Vérifiez le résultat
Ouvrez la copie, appuyez sur Commande-F et cherchez un mot que vous voyez sur la page.
Transformez vos PDF numérisés en PDF interrogeables, sur votre Mac.
Gratuit à l'essai · macOS 14 ou version ultérieure
| Méthode | Enregistre un PDF interrogeable | Plusieurs fichiers à la fois | Reste sur votre Mac |
|---|---|---|---|
| Texte en direct | Non | Non, une sélection à la fois | Oui |
| Aperçu | Non | Non, il n'a pas d'OCR | Oui |
| Sites OCR en ligne | Oui | Variable | Non, le fichier est envoyé |
| File Acture, OCR PDF | Oui | Oui | Oui |
Questions
Aperçu peut-il rendre un PDF interrogeable ?
Non. Aperçu sait afficher et annoter les PDF, et Texte en direct sait copier du texte depuis des images, mais ni l'un ni l'autre n'enregistre de calque de texte dans le fichier.
L'OCR change-t-il l'apparence de mon PDF ?
Non. Le texte reconnu est invisible et se place au-dessus de l'image de la page d'origine : les pages gardent la même allure pendant que la recherche et la copie fonctionnent.
Quelles langues File Acture reconnaît-il ?
L'anglais, le turc, l'allemand, le français, l'espagnol, l'italien, le portugais, le russe, le chinois, le japonais et le coréen. Vous pouvez aussi laisser la Détection automatique.
Pourquoi du texte manque-t-il après l'OCR ?
Un texte flou, minuscule ou couché peut ne pas être reconnu. Remettez les pages à l'endroit, renumérisez à une résolution plus élevée si vous le pouvez, et laissez Précision sur Précis.
Peut-on faire l'OCR d'un PDF protégé par mot de passe ?
Oui, si vous connaissez le mot de passe. Saisissez-le dans le champ Mot de passe, et la copie interrogeable est protégée par le même mot de passe.
L'OCR conserve-t-il les liens et les signets ?
Non. Les pages sont redessinées avec le calque de texte : les liens, les signets et les champs de formulaire ne suivent pas. Gardez votre original pour cela.