tomai
Connexion
☁️ Cloud · crédits

OCR vers PDF consultable

Transformez des scans et des PDF image en PDF avec texte consultable et sélectionnable — 10 langues

🪙 2 crédits par fichier · images et PDF jusqu'à 20 pages

FFmpeg côté serveur gère tous les formats — y compris les fichiers HEVC/H.265 que votre navigateur ne lit pas. Les fichiers sont supprimés du serveur sous 30 minutes.

Questions fréquentes

En quoi est-ce différent de l'outil OCR classique ?

L'outil OCR classique vous donne le texte reconnu sous forme de fichier .txt. Cet outil conserve les images de page d'origine exactement telles quelles et ajoute une couche de texte invisible en dessous — le résultat reste un PDF qui ressemble à l'original, mais dont vous pouvez désormais sélectionner, copier et rechercher le texte.

Les pages auront-elles un aspect différent ?

Non — les images de page visibles restent inchangées. Seule une couche de texte invisible et consultable est ajoutée en dessous.

Quelles langues sont prises en charge, et combien de pages ?

Chinois simplifié et traditionnel, anglais, japonais, coréen, français, espagnol, allemand, russe et portugais, jusqu'à 20 pages par fichier. Choisissez une option combinée comme « 中文 + English » pour les documents multilingues.

L’OCR change-t-il l’apparence de mon scan ?

Non — la couche image reste préservée à l’octet près. Seule la couche de texte cachée est ajoutée ; les lecteurs l’indexent mais ne l’affichent jamais.

Détails du pipeline OCR

La reconnaissance s’appuie sur Tesseract dans plus de 100 langues avec détection de l’écriture page par page :

Comment ça marche

  1. 1

    Importez un PDF scanné ou une photo/capture d'écran d'un document.

  2. 2

    Choisissez la langue du document (le mélange avec l'anglais est pris en charge).

  3. 3

    Téléchargez le PDF consultable — le texte peut désormais être sélectionné, copié et retrouvé avec Ctrl+F.

Des scans qui se comportent comme de vrais documents

Les pages image reçoivent une couche de texte invisible et recherchable en dessous — copier-coller et Ctrl+F fonctionnent tandis que le visuel reste intact.

🔎

Les scans deviennent recherchables

Une page scannée est stockée comme image dans le PDF, et cet outil ajoute une couche de texte recherchable par-dessus, pour que le fichier se cherche comme un document numérique.

📄

Couche de texte invisible

Le texte repose invisiblement sous chaque page, prêt pour Ctrl+F, la sélection et le copier-coller, tandis que le scan visible reste exactement tel qu'il a été numérisé.

🔗

Garde l’apparence d’origine

Au plus 20 pages d'images ou de PDF sont traitées en un seul travail, et la sortie conserve la mise en page d'origine au lieu de recomposer le document.

Outils associés

Qu'est-ce qu'un PDF consultable ?

Un PDF consultable ressemble exactement à votre scan mais porte une couche de texte invisible sous l'image de page : le document devient donc consultable, sélectionnable et copiable dans n'importe quel lecteur PDF, tandis que la page reste visuellement identique au scan d'origine. Cet outil construit cette couche avec l'OCR côté serveur : envoyez une image scannée ou un PDF purement image, choisissez parmi 10 langues, et Tesseract lit les pages et écrit un nouveau PDF avec le texte reconnu incorporé de façon invisible sous les images de page d'origine. Vous pouvez ensuite rechercher un mot-clé dans un contrat, sélectionner une phrase, copier un paragraphe ou laisser un logiciel indexer le fichier. Il est fait pour les archivistes qui numérisent des registres papier, les avocats et comptables qui scannent des contrats, et tous ceux dont le scanner produit de beaux PDF non consultables. L'outil demande un compte et consomme des crédits.

Ce que cet outil sait faire

  • Ajouter une couche de texte invisible mais sélectionnable aux scans et PDF purement images
  • Reconnaître 10 langues, du chinois simplifié et traditionnel à l'anglais, le japonais, le coréen, le français, l'espagnol, l'allemand, le russe et le portugais
  • Garder les images de page d'origine exactement comme scannées — rien ne change visuellement
  • Traiter les documents multipages en un passage vers un seul PDF consultable
  • Permettre la sélection et la copie du texte dans n'importe quel lecteur PDF
  • Télécharger le PDF consultable fini directement depuis la page

Quand l'utiliser

  • Rendre un contrat scanné consultable pour trouver des clauses par mot-clé
  • Construire des archives numériques consultables de documents papier et de reçus
  • Convertir des notes de cours scannées en un document que vous pouvez citer
  • Préparer des formulaires ou pièces scannés pour la recherche et la citation
  • Envoyer à un client un PDF où il sélectionne le texte au lieu de plisser les yeux sur le scan

Confidentialité et limites : l'OCR tourne sur le VPS du site — vos scans sont envoyés pour traitement puis supprimés à la fin du travail. L'outil demande un compte et consomme des crédits. La qualité de reconnaissance reflète la source : des scans propres, droits et contrastés donnent une couche de texte quasi parfaite, tandis que les pages de faible qualité ou manuscrites peuvent cacher des erreurs dans le texte invisible — vérifiez les documents importants après conversion.

Dernière mise à jour · 2026-09-01

Outils associés