PDF to Markdown

OCR · PDF scanné

PDF scanné vers Markdown

Extrayez le texte de PDF scannés ou composés uniquement d'images et obtenez du Markdown propre. L'OCR s'exécute entièrement dans votre navigateur — votre fichier ne quitte jamais votre appareil.

100 % privé — les fichiers ne quittent jamais votre navigateur

Déposez un PDF scanné ici, ou

cliquez pour parcourir
Image ou PDF scanné · OCR dans votre navigateur · Max. 50 Mo
Pas de PDF sous la main ?

La première utilisation télécharge un modèle linguistique (~2–15 Mo). Ensuite, cela fonctionne hors ligne — votre fichier est traité localement.

OCR intégré

Lit le texte des PDF scannés et composés uniquement d'images que les convertisseurs classiques ne gèrent pas, alimenté par Tesseract dans votre navigateur.

Plus de 100 langues

Reconnaît l'anglais, le chinois, le japonais, le coréen, l'espagnol, le français, l'allemand, le russe et bien d'autres.

Privé par conception

L'OCR s'exécute localement via WebAssembly. Seul le modèle linguistique est récupéré — votre document ne quitte jamais votre appareil.

Qui l'utilise

Archivistes

Numérisez livres scannés, reçus et anciens documents en Markdown modifiable.

Étudiants

Transformez diapositives de cours photographiées et polycopiés en notes consultables.

Bureaux

Extrayez le texte de contrats et formulaires scannés sans retaper.

Questions fréquentes

Qu'est-ce qu'un PDF scanné ?

Un PDF scanné ou composé uniquement d'images n'a pas de couche de texte sélectionnable — ce sont essentiellement des images de pages. Les convertisseurs classiques ne renvoient rien, l'OCR est donc nécessaire pour lire le texte.

L'OCR est-il gratuit et privé ?

Oui. La reconnaissance s'exécute entièrement dans votre navigateur via WebAssembly. Seul le modèle linguistique est téléchargé depuis un CDN ; votre PDF n'est jamais téléversé.

Quelles langues sont prises en charge ?

Choisissez parmi l'anglais, le chinois simplifié et traditionnel, le japonais, le coréen, l'espagnol, le français, l'allemand, le russe et d'autres avant de commencer.

Pourquoi l'OCR est-il plus lent qu'une conversion normale ?

L'OCR analyse chaque image de page pixel par pixel pour reconnaître les caractères, ce qui est plus lourd que la lecture d'une couche de texte existante. Les documents volumineux prennent plus de temps.

Outils associés