Convertir un PDF texte ou numérisé en Markdown

L’outil lit d’abord la couche texte du PDF. Pour les pages composées uniquement d’une image, l’OCR local prend en charge jusqu’à 20 pages en anglais, espagnol, allemand, japonais ou chinois simplifié. Aucun modèle OCR français n’est proposé : un PDF numérisé en français nécessite un autre outil OCR, tandis qu’un PDF français doté d’une couche texte fonctionne normalement.

Les PDF avec texte utilisent leur couche de texte. Les pages numérisées peuvent être reconnues dans ce navigateur avec l’un des cinq modèles proposés, jusqu’à 20 pages sans texte. Aucun modèle OCR français n’est actuellement inclus.

0 caractères

Aperçu enrichi

Aperçu rendu
Notes du projet

Un document clair commence par une structure précise.

Points à contrôler

  • Des titres faciles à suivre
  • Des liens qui restent valides
  • Des fichiers simples à modifier

Vérifiez l’aperçu rendu avant le téléchargement.

Les fichiers sont traités dans cet onglet du navigateur.

Comment utiliser le convertisseur PDF vers Markdown

Travaillez à partir d’un PDF de 30 Mo maximum comportant jusqu’à 100 pages, puis contrôlez un brouillon Markdown modifiable avant de l’utiliser ailleurs.

01

Ajouter la source

Ouvrez un PDF de 30 Mo maximum comportant jusqu’à 100 pages. Le Markdown extrait restera modifiable.

02

Contrôler la structure

Comparez les titres, les listes, les liens, les tableaux et les caractères particuliers avec la source.

03

Ouvrir le PDF

Générez un brouillon Markdown modifiable, ouvrez le résultat dans son application cible et vérifiez les éléments importants.

Ce que fait l’outil

Un résultat à vérifier avant utilisation

La conversion conserve la structure utile lorsque les deux formats la représentent. Elle ne promet pas une reproduction visuelle à l’identique.

StructureLa couche texte Unicode reste lisible lorsqu’elle existe.
Contenu réutilisableLes coordonnées de page sont regroupées en paragraphes, titres probables et listes.
Résultat contrôlableLes pages sans texte peuvent utiliser l’un des cinq modèles OCR affichés.
Cas d’usage

Quand utiliser PDF vers Markdown

Publier ou livrer

Récupérer le contenu d’un rapport exporté.

Collaborer

Préparer un PDF texte pour analyse ou résumé.

Réutiliser

Obtenir une base modifiable depuis un scan dans une langue OCR compatible.

Questions fréquentes

Que conserve cet outil ?

La couche texte Unicode reste lisible lorsqu’elle existe. Les coordonnées de page sont regroupées en paragraphes, titres probables et listes. Les pages sans texte peuvent utiliser l’un des cinq modèles OCR affichés. Vérifiez néanmoins le résultat dans l’application cible.

Pourquoi le résultat peut-il différer de la source ?

Les formats n’offrent pas les mêmes fonctions. Le modèle OCR français n’est pas disponible dans cette version. Colonnes, tableaux, pieds de page, liens et ordre de lecture peuvent demander une correction.

Comment valider le fichier obtenu ?

Comparez chaque page au PDF et relisez orthographe et structure. Conservez la source jusqu’à la fin de la comparaison.