Convertisseur PDF vers Excel

Extrayez le texte d'un PDF vers les lignes et colonnes d'un fichier Excel (.xlsx), directement dans votre navigateur.

Cet outil fonctionne entièrement dans votre navigateur. Vos fichiers ne sont jamais envoyés à un serveur.

Drop a PDF here or click to upload

Ce que fait cet outil

Extrait le texte de chaque page avec sa position sur la page, regroupe les éléments partageant une ligne dans une même rangée, et regroupe les éléments séparés par un large espace horizontal dans des colonnes distinctes — puis enregistre le résultat sous forme de feuille de calcul .xlsx.

Mode d'emploi

Déposez ou sélectionnez un fichier PDF. L'outil analyse les positions du texte de chaque page et génère un fichier .xlsx prêt à télécharger, avec une ligne vide insérée entre chaque page PDF d'origine.

Exemple expliqué

Importez invoice.pdf (une page avec une simple liste à deux colonnes de noms d'articles et de prix) et vous obtenez invoice.xlsx, avec chaque nom d'article en colonne A et son prix en colonne B, une ligne par ligne.

Comment les lignes et colonnes sont détectées

Il s'agit d'une heuristique basée sur la position, pas d'une véritable reconnaissance de tableau : le texte à peu près à la même position verticale devient une ligne, et au sein d'une ligne, un espace plus large qu'un petit seuil entre deux fragments de texte démarre une nouvelle colonne. Cela fonctionne bien pour des tableaux et listes simples alignés sur une grille.

Quand cela ne fonctionnera pas bien

Les mises en page complexes — articles à plusieurs colonnes, PDF avec des cellules de tableau fusionnées ou pivotées, ou texte non aligné sur une grille propre — seront extraites en lignes et colonnes qui ne correspondront pas à la structure visuelle du tableau. Vérifiez le résultat et ajustez-le manuellement pour tout ce qui dépasse un tableau simple.

Limites

Les PDF scannés (des pages qui sont des images de texte, sans véritable couche de texte) produisent des lignes vides, car cet outil ne fait pas d'OCR. Chaque valeur est extraite sous forme de texte brut — les nombres ne sont pas convertis au type numérique d'Excel, donc les formules qui s'y réfèrent peuvent nécessiter un reformatage préalable.

Confidentialité

La lecture du PDF et la génération de la feuille de calcul se font entièrement dans votre navigateur, à l'aide de pdf.js pour l'extraction du texte. Votre fichier n'est jamais envoyé à un serveur.

Questions Fréquentes

Cela extraira-t-il correctement n'importe quel tableau d'un PDF ?
Pas toujours — cela utilise une heuristique basée sur la position (même ligne = rangée, large espace horizontal = nouvelle colonne) qui fonctionne bien pour des tableaux simples alignés sur une grille, mais peut mal interpréter des mises en page complexes ou irrégulières.
Cela fonctionnera-t-il avec un PDF scanné ?
Non — une page scannée n'a pas de véritable couche de texte à lire, seulement des pixels, ce qui produit des lignes vides ; il vous faudrait plutôt un outil d'OCR.
Les nombres sont-ils extraits comme de vrais nombres ?
Non — chaque cellule est extraite sous forme de texte brut, vous devrez peut-être donc convertir les cellules ressemblant à des nombres au format numérique d'Excel avant de les utiliser dans des formules.