PDF en Word
Extrayez le texte d’un PDF vers un fichier .docx modifiable. Le PDF est lu par cette page et n’est jamais envoyé à un serveur.
Ce que cela fait, et ce que cela ne fait pas
Il récupère le texte : l’ordre de lecture, les paragraphes, les sauts de page et les titres là où le PDF les compose dans un corps plus grand. Il ne reconstruit pas la mise en page : les colonnes, les tableaux en tant que vrais tableaux, les images et les polices ne sont pas repris. Si votre PDF est un scan ou la photo d’une feuille, il ne contient aucun texte, et cette page vous le dira plutôt que de vous remettre un document vide.
Choisissez un PDF de cet appareil à convertir.
Aucune limite de nombre de fichiers, aucune limite quotidienne, aucune file d’attente : le travail se fait sur cette machine. Choisissez un fichier pour le flux habituel, ou plusieurs pour un traitement par lot et un seul ZIP.
À propos de cette conversion PDF vers Word
Choisissez un PDF de 150 Mo maximum et convertissez-le. La couche de texte est lue dans la page, regroupée en lignes et en paragraphes à partir des coordonnées des caractères, puis écrite dans un .docx portant le nom de votre PDF. Cela récupère les mots, pas la page : c’est une extraction de texte, et la page le dit au-dessus du bouton.
Un PDF stocke des glyphes à des coordonnées, pas des paragraphes : l’ordre de lecture, le regroupement en lignes et les limites de paragraphe doivent donc être reconstruits à partir de la géométrie, et c’est cette reconstruction que vous obtenez. Passent bien : l’ordre de lecture, les paragraphes, les sauts de page et les titres composés dans un corps plus grand. Ne passent pas : la mise en page, les colonnes, les tableaux en tant que tableaux, les images et les polices — parler de conversion plutôt que d’extraction serait exagéré. Un PDF sans aucun texte — un scan, ou la photo d’une feuille — est refusé en le disant, plutôt que de vous rendre un document vide.
Étape par étape
- 1Choisissez le PDFJusqu’à 150 Mo. Le fichier est ouvert dans la mémoire de l’onglet.
- 2ConvertissezLa couche de texte est lue et regroupée en lignes et en paragraphes d’après les coordonnées des caractères.
- 3Téléchargez le .docxLe document reprend le nom de votre PDF et s’ouvre dans Word, LibreOffice ou Google Docs.
Ce qui survit et ce qui ne survit pas
Survivent : l’ordre de lecture, la séparation en paragraphes, les sauts de page et les titres composés plus grand, marqués comme styles de titre.
Ne survivent pas : la mise en page, les colonnes, les tableaux en tant que tableaux, les images et les polices d’origine. S’il vous faut le document à l’identique, aucun outil gratuit ne vous le donnera ; ce qui est récupéré ici, ce sont les mots, pour pouvoir les modifier.
Si votre PDF est un scan
Un PDF scanné ne contient pas de texte mais une image de texte. L’outil le refuse en le disant, au lieu de vous remettre un .docx vide.
Dans ce cas, passez d’abord par l’OCR PDF, qui reconnaît les caractères dans le navigateur, puis revenez convertir ici.
Questions fréquentes
- La mise en page d’origine est-elle conservée ?
- Non. Sont conservés les mots, l’ordre de lecture, les paragraphes et les titres. La mise en page, les colonnes et les tableaux non : c’est une extraction de texte, pas une reproduction de la page.
- Faut-il créer un compte ou donner une adresse e-mail ?
- Non. Ni compte, ni e-mail, ni envoi du résultat par courriel : le fichier ne quitte jamais votre navigateur.
- Cela fonctionne-t-il avec un PDF scanné ?
- Pas directement : un scan n’a pas de couche de texte et il est refusé explicitement. Passez-le d’abord par l’OCR, puis réessayez.