PDF in Word
Estrai il testo di un PDF in un file .docx modificabile. Il PDF viene letto da questa pagina e non viene mai inviato a un server.
Che cosa fa e che cosa non fa
Recupera il testo: l’ordine di lettura, i paragrafi, le interruzioni di pagina e i titoli dove il PDF li compone in corpo maggiore. Non ricostruisce l’impaginazione: colonne, tabelle come tabelle vere, immagini e caratteri non vengono riportati. Se il tuo PDF è una scansione o la foto di un foglio non contiene alcun testo, e questa pagina te lo dirà invece di consegnarti un documento vuoto.
Scegli un PDF da questo dispositivo da convertire.
Nessun limite al numero di file, nessun limite giornaliero e nessuna coda: il lavoro avviene su questa macchina. Scegli un file per il flusso normale, oppure molti per i risultati in blocco e un unico ZIP.
Su questa conversione da PDF a Word
Scegli un PDF fino a 150 MB e convertilo. Lo strato di testo viene letto nella pagina, raggruppato in righe e paragrafi a partire dalle coordinate dei caratteri e scritto in un .docx che porta il nome del tuo PDF. Questo recupera le parole, non la pagina: è un’estrazione di testo, e la pagina lo dice sopra il pulsante.
Un PDF memorizza glifi a delle coordinate, non paragrafi: ordine di lettura, raggruppamento in righe e confini dei paragrafi vanno quindi ricostruiti dalla geometria, e quella ricostruzione è ciò che ottieni. Passano: l’ordine di lettura, i paragrafi, le interruzioni di pagina e i titoli composti in corpo più grande. Non passano: impaginazione, colonne, tabelle come tabelle, immagini e caratteri; chiamare il risultato una conversione anziché un’estrazione sarebbe esagerato. Un PDF senza alcun testo — una scansione, o la foto di un foglio — viene rifiutato dicendolo, invece di restituirti un documento vuoto.
Passo per passo
- 1Scegli il PDFFino a 150 MB. Il file viene aperto nella memoria della scheda.
- 2ConvertiLo strato di testo viene letto e raggruppato in righe e paragrafi secondo le coordinate dei caratteri.
- 3Scarica il .docxIl documento prende il nome del tuo PDF e si apre in Word, LibreOffice o Google Docs.
Cosa sopravvive e cosa no
Sopravvivono: l’ordine di lettura, la divisione in paragrafi, le interruzioni di pagina e i titoli in corpo più grande, marcati come stile titolo.
Non sopravvivono: l’impaginazione, le colonne, le tabelle come tabelle, le immagini e i caratteri originali. Se ti serve il documento identico, nessuno strumento gratuito te lo darà; qui si recuperano le parole, per poterle modificare.
Se il tuo PDF è una scansione
Un PDF scansionato non contiene testo, contiene un’immagine di testo. Lo strumento lo rifiuta dicendolo, invece di consegnarti un .docx vuoto.
In quel caso usa prima l’OCR per PDF, che riconosce i caratteri dentro il browser, e poi converti qui.
Domande frequenti
- Si conserva la formattazione originale?
- No. Si conservano le parole, l’ordine di lettura, i paragrafi e i titoli. Impaginazione, colonne e tabelle no: è un’estrazione di testo, non una riproduzione della pagina.
- Serve registrarsi o lasciare un’email?
- No. Niente account, niente email e nessun invio del risultato per posta, perché il file non lascia mai il tuo browser.
- Funziona con un PDF scansionato?
- Non direttamente: una scansione non ha uno strato di testo e viene rifiutata esplicitamente. Passa prima dall’OCR e riprova.