Prima di tutto: il tuo PDF contiene testo o è una fotografia?
C’è una prova che puoi fare in due secondi: apri il documento e prova a selezionare una parola col cursore. Se si evidenzia, qui funziona. Se non si evidenzia, quella pagina è un’immagine.
È la distinzione che decide tutto, e vale la pena capirla una volta. Un PDF creato da Word, da LaTeX o esportato da un programma contiene le lettere come lettere: si possono cercare, copiare e quindi convertire. Un PDF che viene da uno scanner o da una foto contiene invece l’immagine di una pagina scritta: per un computer è una distesa di pixel in cui non c’è nessuna «a» e nessuna «b».
Per tirare fuori parole da un’immagine serve il riconoscimento ottico dei caratteri, che è un altro mestiere e che questo strumento non fa. Invece di darti un documento Word vuoto o pieno di segni senza senso, te lo diciamo appena aggiungi il file.
Come si converte
- Aggiungi il documento. Uno solo: si lavora su un file alla volta.
- Guarda cosa ti diciamo. In un istante controlliamo se c’è testo da estrarre e quante pagine ne hanno: se il documento è una scansione, lo scopri subito.
- Scarica il .docx e aprilo con Word, LibreOffice o Google Documenti.
Cosa aspettarsi dal risultato
Un documento modificabile, non una fotocopia. Il testo è quello giusto; l’impaginazione è ricostruita, e a volte semplificata.
Un PDF non contiene paragrafi: contiene istruzioni del tipo «scrivi questa parola in questo punto della pagina». Per farne un documento Word bisogna ricomporre quelle istruzioni in righe, le righe in paragrafi, e riconoscere quali righe erano titoli. Su un testo lineare — un libro, una relazione, un contratto, un articolo — il risultato è ottimo. Su impaginazioni complicate lo è meno.
In pratica: due colonne possono diventare una sola, le tabelle possono perdere la griglia e restare testo, e le caselle di testo sparse possono finire in un ordine diverso da quello che vedevi. Se il tuo scopo è riprendere il contenuto e rilavorarlo, va benissimo; se ti serve una copia identica all’originale, il PDF è già quella copia.
Cosa questo strumento non fa
- Non legge le scansioni. Niente riconoscimento ottico: da una pagina fotografata non si estrae testo, e te lo diciamo prima invece di farti aspettare.
- Non riproduce l’impaginazione alla lettera. Ricostruisce paragrafi e titoli; colonne, tabelle e riquadri possono semplificarsi.
- Non incorpora i caratteri originali. Se il font del PDF non è installato sul computer che apre il .docx, Word ne userà uno simile.
- Non converte le immagini in testo né le riposiziona con precisione: l’attenzione è sul contenuto scritto.
- Non apre i PDF protetti da password. Vanno sbloccati prima.
Domande frequenti
Il file viene caricato da qualche parte?
No. Non esiste un server applicativo: il sito è fatto di soli file statici, e la conversione avviene nel tuo browser, sul tuo dispositivo.
Perché il mio PDF risulta «senza testo»?
Perché le sue pagine sono immagini: viene da uno scanner, da una fotografia o da un fax. Provalo tu stesso — se nel tuo lettore non riesci a selezionare una parola col cursore, non c’è testo da estrarre.
Il documento Word sarà identico al PDF?
No, e nessuno strumento può garantirlo: i due formati funzionano in modo diverso. Il testo sarà quello giusto e i paragrafi ricostruiti; su due colonne, tabelle e riquadri aspettati delle semplificazioni.
Posso poi rifare un PDF dal Word?
Sì, ma sarà un PDF nuovo, impaginato da Word: non tornerai al file di partenza. Se ti serve l’originale intatto, conservalo.
Funziona con documenti lunghi?
Sì, ma il lavoro lo fa il tuo dispositivo: su un libro di centinaia di pagine l’attesa si sente, soprattutto da telefono. L’elaborazione si può fermare in qualsiasi momento.
Come faccio a verificare che sia vero?
Apri gli strumenti per sviluppatori, scheda Rete, e converti un documento: vedrai i file di questa pagina e un conteggio anonimo delle visite, e nessuna richiesta che porti con sé il tuo documento.