Salta al contenuto
Torna a tutti gli strumenti
Converti

Estrai testo

Estrae tutto il testo selezionabile da un PDF in un file .txt da cercare e riutilizzare.

0 B caricati su un server

Copiare a mano il testo da un PDF fa perdere l'ordine di lettura appena l'impaginazione ha più di una colonna. L'estrazione legge gli oggetti di testo e ricostruisce il flusso, così quello che ottieni è il contenuto del documento e non un miscuglio di frammenti di colonna.

Funziona sui PDF che contengono testo reale. Una scansione non ne ha, quindi passala prima dall'OCR.

Come funziona

  1. Apri il PDF.
  2. Lascia leggere il livello di testo e ricostruire l'ordine di lettura.
  3. Controlla il testo estratto.
  4. Copialo oppure scaricalo come file di testo semplice.

Quando si usa

  • Portare il contenuto di un documento dentro un'app per appunti o un editor.
  • Contare le parole o cercare dentro un report lungo offline.
  • Preparare il testo per una traduzione o una sintesi.

Domande frequenti

Il mio file viene caricato su un server?
No. Il file viene aperto da JavaScript e WebAssembly che girano nella scheda del tuo browser. Non viene caricato da nessuna parte, non c'è elaborazione lato server e non viene conservato nulla: chiudendo la scheda sparisce tutto.
Non è stato estratto nulla.
Il PDF non ha un livello di testo: è una scansione o un'immagine esportata. Passalo prima dallo strumento OCR per crearne uno.
L'ordine del testo è sbagliato.
Le impaginazioni complesse con barre laterali, citazioni in evidenza e note sono ambigue anche per un occhio umano che legge coordinate grezze. Il testo su più colonne è gestito; le pagine molto costruite graficamente possono richiedere una sistemata a mano.
Posso mantenere la formattazione?
Non qui: questo restituisce testo semplice. Per grassetti, titoli e struttura usa Estrai Markdown, oppure converti in Word.