PDF in Markdown
Converte il testo leggibile in Markdown pulito, da incollare in note o documenti.
Copiare il testo da un PDF ti dà un muro di parole: titoli, elenchi e stacchi di paragrafo spariscono tutti, perché nel file non esistono come struttura. Questo strumento li rimette misurando. Confronta la dimensione del carattere di ogni riga con quella del corpo del testo della pagina — una riga sensibilmente più grande è un titolo, e quanto è più grande decide se diventa H1, H2 o H3 — e riconosce come elenchi i marcatori a punto e numerati.
È quindi una ricostruzione che fa del suo meglio, e lo strumento lo dichiara nell'interfaccia. Un documento con una gerarchia tipografica coerente esce sorprendentemente pulito; uno che finge i titoli mettendo il grassetto al testo normale produrrà prosa piatta, perché dal punto di vista del file è esattamente ciò che sono. Il testo corrente e gli stacchi di paragrafo passano bene in entrambi i casi.
Come funziona
- Trascina un PDF che contenga testo vero.
- Leggi il Markdown estratto nel pannello.
- Copialo negli appunti, oppure scaricalo come file .md.
Quando si usa
- Portare una relazione in Obsidian, Notion o un wiki senza riscrivere la struttura.
- Trasformare una specifica in PDF in un documento di cui puoi fare diff e versioni in Git.
- Far entrare un articolo lungo in un'app di appunti dove puoi davvero annotarlo.
Domande frequenti
- Il mio file viene caricato su un server?
- No. Il file viene aperto da JavaScript e WebAssembly che girano nella scheda del tuo browser. Non viene caricato da nessuna parte, non c'è elaborazione lato server e non viene conservato nulla: chiudendo la scheda sparisce tutto.
- Non è uscito niente.
- Il PDF è una scansione senza strato di testo. Passalo prima dall'OCR e poi estrai: finché qualcuno non lo scrive, non c'è testo da leggere.
- I miei titoli sono usciti come paragrafi normali.
- Probabilmente nel file non sono titoli, ma testo normale messo in grassetto, che è di gran lunga il modo più comune in cui i documenti vengono scritti. Il rilevamento lavora sulla dimensione, perché è la dimensione a distinguere tipograficamente un titolo. Aggiungi i # a mano dove conta.
- Le tabelle diventano tabelle Markdown?
- No. Un PDF non ha una struttura di tabella da leggere, solo testo allineato, e indovinare qui i confini delle celle produrrebbe tabelle sottilmente sbagliate. Per le tabelle usa PDF in Excel, che fa quella deduzione di proposito e ti mostra il risultato in una griglia.
- Che fine fanno le immagini?
- Non vengono incluse: questo estrae testo. Usa Estrai immagini per tirarle fuori a parte e richiamarle tu dal Markdown.
Strumenti correlati
- 043043PDF in WordOttieni un .docx modificabile: paragrafi continui, titoli e immagini incluse.
- 044044Word in PDFConverti documenti .docx in un PDF impaginato — titoli, elenchi, tabelle e immagini. Interamente nel tuo browser.
- 045045Excel in PDFTrasforma fogli .xlsx, .xls, .ods o .csv in un PDF tabellare pulito — orientamento automatico, intestazioni ripetute, tabelle larghe divise per colonne. Le formule usano i valori salvati.
- 046046PDF in ExcelEstrai tabelle e testo da un PDF in una cartella di lavoro .xlsx — un foglio per pagina, formati numerici europei riconosciuti. I PDF scansionati richiedono prima l’OCR.