Convertire un PDF in Markdown
Trasforma un PDF in testo Markdown strutturato: titoli, paragrafi, elenchi, tabelle e link vengono ricostruiti, intestazioni e numeri di pagina rimossi. Ideale per dare un documento a ChatGPT, Claude o al tuo wiki.
- Gratis
- Titoli, elenchi, tabelle
- Contatore di token
- Senza invio
100% privato — Tutto viene elaborato direttamente nel tuo browser: i tuoi file, la tua voce e la tua immagine non vengono mai inviati ai server di Chatzam.
Come convertire un PDF in Markdown?
-
Carica il PDF
Trascina il file: le sue pagine vengono lette direttamente nel tuo browser.
-
Imposta la conversione
Tieni tutto il documento o solo alcune pagine, e scegli se togliere le intestazioni, segnare le pagine o indicare le immagini.
-
Copia o scarica
Controlla il risultato in Markdown grezzo o in anteprima, poi copialo o scarica il file .md.
Un Markdown fedele alla struttura del PDF
Titoli e formattazione
Le dimensioni dei caratteri diventano titoli #, ## e ###, grassetto e corsivo vengono conservati.
Colonne e paragrafi
Le impaginazioni su due colonne vengono lette nell'ordine giusto, le righe ricomposte in paragrafi e le parole spezzate a fine riga riunite.
Elenchi, tabelle e link
Punti elenco, elenchi numerati, tabelle semplici e link cliccabili vengono convertiti in sintassi Markdown.
Pensato per le IA
Intestazioni, piè di pagina e numeri di pagina ripetuti vengono rimossi, e un contatore stima il numero di token.
Perché convertire un PDF in Markdown?
Il Markdown è testo semplice arricchito da pochi simboli: un cancelletto per un titolo, un trattino per un punto elenco, barre verticali per una tabella. Si legge senza programmi, si modifica in qualsiasi editor e viene mostrato in modo pulito su GitHub, Notion, Obsidian o un wiki aziendale. È anche il formato che gli assistenti di IA capiscono meglio: quando incolli un report in ChatGPT o Claude, la gerarchia dei titoli e le tabelle lo aiutano a riassumere, confrontare o rispondere a una domanda precisa. Un semplice copia-incolla da un lettore PDF spesso mescola le colonne, spezza le frasi a ogni riga e ripete le intestazioni di pagina; la conversione in Markdown evita questi difetti.
Come viene ricostruita la struttura?
Un PDF non contiene titoli né paragrafi, solo frammenti di testo posizionati a coordinate precise. Lo strumento individua la dimensione del carattere del corpo del testo, poi classifica le dimensioni più grandi: la più grande diventa un titolo di livello 1, la successiva un livello 2, e così via. Rileva le colonne grazie allo spazio vuoto che le separa, ricompone le righe di uno stesso paragrafo e rimuove i trattini di sillabazione. Le righe allineate in più celle formano una tabella, punti elenco e numeri aprono un elenco. I testi ripetuti in alto o in basso nella maggior parte delle pagine, come il nome di un report o «Pagina 3 di 12», vengono scartati.
Token, limiti e PDF scansionati
Le IA misurano la lunghezza di un testo in token, frammenti di parole. Il contatore dà un ordine di grandezza, circa un token ogni quattro caratteri: utile per sapere se un documento sta in una conversazione o se conviene inviare solo alcune pagine. Le immagini non vengono convertite, ma la loro posizione può essere segnalata. Le impaginazioni molto grafiche, come una brochure o una tabella con celle unite, a volte richiedono una rilettura. Infine, un PDF scansionato contiene solo immagini di pagine: lo strumento te lo segnala e ti propone di passare prima per l'OCR per renderlo leggibile. Il file viene elaborato nel tuo browser e non viene mai inviato.
Domande frequenti
Come si dà un PDF a ChatGPT senza perdere la formattazione?
Convertilo in Markdown: titoli, elenchi e tabelle restano leggibili per l'IA. Copia il risultato nella conversazione o allega il file .md.
Le tabelle del PDF vengono conservate?
Le tabelle semplici, con colonne ben allineate, diventano tabelle Markdown. Le tabelle con celle unite o molto grafiche possono richiedere un ritocco.
Il mio PDF viene inviato a un server?
No. Il PDF viene letto e convertito interamente nel tuo browser; non lascia il tuo dispositivo.
Perché il risultato è vuoto?
Probabilmente il tuo PDF è una scansione: le sue pagine sono immagini, senza testo. Rendilo prima ricercabile con lo strumento «OCR PDF», poi convertilo.
Cosa significa il numero di token mostrato?
È una stima della lunghezza del testo così come la contano le IA, sulla base di circa quattro caratteri per token. Il numero esatto dipende dal modello usato.