Zamień PDF na Markdown
Przekształć PDF w uporządkowany tekst Markdown: nagłówki, akapity, listy, tabele i linki zostają odtworzone, a nagłówki stron i numery stron usunięte. Idealne, aby przekazać dokument do ChatGPT, Claude'a lub firmowego wiki.
- Za darmo
- Nagłówki, listy, tabele
- Licznik tokenów
- Bez wysyłania
100% prywatności — Wszystko jest przetwarzane bezpośrednio w Twojej przeglądarce: Twoje pliki, głos i obraz nigdy nie są wysyłane na serwery Chatzam.
Jak zamienić PDF na Markdown?
-
Wgraj PDF
Wrzuć plik: jego strony zostaną odczytane bezpośrednio w przeglądarce.
-
Ustaw konwersję
Zachowaj cały dokument lub tylko kilka stron i zdecyduj, czy usunąć nagłówki stron, oznaczyć początek stron lub zaznaczyć obrazy.
-
Skopiuj lub pobierz
Sprawdź wynik jako surowy Markdown lub w podglądzie, a potem skopiuj go albo pobierz plik .md.
Markdown wierny strukturze PDF
Nagłówki i formatowanie
Rozmiary czcionek stają się nagłówkami #, ## i ###, a pogrubienie i kursywa są zachowane.
Kolumny i akapity
Układy dwukolumnowe są czytane we właściwej kolejności, wiersze sklejane w akapity, a słowa przeniesione na końcu wiersza łączone.
Listy, tabele i linki
Punktory, listy numerowane, proste tabele i klikalne linki są zamieniane na składnię Markdown.
Stworzony z myślą o AI
Powtarzające się nagłówki, stopki i numery stron są usuwane, a licznik szacuje liczbę tokenów.
Po co zamieniać PDF na Markdown?
Markdown to zwykły tekst wzbogacony kilkoma symbolami: krzyżyk oznacza nagłówek, myślnik punktor, a pionowe kreski tabelę. Da się go czytać bez specjalnego programu, edytować w dowolnym edytorze i ładnie wyświetlać na GitHubie, w Notion, Obsidianie czy firmowym wiki. To także format, który asystenci AI rozumieją najlepiej: gdy wklejasz raport do ChatGPT lub Claude'a, hierarchia nagłówków i tabele pomagają mu streścić, porównać lub odpowiedzieć na konkretne pytanie. Zwykłe kopiowanie z czytnika PDF często miesza kolumny, łamie zdania w każdym wierszu i powtarza nagłówki stron; konwersja do Markdown pozwala uniknąć tych problemów.
Jak odtwarzana jest struktura?
PDF nie zawiera nagłówków ani akapitów, a jedynie fragmenty tekstu umieszczone w konkretnych współrzędnych. Narzędzie ustala rozmiar czcionki tekstu głównego, a potem porządkuje większe rozmiary: największy staje się nagłówkiem poziomu 1, następny poziomu 2 i tak dalej. Wykrywa kolumny dzięki pustej przestrzeni, która je oddziela, skleja wiersze tego samego akapitu i usuwa łączniki przeniesień. Wiersze ułożone w kilka komórek tworzą tabelę, a punktory i numery rozpoczynają listę. Teksty powtarzające się u góry lub u dołu większości stron, jak nazwa raportu czy „Strona 3 z 12”, są pomijane.
Tokeny, ograniczenia i zeskanowane PDF
Modele AI mierzą długość tekstu w tokenach, czyli fragmentach słów. Licznik podaje rząd wielkości, około jednego tokena na cztery znaki: to pomaga ocenić, czy dokument zmieści się w jednej rozmowie, czy lepiej wysłać tylko wybrane strony. Obrazy nie są konwertowane, ale ich położenie może zostać zaznaczone. Bardzo graficzne układy, takie jak folder reklamowy czy tabela ze scalonymi komórkami, czasem wymagają przejrzenia. Zeskanowany PDF zawiera tylko obrazy stron: narzędzie Cię o tym poinformuje i zaproponuje, aby najpierw użyć OCR, który uczyni go czytelnym. Plik jest przetwarzany w przeglądarce i nigdy nie jest wysyłany.
Najczęściej zadawane pytania
Jak przekazać PDF do ChatGPT bez utraty formatowania?
Zamień go na Markdown: nagłówki, listy i tabele pozostaną czytelne dla AI. Wklej wynik do rozmowy albo załącz plik .md.
Czy tabele z PDF są zachowywane?
Proste tabele z dobrze wyrównanymi kolumnami stają się tabelami Markdown. Tabele ze scalonymi komórkami lub bardzo graficzne mogą wymagać poprawek.
Czy mój PDF jest wysyłany na serwer?
Nie. PDF jest odczytywany i konwertowany w całości w przeglądarce; nie opuszcza Twojego urządzenia.
Dlaczego wynik jest pusty?
Twój PDF to prawdopodobnie skan: jego strony są obrazami, bez tekstu. Najpierw zamień go na przeszukiwalny narzędziem „OCR PDF”, a potem przekonwertuj.
Co oznacza wyświetlana liczba tokenów?
To szacunkowa długość tekstu liczona tak jak przez modele AI, przy założeniu około czterech znaków na token. Dokładna liczba zależy od użytego modelu.