PDF'i Markdown'a Dönüştür
Bir PDF'i yapılandırılmış Markdown metnine dönüştürün: başlıklar, paragraflar, listeler, tablolar ve bağlantılar yeniden kurulur, üst bilgiler ve sayfa numaraları kaldırılır. Bir belgeyi ChatGPT'ye, Claude'a veya wiki'nize vermek için ideal.
- Ücretsiz
- Başlıklar, listeler, tablolar
- Token sayacı
- Gönderim yok
%100 gizli — Her şey doğrudan tarayıcınızda işlenir: dosyalarınız, sesiniz ve görüntünüz asla Chatzam sunucularına gönderilmez.
PDF Markdown'a nasıl dönüştürülür?
-
PDF'i yükleyin
Dosyayı bırakın: sayfaları doğrudan tarayıcınızda okunur.
-
Dönüştürmeyi ayarlayın
Belgenin tamamını ya da birkaç sayfayı alın; üst bilgileri kaldırmayı, sayfaları işaretlemeyi veya görselleri belirtmeyi seçin.
-
Kopyalayın veya indirin
Sonucu ham Markdown ya da önizleme olarak kontrol edin, ardından kopyalayın veya .md dosyasını indirin.
PDF'in yapısına sadık bir Markdown
Başlıklar ve biçimlendirme
Yazı tipi boyutları #, ## ve ### başlıklarına dönüşür; kalın ve italik korunur.
Sütunlar ve paragraflar
İki sütunlu sayfa düzenleri sırayla okunur, satırlar paragraflar hâlinde birleştirilir ve satır sonunda bölünmüş kelimeler bir araya getirilir.
Listeler, tablolar ve bağlantılar
Madde işaretleri, numaralı listeler, basit tablolar ve tıklanabilir bağlantılar Markdown sözdizimine dönüştürülür.
Yapay zekâ için tasarlandı
Tekrarlanan üst bilgiler, alt bilgiler ve sayfa numaraları kaldırılır; bir sayaç token sayısını tahmin eder.
PDF neden Markdown'a dönüştürülmeli?
Markdown, birkaç sembolle zenginleştirilmiş düz metindir: başlık için bir diyez, madde için bir tire, tablo için dikey çizgiler. Yazılım olmadan okunur, herhangi bir düzenleyicide değiştirilir ve GitHub, Notion, Obsidian veya bir şirket wiki'sinde düzgün görüntülenir. Aynı zamanda yapay zekâ asistanlarının en iyi anladığı biçimdir: ChatGPT'ye veya Claude'a bir rapor yapıştırdığınızda başlık hiyerarşisi ve tablolar, özetlemesine, karşılaştırmasına veya belirli bir soruyu yanıtlamasına yardımcı olur. Bir PDF okuyucudan basit bir kopyala-yapıştır çoğu zaman sütunları karıştırır, cümleleri her satırda böler ve sayfa üst bilgilerini tekrarlar; Markdown'a dönüştürme bu kusurları önler.
Yapı nasıl yeniden kurulur?
Bir PDF başlık veya paragraf içermez, yalnızca belirli koordinatlara yerleştirilmiş metin parçaları içerir. Araç gövde metninin yazı tipi boyutunu belirler, ardından daha büyük boyutları sıralar: en büyüğü 1. düzey başlık, sonraki 2. düzey olur ve bu böyle devam eder. Sütunları aralarındaki boş alan sayesinde algılar, aynı paragrafın satırlarını birleştirir ve heceleme tirelerini kaldırır. Birden çok hücreye hizalanmış satırlar bir tablo oluşturur, madde işaretleri ve numaralar bir liste başlatır. Bir rapor adı veya « Sayfa 3 / 12 » gibi sayfaların çoğunun üstünde veya altında tekrarlanan metinler ayıklanır.
Token'lar, sınırlar ve taranmış PDF'ler
Yapay zekâlar bir metnin uzunluğunu token, yani kelime parçaları ile ölçer. Sayaç bir büyüklük sırası verir, yaklaşık dört karakter için bir token: bir belgenin bir sohbete sığıp sığmadığını ya da yalnızca bazı sayfaları göndermenin daha iyi olup olmadığını bilmek için pratiktir. Görseller dönüştürülmez, ancak yerleri belirtilebilir. Bir broşür veya birleştirilmiş hücreli bir tablo gibi çok grafik ağırlıklı sayfa düzenleri bazen gözden geçirme gerektirir. Son olarak, taranmış bir PDF yalnızca sayfa görüntüleri içerir: araç bunu size bildirir ve okunabilir hâle getirmek için önce OCR'dan geçirmenizi önerir. Dosya tarayıcınızda işlenir ve asla gönderilmez.
Sıkça Sorulan Sorular
Bir PDF biçimlendirmesi kaybolmadan ChatGPT'ye nasıl verilir?
Onu Markdown'a dönüştürün: başlıklar, listeler ve tablolar yapay zekâ için okunabilir kalır. Sonucu sohbete kopyalayın veya .md dosyasını ekleyin.
PDF'teki tablolar korunuyor mu?
Sütunları iyi hizalanmış basit tablolar Markdown tablolarına dönüşür. Birleştirilmiş hücreli veya çok grafik ağırlıklı tablolar düzeltme gerektirebilir.
PDF'im bir sunucuya gönderiliyor mu?
Hayır. PDF tamamen tarayıcınızda okunur ve dönüştürülür; cihazınızdan çıkmaz.
Sonuç neden boş?
PDF'iniz muhtemelen bir tarama: sayfaları metin içermeyen görüntülerdir. Önce « OCR PDF » aracıyla onu aranabilir hâle getirin, ardından dönüştürün.
Gösterilen token sayısı ne anlama geliyor?
Metnin, yapay zekâların saydığı şekliyle uzunluğunun, token başına yaklaşık dört karakter esas alınarak yapılmış bir tahminidir. Kesin sayı kullanılan modele bağlıdır.