PDFをMarkdownに変換
PDFを構造化されたMarkdownテキストに変換します。見出し、段落、リスト、表、リンクを再構成し、ヘッダーやページ番号は取り除きます。ChatGPTやClaude、社内wikiに文書を渡すのに最適です。
- 無料
- 見出し・リスト・表
- トークン数カウンター
- 送信なし
100% プライベート — すべてブラウザ内で直接処理されます。ファイル、音声、映像がChatzamのサーバーに送信されることはありません。
PDFをMarkdownに変換する方法
-
PDFを読み込む
ファイルをドロップすると、ページがブラウザ内で直接読み込まれます。
-
変換を設定
文書全体か一部のページかを選び、ヘッダーの削除、ページ区切りの表示、画像の位置表示を設定します。
-
コピーまたはダウンロード
Markdownのソースまたはプレビューで結果を確認し、コピーするか.mdファイルをダウンロードします。
PDFの構造に忠実なMarkdown
見出しと書式
フォントサイズに応じて#、##、###の見出しにし、太字と斜体も保持します。
段組みと段落
2段組みのレイアウトも正しい順番で読み、行をつなげて段落にし、行末で分割された単語もつなぎ直します。
リスト、表、リンク
箇条書き、番号付きリスト、シンプルな表、クリックできるリンクをMarkdown記法に変換します。
AI向けに設計
繰り返されるヘッダー、フッター、ページ番号を取り除き、トークン数の目安も表示します。
PDFをMarkdownに変換する理由
Markdownは、いくつかの記号を加えただけのプレーンテキストです。見出しには#、箇条書きには-、表には縦線|を使います。専用ソフトなしで読め、どんなエディターでも編集でき、GitHub、Notion、Obsidian、社内wikiできれいに表示されます。また、AIアシスタントが最も理解しやすい形式でもあります。ChatGPTやClaudeにレポートを貼り付けるとき、見出しの階層や表があると、要約、比較、具体的な質問への回答がしやすくなります。PDFビューアーから単純にコピー&ペーストすると、段組みが混ざったり、行ごとに文が途切れたり、ページのヘッダーが繰り返されたりしがちですが、Markdownに変換すればこうした問題を避けられます。
構造を再構成するしくみ
PDFには見出しや段落という情報はなく、決まった座標に置かれた文字の断片があるだけです。このツールは本文のフォントサイズを見つけ、それより大きいサイズを順位づけします。最も大きいものが見出しレベル1、次がレベル2、という具合です。段と段の間の空白から段組みを検出し、同じ段落の行をつなげ、行末のハイフネーションを取り除きます。複数のセルにそろった行は表に、行頭記号や番号はリストになります。レポート名や「12ページ中3ページ」のように、ほとんどのページの上下に繰り返される文字は除外します。
トークン、制限、スキャンPDF
AIはテキストの長さをトークン(単語の断片)で数えます。カウンターは約4文字で1トークンという目安で計算するので、文書が1回の会話に収まるか、一部のページだけ送ったほうがいいかを判断するのに便利です。日本語の場合、実際のトークン数はこれより多くなる傾向があります。画像は変換されませんが、その位置を示すことはできます。パンフレットや結合セルのある表など、デザイン性の高いレイアウトは見直しが必要な場合があります。スキャンPDFにはページの画像しか入っていないため、ツールがお知らせし、先にOCRで読めるようにすることをおすすめします。ファイルはブラウザ内で処理され、送信されることはありません。
よくある質問
書式を崩さずにPDFをChatGPTに渡すには?
Markdownに変換しましょう。見出し、リスト、表がAIにとって読みやすいまま残ります。結果を会話に貼り付けるか、.mdファイルを添付してください。
PDFの表は保持されますか?
列がきれいにそろったシンプルな表は、Markdownの表になります。結合セルのある表やデザイン性の高い表は、手直しが必要な場合があります。
PDFはサーバーに送信されますか?
いいえ。PDFはすべてブラウザ内で読み込まれ、変換されます。端末から出ることはありません。
結果が空なのはなぜ?
そのPDFはおそらくスキャンで、ページが画像になっていてテキストがありません。先に「OCR PDF」ツールで検索可能にしてから変換してください。
表示されるトークン数は何を意味しますか?
AIが数えるテキストの長さの目安で、約4文字で1トークンとして計算しています。正確な数は使用するモデルによって異なり、日本語では多めになることがあります。