PDFをMarkdownに変換
テキストベースのPDFをアップロードすると、きれいなMarkdownが得られます — 見出し、リスト、段落がすべてブラウザ内で自動的に再構築されます。
すべての処理はブラウザ内で完結します — ファイルが外部に送信されることはありません。
テキストベースのPDFに対応しています — 変換処理はすべてブラウザ内で行われ、ファイルはどこにもアップロードされません。スキャン・画像のみのPDFには対応していません(OCR非対応)。
使い方
- 01「PDFをアップロード」をクリックして、端末からテキストベースの.pdfファイルを選びます。
- 02ファイルは自動的に解析されMarkdownに変換されます — サーバーへのアップロードは一切ありません。
- 03左側でMarkdownを確認します(編集可能なので、ヒューリスティックが見逃した箇所を修正できます)。右側のレンダリングプレビューで、見出し・リスト・テーブルが正しく変換されたか確認してください。
- 04Markdownをコピーするか、.mdファイルとしてダウンロードします。
よくある質問
このPDF to Markdown変換ツールは無料ですか?
はい、アカウント登録や利用制限は一切ありません。パースにはオープンソースのpdf.jsライブラリ(Mozilla製)を使用し、変換処理全体がブラウザ内で行われます。
PDFはサーバーにアップロードされますか?
いいえ。ファイルはブラウザのFile APIによってメモリ上から直接読み込まれ、pdf.jsによってブラウザ内で解析されます — ネットワークに送信されることは一切ありません。
スキャンした画像のみのPDFにも対応していますか?
対応していません。このツールはPDFに埋め込まれた実際のテキストを抽出するもので、OCRは行いません。スキャンした画像のみのPDFには抽出できるテキストが埋め込まれていないため、推測で処理する代わりに、テキストが見つからなかった旨を表示します。
見出しはどうやって検出されますか?
このツールは文書全体のすべての行のフォントサイズを確認します。最も一般的な(本文の)サイズより明らかに大きい、はっきりと異なるサイズを大きい順にランク付けし、#、##、###にマッピングします — 最も大きいものが最上位の見出しになります。
箇条書きや番号付きリストは正しく変換されますか?
箇条書き記号(•、-、*)や、ピリオドの付いた数字で始まる行はMarkdownのリスト項目になります。これはPDFの実際の構造ではなく視覚的なレイアウトに基づくヒューリスティックな判定のため、通常とは異なるリスト書式は検出できない場合があります。
レイアウトは元のPDFとまったく同じになりますか?
なりません — これはピクセル完全な変換ではなく、ヒューリスティックな変換です。複数列のレイアウト、テーブル、埋め込み画像は再現されません。目的は視覚的な複製ではなく、クリーンで読みやすいMarkdownテキストを得ることです。