MarkdownLab

PDFをMarkdownに変換

テキストベースのPDFをアップロードすると、きれいなMarkdownが得られます — 見出し、リスト、段落がすべてブラウザ内で自動的に再構築されます。

すべての処理はブラウザ内で完結します — ファイルが外部に送信されることはありません。

Markdown
上でテキストベースのPDFをアップロードすると、変換されたMarkdownがここに表示されます。
プレビュー
PDFをアップロードすると、ここにプレビューが表示されます。

テキストベースのPDFに対応しています — 変換処理はすべてブラウザ内で行われ、ファイルはどこにもアップロードされません。スキャン・画像のみのPDFには対応していません(OCR非対応)。

使い方

  1. 01「PDFをアップロード」をクリックして、端末からテキストベースの.pdfファイルを選びます。
  2. 02ファイルは自動的に解析されMarkdownに変換されます — サーバーへのアップロードは一切ありません。
  3. 03左側でMarkdownを確認します(編集可能なので、ヒューリスティックが見逃した箇所を修正できます)。右側のレンダリングプレビューで、見出し・リスト・テーブルが正しく変換されたか確認してください。
  4. 04Markdownをコピーするか、.mdファイルとしてダウンロードします。

よくある質問

このPDF to Markdown変換ツールは無料ですか?

はい、アカウント登録や利用制限は一切ありません。パースにはオープンソースのpdf.jsライブラリ(Mozilla製)を使用し、変換処理全体がブラウザ内で行われます。

PDFはサーバーにアップロードされますか?

いいえ。ファイルはブラウザのFile APIによってメモリ上から直接読み込まれ、pdf.jsによってブラウザ内で解析されます — ネットワークに送信されることは一切ありません。

スキャンした画像のみのPDFにも対応していますか?

対応していません。このツールはPDFに埋め込まれた実際のテキストを抽出するもので、OCRは行いません。スキャンした画像のみのPDFには抽出できるテキストが埋め込まれていないため、推測で処理する代わりに、テキストが見つからなかった旨を表示します。

見出しはどうやって検出されますか?

このツールは文書全体のすべての行のフォントサイズを確認します。最も一般的な(本文の)サイズより明らかに大きい、はっきりと異なるサイズを大きい順にランク付けし、#、##、###にマッピングします — 最も大きいものが最上位の見出しになります。

箇条書きや番号付きリストは正しく変換されますか?

箇条書き記号(•、-、*)や、ピリオドの付いた数字で始まる行はMarkdownのリスト項目になります。これはPDFの実際の構造ではなく視覚的なレイアウトに基づくヒューリスティックな判定のため、通常とは異なるリスト書式は検出できない場合があります。

レイアウトは元のPDFとまったく同じになりますか?

なりません — これはピクセル完全な変換ではなく、ヒューリスティックな変換です。複数列のレイアウト、テーブル、埋め込み画像は再現されません。目的は視覚的な複製ではなく、クリーンで読みやすいMarkdownテキストを得ることです。

関連ツール