PDFをMarkdownに — 端末内でテキスト抽出
ブラウザで PDF テキストを Markdown に抽出し、メモや LLM 貼り付けに使えます——ファイルは端末に残り、サーバーにアップロードしません。手順:テキスト層のある PDF を選び、変換、プレビュー確認、.md をダウンロード。例:1 ページのサンプルは「Hello PDF to Markdown sample.」を含む .md になります。スキャン画像のみの PDF は OCR なしで失敗します。暗号化・破損は明確なエラー。
使い方
PDF を選び、変換、プレビュー確認、.md ダウンロード。縦位置で行を組み、ページ間は --- で区切ります。ライブラリ読込後はすべて端末内。
想定されるルール
テキスト層抽出、ページ区切り、OCR なし、プライバシーと失敗条件。
- エンジン:各ページ getTextContent;近い y の項目をスペースで行結合。
- ページ:空行 + --- + 空行で結合。
- OCR なし:trim 後空なら明確に失敗——スキャンは別ワークフロー。
- 制限:バイトはタブ内;暗号化/破損は明確;~25 MB 超は遅くなる場合あり。
例
サンプルは Helvetica 1 ページ PDF を作り、変換してプレビューに文を表示し、.md ダウンロードを有効にします。
向いている場面
- オフィス:契約条項をメモや Wiki にコピー、再入力不要。
- 執筆・AI:レポート本文を Markdown 化して編集やプロンプトに。
- 学生:テキスト層のある講義 PDF から復習メモ用テキストを。
Frequently asked questions
PDF はアップロードされますか?
いいえ。ページ描画 はタブ内で動作します(CDN から読み込む場合あり)。PDF は当社サーバーに送られません。
スキャン PDF が失敗するのはなぜ?
スキャン PDF は多くが画像のみでテキスト層がありません。OCR しないため空になり、明確に失敗します。
見出しや表は残りますか?
見出しや表は再構成しません。位置で行にまとめたプレーンテキストを出力します。
Markdown→HTML との違いは?
Markdown→HTML は Markdown 構文を Web プレビューに。本ツールは PDF から .md テキストを書き出します。
PDF→JPG を使うべきときは?
PDF→JPG は各ページを画像化。編集可能な文字が欲しいデジタル PDF には本ツールを。
お問い合わせ・フィードバック
分かりにくい点、不具合、不足があれば下にメッセージを書いてください。ツールに関する内容はすべて確認します。