PDFを整える
初級PDFの文字起こしを整える。
= PDFから文字を取り出してテキスト・Markdownにする
PDFに埋め込まれた文字を取り出して、プレーンテキストやMarkdownとして使えるようにします。処理はすべてこの端末のブラウザの中で完結し、PDFがサーバーに送られることは一切ありません。
🔰 かんたんに言うと
PDFに書かれている文字を取り出して、コピーできる形にするページです。※紙をスキャンしただけのPDF(中身が写真)からは取り出せません。
TLDR — 30秒で分かる
PDFから文字を取り出してテキスト・Markdownに。コピーもダウンロードもできて、アップロードなし。※スキャンした画像だけのPDFからは取り出せません(OCR非対応)。
主な機能
- PDFの文字をテキストとして取り出す
- Markdown整形(ページ区切り・箇条書き変換)
- コピー/.txt・.mdでダウンロード
- 画像だけのPDF(スキャン)を自動検出して警告
- アップロードゼロ——ファイルは端末の外に出ない(送信ゼロ)
- 広告ゼロ・登録不要・無料
🔒 このページはPDFをアップロードしません。処理はすべてブラウザ内で行われ、ファイルが端末の外に出ることはありません(送信ゼロ・広告ゼロ)。
※ ページ数が多いと時間がかかります
SAFETY
なぜ「アップロードなし」と言えるのか
このツールのPDF処理は、ページに同梱した処理プログラム(pdf.js)がブラウザの中だけで行います。ファイルを読むのも、文字を取り出すのも、ダウンロード用のデータを作るのも、すべてこの端末のメモリ内です。信じなくても確認できます——ブラウザの開発者ツールの「ネットワーク」タブを開いたままPDFを処理してみてください。ファイルを送る通信は発生しません。
このツールについて
- 処理はすべてブラウザ内で完結し、PDFがサーバーへ送信・保存されることは一切ありません(送信ゼロ)。元のファイルも変更されません。
- パスワード付き(暗号化)PDFは扱えません。解除してからお試しください。
- 非常に大きいPDF・ページ数の多いPDFは、端末の性能によっては処理に時間がかかったり、途中で止まったりすることがあります。
よくある質問
Q. スキャンしたPDFから文字を取り出せますか?
A. 取り出せません。紙をスキャンしたPDFは、中身が「文字」ではなく「写真」だからです。このツールはPDFに埋め込まれた文字データを取り出す仕組みで、画像から文字を認識するOCRには対応していません。文字データがほとんど無いPDFを読み込むと、その旨を警告表示します。
Q. レイアウトや表はそのまま再現されますか?
A. されません。取り出せるのは文字とその位置情報までで、段組みや表組みが複雑なPDFでは読み取り順が前後することがあります(例: 2段組みの文章が交互に混ざる)。取り出した内容は必ずご確認のうえお使いください。
Q. Markdownで出力すると何が変わりますか?
A. 「・」や「1)」で始まる行を Markdown のリスト記法(`- ` や `1. `)に整え、必要ならページ区切り(`---` と `## ページ N`)を挿入します。そのままメモアプリやドキュメントツールに貼り付けやすい形式です。見出しの自動判定は行いません(誤って見出しにすると内容が歪むためです)。
Q. PDFはアップロードされますか?
A. されません。文字の抽出はすべてブラウザ内で行われ、PDFの中身も取り出したテキストもサーバーに送信されません(送信ゼロ)。社外秘の資料からの文字起こしにも安心してお使いいただけます。
入力値はURLの「#」以降に入るためサーバーには送信されません。リンクを開くと同じ状態を復元します。
RELATED TOOLS
続けて整える