PDF to Markdown

OCR · スキャン PDF

スキャン PDF → Markdown

スキャンまたは画像のみ PDF からテキストを抽出し、クリーンな Markdown を取得。OCR は完全にブラウザ内 — ファイルはデバイスから出ません。

100% プライベート — ファイルはブラウザ外に出ません

スキャン PDF をここにドロップ、または

クリックして選択
画像またはスキャン PDF · ブラウザ内 OCR · 最大 50 MB
PDF をお持ちでない場合

初回は言語モデルをダウンロード(約 2–15 MB)。以降はオフライン — ファイルはローカル処理。

内蔵 OCR

通常コンバーターが扱えないスキャン・画像のみ PDF からテキストを読み取り — ブラウザ内 Tesseract 搭載。

100 以上の言語

英語、中国語、日本語、韓国語、スペイン語、フランス語、ドイツ語、ロシア語など多数に対応。

プライバシー by design

OCR は WebAssembly でローカル実行。言語モデルのみ取得 — ドキュメントはデバイスから出ません。

利用者

アーキビスト

スキャン書籍、領収書、古い文書を編集可能な Markdown にデジタル化。

学生

撮影した講義スライドや配布資料を検索可能なノートに。

オフィス

スキャン契約書やフォームからテキストを抽出、再入力不要。

よくある質問

スキャン PDF とは?

スキャンまたは画像のみ PDF には選択可能なテキスト層がありません — ページの画像そのもの。通常コンバーターは何も返さず、OCR でテキストを読み取る必要があります。

OCR は無料でプライベート?

はい。認識は WebAssembly で完全にブラウザ内。言語モデルのみ CDN からダウンロード — PDF はアップロードされません。

対応言語は?

開始前に英語、簡体字・繁体字中国語、日本語、韓国語、スペイン語、フランス語、ドイツ語、ロシア語などから選択。

OCR が通常変換より遅いのはなぜ?

OCR は各ページ画像をピクセル単位で解析して文字を認識 — 既存テキスト層の読み取りより重い。大きなドキュメントほど時間がかかります。

関連ツール