OCR · スキャン PDF
スキャン PDF → Markdown
スキャンまたは画像のみ PDF からテキストを抽出し、クリーンな Markdown を取得。OCR は完全にブラウザ内 — ファイルはデバイスから出ません。
100% プライベート — ファイルはブラウザ外に出ません
スキャン PDF をここにドロップ、または
クリックして選択画像またはスキャン PDF · ブラウザ内 OCR · 最大 50 MB
PDF をお持ちでない場合
初回は言語モデルをダウンロード(約 2–15 MB)。以降はオフライン — ファイルはローカル処理。
内蔵 OCR
通常コンバーターが扱えないスキャン・画像のみ PDF からテキストを読み取り — ブラウザ内 Tesseract 搭載。
100 以上の言語
英語、中国語、日本語、韓国語、スペイン語、フランス語、ドイツ語、ロシア語など多数に対応。
プライバシー by design
OCR は WebAssembly でローカル実行。言語モデルのみ取得 — ドキュメントはデバイスから出ません。
利用者
アーキビスト
スキャン書籍、領収書、古い文書を編集可能な Markdown にデジタル化。
学生
撮影した講義スライドや配布資料を検索可能なノートに。
オフィス
スキャン契約書やフォームからテキストを抽出、再入力不要。
よくある質問
スキャン PDF とは?
スキャンまたは画像のみ PDF には選択可能なテキスト層がありません — ページの画像そのもの。通常コンバーターは何も返さず、OCR でテキストを読み取る必要があります。
OCR は無料でプライベート?
はい。認識は WebAssembly で完全にブラウザ内。言語モデルのみ CDN からダウンロード — PDF はアップロードされません。
対応言語は?
開始前に英語、簡体字・繁体字中国語、日本語、韓国語、スペイン語、フランス語、ドイツ語、ロシア語などから選択。
OCR が通常変換より遅いのはなぜ?
OCR は各ページ画像をピクセル単位で解析して文字を認識 — 既存テキスト層の読み取りより重い。大きなドキュメントほど時間がかかります。