PDF to Markdown

OCR · Skanowany PDF

Skanowany PDF na Markdown

Wyodrębnij tekst ze skanowanych lub obrazowych PDF-ów i uzyskaj czysty Markdown. OCR działa w całości w przeglądarce — plik nie opuszcza urządzenia.

100% prywatnie — pliki nie opuszczają przeglądarki

Upuść skanowany PDF tutaj lub

kliknij, aby przeglądać
Obraz lub skanowany PDF · OCR w przeglądarce · Maks. 50 MB
Brak PDF pod ręką?

Pierwsze uruchomienie pobiera model językowy (~2–15 MB). Potem działa offline — plik jest przetwarzany lokalnie.

Wbudowany OCR

Odczytuje tekst ze skanowanych i obrazowych PDF-ów, których zwykłe konwertery nie obsługują, dzięki Tesseract w przeglądarce.

100+ języków

Rozpoznaje angielski, chiński, japoński, koreański, hiszpański, francuski, niemiecki, rosyjski i wiele innych.

Prywatność od podstaw

OCR działa lokalnie przez WebAssembly. Pobierany jest tylko model językowy — dokument nie opuszcza urządzenia.

Kto z tego korzysta

Archiwiści

Digitalizuj skanowane książki, paragony i stare dokumenty do edytowalnego Markdown.

Studenci

Zamieniaj sfotografowane slajdy i materiały na przeszukiwalne notatki.

Biura

Wyodrębniaj tekst ze skanowanych umów i formularzy bez przepisywania.

Często zadawane pytania

Czym jest skanowany PDF?

Skanowany lub obrazowy PDF nie ma warstwy tekstu do zaznaczenia — to w zasadzie zdjęcia stron. Zwykłe konwertery nic nie zwracają, więc potrzebny jest OCR.

Czy OCR jest darmowy i prywatny?

Tak. Rozpoznawanie działa w całości w przeglądarce przez WebAssembly. Tylko model językowy jest pobierany z CDN; PDF nie jest przesyłany.

Jakie języki są obsługiwane?

Wybierz angielski, chiński uproszczony i tradycyjny, japoński, koreański, hiszpański, francuski, niemiecki, rosyjski i inne przed startem.

Dlaczego OCR jest wolniejszy niż zwykła konwersja?

OCR analizuje każdy obraz strony piksel po pikselu, by rozpoznać znaki — to cięższe niż odczyt istniejącej warstwy tekstu. Większe dokumenty trwają dłużej.

Powiązane narzędzia