PDF to Markdown

OCR · PDF escaneado

PDF escaneado para Markdown

Extraia texto de PDFs escaneados ou só com imagem e obtenha Markdown limpo. OCR roda inteiramente no navegador — seu arquivo nunca sai do dispositivo.

100% privado — arquivos nunca saem do navegador

Solte um PDF escaneado aqui, ou

clique para procurar
Imagem ou PDF escaneado · OCR no navegador · Máx. 50 MB
Sem PDF à mão?

Na primeira vez baixa um modelo de idioma (~2–15 MB). Depois funciona offline — seu arquivo é processado localmente.

OCR integrado

Lê texto de PDFs escaneados e só com imagem que conversores normais não conseguem, com Tesseract no navegador.

100+ idiomas

Reconheça inglês, chinês, japonês, coreano, espanhol, francês, alemão, russo e muito mais.

Privado por design

OCR roda localmente via WebAssembly. Só o modelo de idioma é baixado — seu documento nunca sai do dispositivo.

Quem usa

Arquivistas

Digitalize livros escaneados, recibos e documentos antigos em Markdown editável.

Estudantes

Transforme slides e handouts fotografados em notas buscáveis.

Escritórios

Extraia texto de contratos e formulários escaneados sem redigitar.

Perguntas frequentes

O que é um PDF escaneado?

PDF escaneado ou só com imagem não tem camada de texto selecionável — são essencialmente imagens de páginas. Conversores normais não retornam nada, então OCR é necessário para ler o texto.

O OCR é grátis e privado?

Sim. Reconhecimento roda inteiramente no navegador via WebAssembly. Só o modelo de idioma é baixado de um CDN; seu PDF nunca é enviado.

Quais idiomas são suportados?

Escolha entre inglês, chinês simplificado e tradicional, japonês, coreano, espanhol, francês, alemão, russo e mais antes de iniciar.

Por que OCR é mais lento que conversão normal?

OCR analisa cada imagem de página pixel a pixel para reconhecer caracteres, mais pesado que ler camada de texto existente. Documentos maiores demoram mais.

Ferramentas relacionadas