API keys are…
OAuth is…
| Methode | Gebruik |
|---|---|
| Keys | Server |
| OAuth | Apps |
PDF → Markdown
PDF's zijn gemaakt om te lezen en te delen, niet om te bewerken, te zoeken of voor RAG. Wij converteren PDF naar Markdown met koppen, tabellen, lijsten en outline intact — klaar voor docs, retrieval en AI.
Haal de tekst én het document eruit: koppen, tabellen, lijsten, links en hiërarchie — geen stapel ongestructureerde tekens.
100% lokaal in je browser — bestanden verlaten je apparaat nooit. Max 50 MB. Probeer een voorbeeld-PDF in de converter.
Converteren in de browser
Geen upload. Koppen, tabellen, lijsten en outline blijven intact — daarna kopiëren of downloaden.
Sleep je PDF hierheen, of
klik om te bladerenHet probleem
PDF (Portable Document Format) is gemaakt om elektronische documenten zo te bewaren dat ze er overal hetzelfde uitzien. Dat is een voordeel bij een contract, rapport of gedrukt handboek. Het is een probleem als je de inhoud nodig hebt.
Een PDF bewaart “hoe dit document eruit moet zien”, niet “waaruit dit document bestaat.”
| Kenmerk | Wat het in de praktijk betekent |
|---|---|
| Vaste layout | Lettertypen, afbeeldingen, tabellen, spatiëring, kop- en voetteksten blijven staan. De pagina reflowt niet op een ander apparaat. |
| Cross-platform | Windows, macOS, Linux, iOS en Android kunnen het allemaal openen. |
| Drukklaar | Paginaformaat en printlayout houden stand, daarom gaan contracten, rapporten, papers en handleidingen als PDF de deur uit. |
| Stabiele distributie | Eenmaal gegenereerd werkt het als eindversie: lezen, delen, archiveren. |
| Complexe inhoud | Een PDF is zelden “alleen tekst.” Afbeeldingen, tabellen, links, vectoren, embedded fonts en scans horen er vaak bij. |
| Kenmerk | Waarom het moderne workflows schaadt |
|---|---|
| Structuur-onvriendelijk | PDF geeft om de pagina, niet om de outline. Machines hebben moeite koppen, alinea's, lijsten en tabellen terug te vinden. |
| Onhandig te bewerken | Anders dan Word of Markdown is PDF niet ontworpen voor frequent herschrijven. |
| Moeilijk te parsen | Embedded fonts, meerkoloms layouts, tabellen, afbeeldingen en voetnoten maken extractie lastiger. |
| Soms geen tekst | Veel PDF's zijn scans — afbeeldingen van pagina's. Je hebt OCR nodig voordat er woorden zijn. |
Op de pagina kan een PDF een hoofdstuk, sectie, lijst of tabel lijken.
Chapter 1 Introduction This is the introduction... 1. Background 2. Methodology 3. Results [Table]
Een programma ziet vaak iets anders: strings, coördinaten, fonts en afbeeldingen over een canvas. De echte titel, alineagrenzen, lijst en tabel terughalen is niet gegarandeerd.
Een PDF rechtstreeks in een kennisbank droppen is vaak de verkeerde eerste stap. Het model krijgt tekst. Het krijgt geen structuur.
De bestemming
Markdown is een lichte opmaaktaal. Een paar platte-tekstsymbolen staan voor koppen, alinea's, lijsten, tabellen, links en code. Je kunt de bron lezen zonder te renderen.
# Product Documentation ## Introduction Markdown is simple and easy to read. - Easy to edit - Easy to search - Easy to convert
#, ##, - en vergelijkbare markeringen maken koppen en lijsten expliciet.
Het is een tekstbestand. Je zit niet vast in een layoutformaat.
Elke teksteditor werkt. Geen kantoorsuite nodig.
Zelfs het ruwe bestand is leesbaar.
Meestal veel lichter dan PDF of Word.
Gestructureerde tekst is eenvoudig full-text te doorzoeken.
Markdown wordt HTML, PDF, Word en meer.
Koppen, alinea's en lijsten zijn expliciet, zodat software ze kan parsen.
Platte tekst hoort in Git.
Windows, macOS, Linux — allemaal.
Gestructureerde tekst is makkelijker voor LLM's, embeddings en RAG.
Markdown scheidt inhoud van visuele layout.
PDF vraagt: Hoe moet dit er op de pagina uitzien?
Markdown vraagt: Wat is dit, en hoe is het gestructureerd?
Dat is geen cosmetisch verschil. Het is een werkverschil.
# Product Documentation ## Installation ### Requirements - Node 18+ - A valid API key
Die hiërarchie is waar moderne contentworkflows op draaien.
Product Documentation
└── Installation
└── Requirements
├── Node 18+
└── A valid API keyAI heeft niet alleen “de tekst” nodig. Het heeft de relaties tussen stukken tekst nodig. Voor AI of RAG worden kopniveaus, alineagrenzen, lijsten en tabellen ineens ondubbelzinnig.
Daarom past Markdown bij:
Als de volgende stap bewerken, retrieval of generatie is, is Markdown het formaat dat al op die klus lijkt.
Twee formaten, twee taken
PDF bewaart hoe een document eruitziet. Markdown bewaart wat een document is.
| Markdown | ||
|---|---|---|
| Kern doel | Pagina en visuele layout bewaren | Inhoud en structuur uitdrukken |
| Bewerkbaarheid | ★★ | ★★★★★ |
| Machine-parsing | ★★ | ★★★★★ |
| Zoeken | ★★★ | ★★★★★ |
| AI-verwerking | ★★ | ★★★★★ |
| RAG | Slechte fit as-is | Natuurlijke fit |
| Versiebeheer | Onhandig | Native |
| Bestandsgrootte | Meestal groter | Meestal klein |
| Cross-platform | Ja | Ja |
| Menselijk lezen | Ja | Ja |
| Paginalayout | Sterk | Zwak |
Je hebt nog steeds PDF's nodig. Contracten, rapporten en papers moeten er voor elke lezer hetzelfde uitzien. Je hebt Markdown nodig als hetzelfde materiaal hergebruikt, bevraagd, bijgewerkt of aan een model gegeven moet worden.
De formaten zijn geen vijanden. Ze hebben verschillende taken. Het ontbrekende stuk is de conversie ertussen.
Het product
Het belangrijkste materiaal leeft al als PDF. Het werk dat je daarna wilt niet: herschrijven, zoeken, ophalen, samenvatten, publiceren. Dat werk heeft structuur nodig.
Je koopt geen “tekst uit een PDF.” Je koopt een document dat de rest van je stack kan gebruiken.
Zet je PDF's om in schone, gestructureerde Markdown — klaar voor bewerken, zoeken, AI, RAG en meer.
Converteer een PDFKies het juiste formaat
Zie ze als een keten, niet als een keuze: PDF is voor levering en lezen → Markdown is voor bewerken en verwerken → PDF naar Markdown maakt van bestaande PDF's gestructureerde inhoud waar je mee kunt werken.
PDF is op z'n best als de inhoud getoond, gedeeld, gedrukt of gearchiveerd moet worden zonder drift.
De taak van PDF, in één zin: Wat zij zien moet matchen met wat ik maakte.
| Gebruik | Waarom PDF |
|---|---|
| Contracten | Layout blijft vast voor beide partijen en het archief. |
| Rapporten | Grafieken, tekst en paginalayout blijven consistent. |
| Papers / onderzoek | Formeel publiceren en lezen. |
| E-books | Hoofdstukken, figuren en pagina-ontwerp blijven staan. |
| Producthandleidingen | Mensen kunnen downloaden, lezen of printen. |
| Facturen / bonnen | Het formulier schuift niet. |
| Bedrijfsdocumenten | Formele distributie. |
| Cursusmateriaal | Colleges en leerboeken in één bestand. |
| Paginageometrie overleeft de printer. | |
| Archieven | Een stabiele eindversie. |
Markdown is op z'n best als je nog moet bewerken, bijwerken, zoeken, converteren of software laten lezen.
De taak van Markdown, in één zin: Maak de inhoud makkelijk te bewerken, beheren, zoeken en parsen.
| Gebruik | Waarom Markdown |
|---|---|
| Technische docs | Ontwikkelaars kunnen het direct bewerken. |
| Kennisbanken | Structuur is helder; organiseren is makkelijk. |
| Blogs / schrijven | Snel schrijven; makkelijk een pagina van maken. |
| Productdocumentatie | Hoofdstukken, secties en codeblokken zijn first-class. |
| AI-kennisbanken | Modellen gaan beter om met gestructureerde tekst. |
| Zoeken | Platte tekst is makkelijker te indexeren. |
| RAG | Schonere chunking, embedding en retrieval. |
| Git / GitHub | Platte tekst is waar versiebeheer voor is. |
| Project-READMEs | Native op GitHub en vergelijkbare platforms. |
| Contentconversie | Eén bron → HTML, PDF en andere output. |
Realiteit: een enorme hoeveelheid belangrijk materiaal is al PDF. Daarna moet je:
Dat is de conversie. PDF → Markdown.
Hoe het werkt
Een rapport, handleiding, paper, handboek, SOP of archief-PDF — inclusief bestanden die tekst, tabellen, afbeeldingen en links mengen.
We halen meer terug dan een tekstdump: koppen, lijsten, tabellen, links en leesvolgorde, zodat de Markdown nog documentvorm heeft.
Bewerk. Zoek. Chunk. Embed. Publiceer. Geef het aan een LLM. Zet het in Git.
Toepassingen
Een bedrijf heeft al duizend PDF's: producthandleidingen, technische docs, interne SOP's, contracten, onderzoeksrapporten, trainingsmateriaal. Het doel is een assistent die uit die bestanden antwoordt. PDF's in de pijplijn dumpen is meestal niet de beste eerste zet.
De stapel die je al hebt
De pijplijn die werkt
PDF → structured Markdown → chunking → embedding → vector database → RAG → AI assistant
PDF naar Markdown is de dataprep-stap voor een AI-kennisbank. Zonder structuur snijdt chunking op de verkeerde plek, mengen embeddings losse secties, en geeft retrieval blobs in plaats van antwoorden. Met Markdown is een kop een kop, een tabel een tabel, en kan een sectie als sectie worden opgehaald.
Je hebt een bestand van 100 pagina's: 2026 Global Market Research Report. Je wilt dat ChatGPT, Claude of Gemini het rapport samenvat, kerncijfers haalt, concurrenten analyseert, markttrends vindt en vragen uit het document beantwoordt.
Wat je van het model wilt
Na conversie kan het model de outline volgen in plaats van te gokken. Dat is het verschil tussen “plak een muur tekst” en “geef het model een document.”
# Executive Summary ## Market Overview ... ## Market Size ... ## Competitive Landscape ### Company A ... ### Company B ...
Onderzoekers leven in PDF's. Als Markdown kun je de volledige tekst zoeken, secties extraheren, een onderzoeksbibliotheek organiseren, een literatuurkennisbank bouwen, samenvatten met AI, RAG over het corpus draaien en papers vergelijken.
Research Paper 1.pdf Research Paper 2.pdf Research Paper 3.pdf Research Paper 4.pdf …
PDF
→ Markdown
→ research knowledge base
→ AI
→ “Compare what these 50 papers
conclude about RAG.”De papers blijven citeerbaar als PDF. De werk kopie wordt iets waar je queries op kunt doen.
Veel bestaand technisch materiaal gaat nog als PDF de deur uit. Teams willen levende bestanden — dan horen ze in GitHub, GitLab, Notion, een documentatiesite of een interne kennisbank.
Van vergrendelde handleidingen
Naar bestanden die je kunt onderhouden
Onderhoud wordt goedkoper: diffs, reviews, zoeken en opnieuw publiceren werken zoals software al werkt.
PDF naar Markdown voor Obsidian · PDF naar Markdown voor Notion
Een producthandleiding die een download was, kan een site worden. De PDF is een bestand dat mensen bewaren. Het Markdown-pad wordt documentatie die je kunt zoeken, navigeren en op het web openen.
PDF product manual → Markdown → HTML → documentation website
Het bedrijf heeft al Company Handbook.pdf. Dat mag niet in dat ene bestand gevangen blijven. Dat is hergebruik: één bron van waarheid, veel output — omdat de structuur eindelijk los van de pagina bestaat.
PDF
→ Markdown
├── blog article
├── website content
├── FAQ
├── knowledge base
├── AI dataset
└── documentationVoor / na
Introduction Getting started Install the CLI... 1. Download 2. Configure
# Introduction ## Getting started Install the CLI... 1. Download 2. Configure
Regels op een pagina. Misschien de juiste volgorde. Misschien niet. Kopniveau is een gok. Na conversie zijn koppen, grenzen en hiërarchie expliciet — dat is het verschil tussen strings van een pagina trekken en een document terughalen.
AI-systemen gebruiken die hiërarchie. Zoeken ook. Editors ook. Een PDF geeft hem niet cadeau.
Na conversie
Houd de PDF voor mensen. Converteer als de volgende lezer een editor, zoekindex, model of site is.
Lezen / Delen / Printen
Schrijven / Structuur / Verwerken
Extraheren / Converteren / Hergebruiken
Voor wie
Handleidingen, SOP's, contracten en training decks omzetten in RAG-assistenten.
Zoeken, vergelijken en vragen stellen over papers en lange rapporten.
API-PDF's, gebruikershandleidingen en handboeken naar Git, Notion of een docs-site.
Bewerken, tabellen extraheren, als website herpubliceren, of een bestand hergebruiken dat nooit een werkkopie was.
Als de PDF klaar is, laat hem PDF. Als het werk niet klaar is, converteer.
Waar mensen op zoeken
Die queries zitten naast de hoofdquery. Elke is een klus die het bestand moet overleven — geen extra college over formaten.
Een gescand handboek is een stapel afbeeldingen. Er is geen tekstlaag tot OCR draait — en OCR alleen laat een stroom tekens achter. Het nuttige pad is OCR plus structuur: leesvolgorde, kopniveaus, tabellen als tabellen, niet als foto van een raster. Zo wordt een scan iets dat je kunt zoeken, chunking of bewerken. Contracten, facturen en oudere papers zijn vaak scans; born-digital bestanden kunnen OCR overslaan, scans kunnen de outline niet overslaan.
Open de OCR-converterAls je een PDF as-is embed, snijdt de splitter vaak midden in een tabel of sectie omdat hij nooit een kop zag. Retrieval geeft dan een blob die gerelateerd lijkt en het niet is. Geef de pijplijn Markdown met expliciete koppen en echte tabellen, en chunking kan de outline volgen. Conversie vervangt je chunk size niet. Het voorkomt dat het model kop- en voetteksten als antwoord embedt.
LLM- & RAG-klare MarkdownKopiëren-plakken en naïeve extractors pletten een tweekoloms rapport tot één stroom: de kop is alleen grotere letters, de tabel restspaties. Downstream kun je geen kolom sorteren of “sectie 4.2” ophalen. Conversie moet Markdown-koppen en pipe-tabellen uitgeven, met leesvolgorde zoals een mens de pagina leest.
Extraheer tabellen naar MarkdownPagina's plakken in ChatGPT, Claude of Gemini is prima voor een eenmalige samenvatting. Het is een zwak plan voor een bibliotheek. Het model krijgt een zwak geordende blob. Converteer eerst, prompt daarna: de outline zit in het bestand, en dezelfde Markdown kan naar een ander model, interne RAG of Git.
Converteer voor ChatGPT & LLM'sEén bestand is een demo. Operaties zien eruit als een map: tweehonderd handleidingen, een contractarchief, een paper-corpus. Batchconversie moet bestandsnamen behouden, bestaande .md overslaan, en zichtbaar falen als een scan OCR nodig heeft. Begin met lelijke samples voordat je de job op alles zet.
Open de batchconverterFAQ
Dat kan, voor één keer. Een rapport van 100 pagina's landt nog steeds als een zwak gestructureerde blob. Geconverteerde Markdown maakt de outline expliciet, zodat samenvatting, extractie en Q&A iets hebben om vast te houden. Voor een kennisbank is het gat groter: RAG wil chunks met echte koppen, geen paginacoördinaten. Conversie draait volledig in je browser; het bestand wordt niet naar ons geüpload.
Word mengt layout nog in het bestand. Platte tekst gooit de hiërarchie weg. Markdown bewaart inhoud en structuur en laat het pagina-ontwerp vallen — precies wat bewerken, Git, zoeken, embeddings en LLM's nodig hebben.
Tekst, koppen, tabellen, lijsten, links en documentstructuur. Het punt is geen ruwe dump. Het punt is een bestand dat nog een outline heeft. Paginaheaders, voetteksten en paginanummers worden automatisch verwijderd.
Veel PDF's zijn afbeeldingen van pagina's. Die hebben OCR nodig voordat er tekst is om te structureren. Gebruik de ingebouwde OCR-converter, die tekst herkent in je browser.
Dat zijn de lastige gevallen — en ze komen vaak voor. Daarom bestaat er een dedicated PDF → Markdown-stap. Conversie die alleen strings plakt, verstoort leesvolgorde en mist de outline.
Beide. Eén rapport, zodat je een LLM ernaar kunt vragen. Duizend handleidingen, SOP's en trainings-PDF's, zodat je kunt chunking, embedden en ophalen. Gebruik de batchconverter voor mappen. Het blijft lokaal.
Ja, als je een stabiel, printgetrouw, deelbaar origineel nodig hebt. Conversie vervangt PDF niet voor contracten, facturen of archiefkopieën. Het ontgrendelt een tweede leven voor dezelfde inhoud.
Dat is een van de redenen om te converteren. Markdown wordt makkelijk HTML, PDF, Word, docs-sites, FAQ's, blogposts en AI-datasets. De PDF was een download. De Markdown is een bron.
Aan de slag
PDF's zijn geweldig om te lezen en te delen, maar niet ontworpen voor moderne contentworkflows. Markdown maakt inhoud gestructureerd, bewerkbaar, doorzoekbaar en AI-vriendelijk.
Zet je PDF's om in schone, gestructureerde Markdown — klaar voor bewerken, zoeken, AI, RAG en meer.