DEEN

PDF zu Markdown konvertieren

Text aus PDFs als strukturiertes Markdown — direkt im Browser.

    Ohne Upload: Deine PDFs bleiben auf deinem Gerät

    Die Text-Extraktion läuft vollständig lokal in deinem Browser — kein Upload, kein Server, keine Registrierung. Auch vertrauliche Berichte, Verträge oder interne Unterlagen kannst du damit bedenkenlos in Markdown umwandeln.

    PDFs sind fürs Lesen und Drucken gemacht, nicht fürs Weiterverarbeiten: Der Text steckt in einem festen Layout ohne logische Struktur. Wer den Inhalt in ein Wiki übernehmen, in einem Editor weiterbearbeiten oder einem KI-Tool übergeben will, muss ihn erst wieder herauslösen — genau das leistet dieser Converter, indem er PDF in Markdown umwandelt.

    Dabei wird der Text Seite für Seite extrahiert und die Struktur rekonstruiert: Überschriften erkennt der Converter am Schriftgrößen-Verhältnis zum Fließtext und gibt sie als #-, ##- oder ###-Headings aus. Kurze fett gedruckte Zeilen werden als Zwischenüberschriften behandelt, Seitenwechsel als Trennlinien markiert.

    Wichtig zu wissen: Die Erkennung arbeitet heuristisch und funktioniert am besten bei textbasierten PDFs mit klarer Typografie. Gescannte PDFs (Bilder von Text) bräuchten OCR, das dieser Converter nicht bietet; auch Tabellen und mehrspaltige Layouts werden nicht rekonstruiert. Liegt dein Dokument zusätzlich als Word-Datei vor, nimm besser den Weg über DOCX zu Markdown — dort werden Tabellen und Bilder vollständig übernommen.

    Wofür PDF zu Markdown konvertieren?

    KI-Workflows: PDFs als LLM-Kontext

    PDFs sind für Sprachmodelle ein schwieriges Eingabeformat: Layout-Reste und fehlende Struktur verwässern den Kontext. Als Markdown übergeben, bekommen ChatGPT, Claude & Co. sauberen, strukturierten Text mit erkannten Überschriften — das verbessert Zusammenfassungen, Analysen und Antworten spürbar.

    Recherche & Wissensdatenbanken

    Berichte, Papers und Broschüren liegen oft nur als PDF vor. Konvertiert zu Markdown werden sie in Obsidian, Notion oder einem Wiki durchsuchbar, verlinkbar und zitierbar — statt als geschlossene Datei im Downloads-Ordner zu liegen.

    Dokumentation migrieren

    Wer bestehende PDF-Handbücher oder Anleitungen in ein modernes Doku-System überführen will — Wiki, Git-Repository oder Static-Site-Generator —, bekommt mit der Konvertierung eine strukturierte Markdown-Basis, die sich anschließend gezielt nachbearbeiten lässt, statt alles per Hand aus dem PDF-Viewer zu kopieren.

    So wandelst du eine PDF-Datei in Markdown um

    1. Ziehe deine .pdf-Datei in das Feld oben oder wähle sie per Klick aus.
    2. Der Text wird Seite für Seite extrahiert und mit erkannten Überschriften als Markdown ausgegeben. Prüfe das Ergebnis in der Vorschau.
    3. Korrigiere bei Bedarf einzelne Überschriften direkt im Markdown-Tab und lade das Ergebnis als .md-Datei herunter.

    Fragen zur PDF-Konvertierung

    Warum werden manche Überschriften nicht erkannt?

    Die Überschriften-Erkennung basiert auf dem Schriftgrößen-Verhältnis zum Fließtext: Deutlich größere Zeilen werden zu #- oder ##-Headings, leicht größere oder kurze fette Zeilen zu ###. Setzt ein PDF Überschriften in derselben Größe wie den Fließtext — nur fett oder farbig —, können sie als normaler Text durchgehen. Im Markdown-Tab des Ergebnisses lässt sich das direkt korrigieren.

    Funktionieren gescannte PDFs?

    Nein. Gescannte PDFs enthalten Bilder von Text statt echten, auswählbaren Text. Um daraus Markdown zu machen, wäre OCR (optische Texterkennung) nötig — die bietet dieser Converter aktuell nicht. Es eignen sich also nur PDFs, in denen sich der Text im PDF-Viewer markieren und kopieren lässt; das ist zugleich der schnellste Test vor der Konvertierung.

    Werden Tabellen aus PDFs übernommen?

    Nein. Das PDF-Format speichert Tabellen nur als einzeln positionierte Textfragmente ohne Zeilen- und Spaltenstruktur — eine zuverlässige Rekonstruktion als Markdown-Tabelle ist daraus nicht möglich, deshalb verzichtet dieser Converter bewusst darauf. Liegt das Dokument auch als Word-Datei vor, lohnt der Weg über die DOCX-Konvertierung: Dort werden Tabellen vollständig als Markdown-Pipe-Tabellen übernommen.

    Was bedeutet die Trennlinie (---) im Ergebnis?

    Jeder Seitenwechsel im PDF wird im Markdown als horizontale Trennlinie (---) markiert. So bleibt nach der Konvertierung nachvollziehbar, welcher Inhalt von welcher Seite stammt — hilfreich beim Gegenlesen langer Dokumente. Wer die Markierungen nicht braucht, löscht die Linien einfach im Markdown-Tab oder nach dem Download im Editor.