PDF zu Markdown

Mit PDF to Markdown können Sie PDF-Dateien mit OCR für gescannte Dokumente in Markdown-Text konvertieren. unterstützt Bangla, Englisch und mehr. direkt in Ihrem Browser mit sicherer Serververarbeitung.

Your files are processed securely and automatically deleted after processing. We do not permanently store your files.

Drag & drop files here, or click to browse

Max size: 500 MB

OCR languages (122 supported)

All Tesseract OCR languages are listed. Your server must have the matching .traineddata files installed.

Key capabilities

  • Konvertieren Sie PDF-Dateien mit OCR für gescannte Dokumente in Markdown-Text. Unterstützt Bangla, Englisch und mehr.
  • Sichere Serververarbeitung
  • Kostenlose Nutzung

Anleitung

  1. Laden Sie Ihr PDF hoch (textbasiert oder gescannt).
  2. Wählen Sie „Auto“ (empfohlen), „Nur Text“ oder „OCR“ für gescannte Seiten.
  3. Wählen Sie OCR-Sprachen aus, z. B. Englisch + Bangla für zweisprachige Dokumente.
  4. Klicken Sie auf „Verarbeiten“ und laden Sie die .md-Datei herunter.

How this tool works

  1. Laden Sie Ihr PDF hoch (textbasiert oder gescannt).
  2. Wählen Sie „Auto“ (empfohlen), „Nur Text“ oder „OCR“ für gescannte Seiten.
  3. Wählen Sie OCR-Sprachen aus, z. B. Englisch + Bangla für zweisprachige Dokumente.
  4. Klicken Sie auf „Verarbeiten“ und laden Sie die .md-Datei herunter.

Recommended settings

  • Verwenden Sie zunächst die Standardoptionen und passen Sie sie dann bei Bedarf an

Supported formats

application/pdf

File size and limits

  • Die maximale Upload-Größe wird in den Site-Einstellungen gesteuert (häufig 50–100 MB, abhängig von der Administratorkonfiguration).
  • Bei sehr großen oder stark gescannten PDFs kann die Verarbeitung länger dauern.

Privacy

Dokumententools verarbeiten Dateien auf unseren sicheren Servern. Uploads werden nur vorübergehend gespeichert und gelöscht, nachdem Sie das Ergebnis heruntergeladen haben oder nach dem Aufbewahrungszeitlimit (Standard 30 Minuten).

Common use cases

  • Verwenden Sie PDF to Markdown, wann immer Sie es brauchen: Konvertieren Sie PDF-Text mit OCR für gescannte Dokumente in Markdown. Unterstützt Bangla, Englisch und mehr.

Troubleshooting

Die Verarbeitung schlägt fehl oder es kommt zu einer Zeitüberschreitung

Versuchen Sie es mit einer kleineren Datei, weniger Seiten oder einer niedrigeren Komprimierungs-/Qualitätseinstellung. Aktualisieren und erneut hochladen.

Download-Link abgelaufen

Die Ergebnisse sind vorübergehend. Führen Sie das Tool erneut aus und laden Sie es umgehend herunter.

FAQ

Speichern Sie meine Dateien?

Nein. Dateien werden vorübergehend verarbeitet und automatisch gelöscht. Wir speichern Ihre Uploads niemals dauerhaft.

Wie lange werden Dateien aufbewahrt?

Dateien werden gelöscht, nachdem Sie das Ergebnis heruntergeladen haben oder nach einer kurzen Zeitüberschreitung (Standard 30 Minuten), je nachdem, was zuerst eintritt.

Unterstützt es Bangla und andere Sprachen?

Ja. Wählen Sie für gescannte PDFs Bangla (Ben), Englisch (Eng) oder mehrere Sprachen. Tesseract-Sprachpakete müssen auf dem Server installiert sein.

Was ist der Unterschied zwischen Auto und OCR?

Liest eingebetteten Text automatisch, sofern verfügbar, und greift bei gescannten Seiten auf OCR zurück. OCR führt immer eine optische Zeichenerkennung für jedes Seitenbild durch.

Educational guides

Verwandte Tools