Nicht jede Konvertierung braucht eine Installation

Für eine einmalige, überschaubare Konvertierung ist der Browser meist schneller: Datei öffnen, Markdown prüfen und Ergebnis herunterladen.

Der Agent Skill wird interessant, wenn Codex oder Claude Code ohnehin mit den Dateien arbeitet. Dann kann der Agent einen Bericht extrahieren, den Markdown-Entwurf überarbeiten, eine neue Datei erzeugen und das Ergebnis prüfen, ohne den Arbeitsablauf für einen separaten Konvertierungsdienst zu verlassen.

AufgabeSinnvoller Einstieg
Eine einfache Datei einmalig umwandelnBrowser-Konverter
Markdown schnell bearbeiten oder anzeigenBrowser-Werkzeug
Wiederholte Konvertierung im AgentenAgent Skill
PDF → Markdown → DOCX oder anderes ZielAgent Skill
Der Agent soll das Ergebnis prüfenAgent Skill
Komplexes Layout muss exakt erhalten bleibenFormatspezifischer Ablauf mit manueller Kontrolle

Markdown ist die bearbeitbare Zwischenstufe

Markdown bildet Überschriften, Absätze, Listen, Links, Code und viele einfache Tabellen so ab, dass Menschen und Agenten sie direkt bearbeiten können. Dadurch eignet es sich als Arbeitsformat zwischen Quelldatei und neuem Ergebnis.

Diese Zwischenstufe begrenzt zugleich die Wiedergabetreue. Aus einer PowerPoint-Datei wird lesbarer Folieninhalt, nicht das ursprüngliche Design. Eine später erzeugte PPTX entsteht neu aus dem Markdown und kann verlorene Positionen, Animationen, Schriften oder Medien nicht zurückholen.

Der Ablauf passt, wenn der Inhalt wichtiger ist als eine pixelgenaue Reproduktion.

Markdown Converter als Agent Skill installieren

Der Skill verwendet das offene Agent-Skills-Format und ist für Codex, Claude Code sowie kompatible Clients gedacht. Er benötigt Node.js 20 oder neuer. Laufzeit, OCR, unterstützte Sprachdaten, Schriften, Renderer und Prüfsystem sind im Repository enthalten.

MARKDOWN_CONVERTER_DIR muss auf den installierten Ordner mit der Datei SKILL.md zeigen. Das aktuelle Arbeitsverzeichnis ist nicht automatisch der Skill-Ordner.

Skill installieren
npx skills add agent-tools-lab/markdown-converter --skill markdown-converter
Portables Aufrufmuster
node "$MARKDOWN_CONVERTER_DIR/scripts/runtime/convert.mjs" INPUT --to FORMAT -o OUTPUT

Ein PDF mit Textebene in Markdown umwandeln

Lässt sich in einem PDF-Reader ein Satz markieren, ist die normale Textextraktion der richtige erste Schritt. Absätze, Überschriften und Aufzählungen bleiben häufig erkennbar.

PDF speichert jedoch positionierte Seiteninhalte statt einer vollständigen Dokumentstruktur. Spalten, komplexe Tabellen, Formeln, Fußnoten und ungewöhnliche Typografie müssen deshalb nach der Extraktion geprüft werden.

Text-PDF → Markdown
node "$MARKDOWN_CONVERTER_DIR/scripts/runtime/convert.mjs" bericht.pdf --to markdown -o bericht.md
Ergebnis
bericht.md — bearbeitbarer Entwurf aus der Textebene

OCR nur für bildbasierte PDF-Seiten einsetzen

Eine gescannte Seite kann wie Text aussehen, obwohl sie technisch nur ein Bild enthält. Der Skill extrahiert vorhandenen Text und wendet lokale OCR nur auf Seiten ohne brauchbare Textebene an.

Mitgeliefert werden Modelle für Englisch, Spanisch, Deutsch, Japanisch und vereinfachtes Chinesisch. Pro PDF gelten derzeit 30 MB, 100 Seiten insgesamt und höchstens 20 OCR-Seiten.

OCR liefert einen zu prüfenden Entwurf. Namen, Datumsangaben, Beträge, Satzzeichen, Überschriften und Tabellen sollten mit dem Scan verglichen werden. Handschrift und eine exakte Rekonstruktion komplexer Tabellen sind nicht zugesagt.

Deutsches Scan-PDF → Markdown
node "$MARKDOWN_CONVERTER_DIR/scripts/runtime/convert.mjs" scan.pdf --to markdown --ocr-language deu -o scan.md
Besonders prüfen
Namen · Zahlen · Datumsangaben · Lesereihenfolge · Tabellen
OCR-SpracheCode
Englischeng
Spanischspa
Deutschdeu
Japanischjpn
Vereinfachtes Chinesischchi_sim

Ein Word-Dokument in bearbeitbares Markdown überführen

Textorientierte DOCX-Dateien eignen sich am besten. Absätze, Überschriften, Listen, Links und einfache Tabellen lassen sich sinnvoll in Markdown abbilden und anschließend vom Agenten bearbeiten.

Exaktes Seitenlayout, eingebettete Medien, Kommentare, Änderungsverfolgung, Makros, schwebende Objekte, Schriften und Abstände bleiben nicht zuverlässig erhalten. Ist das Layout selbst entscheidend, sollte die ursprüngliche DOCX-Datei im Word-Ablauf bleiben.

DOCX → Markdown
node "$MARKDOWN_CONVERTER_DIR/scripts/runtime/convert.mjs" bericht.docx --to markdown -o bericht.md
Danach
Überschriften, Listen und Tabellen prüfen, dann bearbeiten oder neu exportieren
Markdown-Syntax nachschlagenTabellen, Listen, Links und Code vor dem nächsten Export prüfen

Aus Markdown ein durchsuchbares PDF erzeugen

Der PDF-Writer erstellt ein neues A4-Dokument mit echten Textobjekten, statt jede Seite als Bild einzubetten. Unterstützte Zeichen lassen sich suchen, markieren, kopieren und extrahieren.

Begann der Ablauf mit einem anderen PDF, wird dessen Seitengestaltung nicht wiederhergestellt. Das Ergebnis wird aus dem geprüften Markdown neu gesetzt.

Markdown → PDF
node "$MARKDOWN_CONVERTER_DIR/scripts/runtime/convert.mjs" notizen.md --to pdf -o notizen.pdf
Mindestprüfung
notizen.pdf öffnen und einen repräsentativen Satz markieren
Markdown im Browser in PDF umwandelnQuelle bearbeiten, Vorschau prüfen und ein Text-PDF herunterladen

Unterstützte Formate richtig einordnen

Jede Nicht-Markdown-Eingabe wird zunächst zu bearbeitbarem Markdown. Eine weitere Ausgabe entsteht aus dieser Zwischenstufe und ist keine direkte Kopie der ursprünglichen Datei.

Einige Zielnamen brauchen Kontext: JSON enthält Markdown-Token, Confluence liefert altes Wiki Markup und Notion erzeugt importorientiertes Markdown. Das sind weder beliebige Geschäftsdaten noch API-Aktionen oder eine Garantie für jeden modernen Cloud-Editor.

BereichBeispieleWichtigste Grenze
EingabenPDF, DOCX, XLSX/XLS, PPTX, HTML, TXT, CSV, JSON, XMLInhalt und Struktur werden Markdown; Layout und Anwendungslogik können verloren gehen
DokumentePDF, DOCX, XLSX, PPTX, EPUBNeue Dateien entstehen aus Markdown
Publikation und TextHTML, LaTeX, AsciiDoc, RTF, RST, Confluence, Notion, Reveal, WeChatJedes Ziel besitzt eigene Kompatibilitätsgrenzen
Daten und BilderCSV, Token-JSON, Mindmap-JSON, PNG, JPG, CardDie Quelle braucht passende Struktur; Card ist eine Zusammenfassung

Das erzeugte Artefakt vor der Übergabe prüfen

Ein erfolgreich beendeter Befehl beweist noch nicht, dass die Datei inhaltlich brauchbar ist. Führe den mitgelieferten Verifier aus und öffne danach repräsentative Stellen in der vorgesehenen Anwendung.

Schlägt die Prüfung fehl, gilt auch die Konvertierung als fehlgeschlagen. Die Quelldatei bleibt erhalten; Ergebnisse gehören auf einen neuen Pfad.

  • Datei vorhanden, nicht leer und in der Zielanwendung zu öffnen.
  • Ausgewählte Überschriften und Absätze mit der Quelle vergleichen.
  • Umlaute und andere Nicht-ASCII-Zeichen kontrollieren.
  • Bei PDF mindestens einen echten Satz markieren oder extrahieren.
  • Bei OCR Namen, Zahlen, Überschriften und einen vollständigen Absatz mit dem Scan abgleichen.
PDF prüfen
python3 "$MARKDOWN_CONVERTER_DIR/scripts/verify_output.py" notizen.pdf --format pdf
Danach kontrollieren
Überschriften · Absätze · Listen · Tabellen · Links · Umlaute · Textextraktion

Lokale Verarbeitung ist nicht gleich verlustfreie Umwandlung

Erzeugte Dateien erhalten kein Produktlogo, Wasserzeichen, Werbe-Footer, Attributionslink oder versteckte Produktmetadaten.

Trotzdem kann Markdown nicht jedes Seitenlayout, Tabellenblattverhalten, Kommentare, Änderungsverfolgung, Animationen, Sprechernotizen, Medien, Gleichungen oder komplexe Tabellen abbilden. Wenn genau diese Elemente das eigentliche Ergebnis sind, ist ein formatspezifischer Arbeitsablauf die bessere Wahl.

Passende Werkzeuge

Markdown-SpickzettelÜberschriften, Listen, Tabellen, Links und Code vor dem Export prüfenPDF in MarkdownText-PDFs und unterstützte Scan-Sprachen direkt im Browser verarbeitenMarkdown in PDFEin neues PDF mit such- und markierbarem Text erzeugen
FAQ

Häufige Fragen

Kann Codex mit diesem Skill PDF in Markdown umwandeln?

Ja. Text-PDFs verwenden lokale Extraktion. Bildbasierte Seiten können innerhalb der dokumentierten Sprach-, Größen- und Seitenlimits lokale OCR nutzen.

Funktioniert derselbe Skill auch mit Claude Code?

Ja. Das Repository nutzt das produktneutrale Agent-Skills-Format für Codex, Claude Code und kompatible Clients.

Benötigt jedes PDF OCR?

Nein. PDFs mit brauchbarer Textebene sollten direkt extrahiert werden. OCR ist für bildbasierte Seiten ohne lesbaren nativen Text vorgesehen.

Lassen sich Word, Excel und PowerPoint in Markdown umwandeln?

DOCX, XLSX/XLS und PPTX werden unterstützt. Erhalten bleiben lesbarer Inhalt und Grundstruktur, nicht das vollständige Office-Layout, Formeln, Animationen oder Medien.

Kann Markdown wieder als Word oder PowerPoint ausgegeben werden?

DOCX und PPTX sind unterstützte Ausgaben. Sie werden neu aus Markdown erzeugt und rekonstruieren keine frühere Quelldatei exakt.

Ist der erzeugte PDF-Text durchsuchbar?

Für unterstützte Zeichen ja. Der Writer erzeugt echte Textobjekte, und die Prüfung kontrolliert eine nicht leere extrahierbare Textebene.

Wann ist ilovemd.net die bessere Wahl?

Für eine einzelne Konvertierung, Bearbeitung oder Vorschau im Browser. Der Skill eignet sich für wiederholte oder mehrstufige Abläufe im Agenten.

Wo lässt sich Markdown Converter installieren?

Unter https://github.com/agent-tools-lab/markdown-converter; der Installationsbefehl lautet npx skills add agent-tools-lab/markdown-converter --skill markdown-converter.