Nicht jede Konvertierung braucht eine Installation
Für eine einmalige, überschaubare Konvertierung ist der Browser meist schneller: Datei öffnen, Markdown prüfen und Ergebnis herunterladen.
Der Agent Skill wird interessant, wenn Codex oder Claude Code ohnehin mit den Dateien arbeitet. Dann kann der Agent einen Bericht extrahieren, den Markdown-Entwurf überarbeiten, eine neue Datei erzeugen und das Ergebnis prüfen, ohne den Arbeitsablauf für einen separaten Konvertierungsdienst zu verlassen.
| Aufgabe | Sinnvoller Einstieg |
|---|---|
| Eine einfache Datei einmalig umwandeln | Browser-Konverter |
| Markdown schnell bearbeiten oder anzeigen | Browser-Werkzeug |
| Wiederholte Konvertierung im Agenten | Agent Skill |
| PDF → Markdown → DOCX oder anderes Ziel | Agent Skill |
| Der Agent soll das Ergebnis prüfen | Agent Skill |
| Komplexes Layout muss exakt erhalten bleiben | Formatspezifischer Ablauf mit manueller Kontrolle |
Markdown ist die bearbeitbare Zwischenstufe
Markdown bildet Überschriften, Absätze, Listen, Links, Code und viele einfache Tabellen so ab, dass Menschen und Agenten sie direkt bearbeiten können. Dadurch eignet es sich als Arbeitsformat zwischen Quelldatei und neuem Ergebnis.
Diese Zwischenstufe begrenzt zugleich die Wiedergabetreue. Aus einer PowerPoint-Datei wird lesbarer Folieninhalt, nicht das ursprüngliche Design. Eine später erzeugte PPTX entsteht neu aus dem Markdown und kann verlorene Positionen, Animationen, Schriften oder Medien nicht zurückholen.
Der Ablauf passt, wenn der Inhalt wichtiger ist als eine pixelgenaue Reproduktion.
Markdown Converter als Agent Skill installieren
Der Skill verwendet das offene Agent-Skills-Format und ist für Codex, Claude Code sowie kompatible Clients gedacht. Er benötigt Node.js 20 oder neuer. Laufzeit, OCR, unterstützte Sprachdaten, Schriften, Renderer und Prüfsystem sind im Repository enthalten.
MARKDOWN_CONVERTER_DIR muss auf den installierten Ordner mit der Datei SKILL.md zeigen. Das aktuelle Arbeitsverzeichnis ist nicht automatisch der Skill-Ordner.
npx skills add agent-tools-lab/markdown-converter --skill markdown-converternode "$MARKDOWN_CONVERTER_DIR/scripts/runtime/convert.mjs" INPUT --to FORMAT -o OUTPUTEin PDF mit Textebene in Markdown umwandeln
Lässt sich in einem PDF-Reader ein Satz markieren, ist die normale Textextraktion der richtige erste Schritt. Absätze, Überschriften und Aufzählungen bleiben häufig erkennbar.
PDF speichert jedoch positionierte Seiteninhalte statt einer vollständigen Dokumentstruktur. Spalten, komplexe Tabellen, Formeln, Fußnoten und ungewöhnliche Typografie müssen deshalb nach der Extraktion geprüft werden.
node "$MARKDOWN_CONVERTER_DIR/scripts/runtime/convert.mjs" bericht.pdf --to markdown -o bericht.mdbericht.md — bearbeitbarer Entwurf aus der TextebeneOCR nur für bildbasierte PDF-Seiten einsetzen
Eine gescannte Seite kann wie Text aussehen, obwohl sie technisch nur ein Bild enthält. Der Skill extrahiert vorhandenen Text und wendet lokale OCR nur auf Seiten ohne brauchbare Textebene an.
Mitgeliefert werden Modelle für Englisch, Spanisch, Deutsch, Japanisch und vereinfachtes Chinesisch. Pro PDF gelten derzeit 30 MB, 100 Seiten insgesamt und höchstens 20 OCR-Seiten.
OCR liefert einen zu prüfenden Entwurf. Namen, Datumsangaben, Beträge, Satzzeichen, Überschriften und Tabellen sollten mit dem Scan verglichen werden. Handschrift und eine exakte Rekonstruktion komplexer Tabellen sind nicht zugesagt.
node "$MARKDOWN_CONVERTER_DIR/scripts/runtime/convert.mjs" scan.pdf --to markdown --ocr-language deu -o scan.mdNamen · Zahlen · Datumsangaben · Lesereihenfolge · Tabellen| OCR-Sprache | Code |
|---|---|
| Englisch | eng |
| Spanisch | spa |
| Deutsch | deu |
| Japanisch | jpn |
| Vereinfachtes Chinesisch | chi_sim |
Ein Word-Dokument in bearbeitbares Markdown überführen
Textorientierte DOCX-Dateien eignen sich am besten. Absätze, Überschriften, Listen, Links und einfache Tabellen lassen sich sinnvoll in Markdown abbilden und anschließend vom Agenten bearbeiten.
Exaktes Seitenlayout, eingebettete Medien, Kommentare, Änderungsverfolgung, Makros, schwebende Objekte, Schriften und Abstände bleiben nicht zuverlässig erhalten. Ist das Layout selbst entscheidend, sollte die ursprüngliche DOCX-Datei im Word-Ablauf bleiben.
node "$MARKDOWN_CONVERTER_DIR/scripts/runtime/convert.mjs" bericht.docx --to markdown -o bericht.mdÜberschriften, Listen und Tabellen prüfen, dann bearbeiten oder neu exportierenAus Markdown ein durchsuchbares PDF erzeugen
Der PDF-Writer erstellt ein neues A4-Dokument mit echten Textobjekten, statt jede Seite als Bild einzubetten. Unterstützte Zeichen lassen sich suchen, markieren, kopieren und extrahieren.
Begann der Ablauf mit einem anderen PDF, wird dessen Seitengestaltung nicht wiederhergestellt. Das Ergebnis wird aus dem geprüften Markdown neu gesetzt.
node "$MARKDOWN_CONVERTER_DIR/scripts/runtime/convert.mjs" notizen.md --to pdf -o notizen.pdfnotizen.pdf öffnen und einen repräsentativen Satz markierenUnterstützte Formate richtig einordnen
Jede Nicht-Markdown-Eingabe wird zunächst zu bearbeitbarem Markdown. Eine weitere Ausgabe entsteht aus dieser Zwischenstufe und ist keine direkte Kopie der ursprünglichen Datei.
Einige Zielnamen brauchen Kontext: JSON enthält Markdown-Token, Confluence liefert altes Wiki Markup und Notion erzeugt importorientiertes Markdown. Das sind weder beliebige Geschäftsdaten noch API-Aktionen oder eine Garantie für jeden modernen Cloud-Editor.
| Bereich | Beispiele | Wichtigste Grenze |
|---|---|---|
| Eingaben | PDF, DOCX, XLSX/XLS, PPTX, HTML, TXT, CSV, JSON, XML | Inhalt und Struktur werden Markdown; Layout und Anwendungslogik können verloren gehen |
| Dokumente | PDF, DOCX, XLSX, PPTX, EPUB | Neue Dateien entstehen aus Markdown |
| Publikation und Text | HTML, LaTeX, AsciiDoc, RTF, RST, Confluence, Notion, Reveal, WeChat | Jedes Ziel besitzt eigene Kompatibilitätsgrenzen |
| Daten und Bilder | CSV, Token-JSON, Mindmap-JSON, PNG, JPG, Card | Die Quelle braucht passende Struktur; Card ist eine Zusammenfassung |
Das erzeugte Artefakt vor der Übergabe prüfen
Ein erfolgreich beendeter Befehl beweist noch nicht, dass die Datei inhaltlich brauchbar ist. Führe den mitgelieferten Verifier aus und öffne danach repräsentative Stellen in der vorgesehenen Anwendung.
Schlägt die Prüfung fehl, gilt auch die Konvertierung als fehlgeschlagen. Die Quelldatei bleibt erhalten; Ergebnisse gehören auf einen neuen Pfad.
- Datei vorhanden, nicht leer und in der Zielanwendung zu öffnen.
- Ausgewählte Überschriften und Absätze mit der Quelle vergleichen.
- Umlaute und andere Nicht-ASCII-Zeichen kontrollieren.
- Bei PDF mindestens einen echten Satz markieren oder extrahieren.
- Bei OCR Namen, Zahlen, Überschriften und einen vollständigen Absatz mit dem Scan abgleichen.
python3 "$MARKDOWN_CONVERTER_DIR/scripts/verify_output.py" notizen.pdf --format pdfÜberschriften · Absätze · Listen · Tabellen · Links · Umlaute · TextextraktionLokale Verarbeitung ist nicht gleich verlustfreie Umwandlung
Erzeugte Dateien erhalten kein Produktlogo, Wasserzeichen, Werbe-Footer, Attributionslink oder versteckte Produktmetadaten.
Trotzdem kann Markdown nicht jedes Seitenlayout, Tabellenblattverhalten, Kommentare, Änderungsverfolgung, Animationen, Sprechernotizen, Medien, Gleichungen oder komplexe Tabellen abbilden. Wenn genau diese Elemente das eigentliche Ergebnis sind, ist ein formatspezifischer Arbeitsablauf die bessere Wahl.
Passende Werkzeuge
Häufige Fragen
Kann Codex mit diesem Skill PDF in Markdown umwandeln?
Ja. Text-PDFs verwenden lokale Extraktion. Bildbasierte Seiten können innerhalb der dokumentierten Sprach-, Größen- und Seitenlimits lokale OCR nutzen.
Funktioniert derselbe Skill auch mit Claude Code?
Ja. Das Repository nutzt das produktneutrale Agent-Skills-Format für Codex, Claude Code und kompatible Clients.
Benötigt jedes PDF OCR?
Nein. PDFs mit brauchbarer Textebene sollten direkt extrahiert werden. OCR ist für bildbasierte Seiten ohne lesbaren nativen Text vorgesehen.
Lassen sich Word, Excel und PowerPoint in Markdown umwandeln?
DOCX, XLSX/XLS und PPTX werden unterstützt. Erhalten bleiben lesbarer Inhalt und Grundstruktur, nicht das vollständige Office-Layout, Formeln, Animationen oder Medien.
Kann Markdown wieder als Word oder PowerPoint ausgegeben werden?
DOCX und PPTX sind unterstützte Ausgaben. Sie werden neu aus Markdown erzeugt und rekonstruieren keine frühere Quelldatei exakt.
Ist der erzeugte PDF-Text durchsuchbar?
Für unterstützte Zeichen ja. Der Writer erzeugt echte Textobjekte, und die Prüfung kontrolliert eine nicht leere extrahierbare Textebene.
Wann ist ilovemd.net die bessere Wahl?
Für eine einzelne Konvertierung, Bearbeitung oder Vorschau im Browser. Der Skill eignet sich für wiederholte oder mehrstufige Abläufe im Agenten.
Wo lässt sich Markdown Converter installieren?
Unter https://github.com/agent-tools-lab/markdown-converter; der Installationsbefehl lautet npx skills add agent-tools-lab/markdown-converter --skill markdown-converter.
