Kernfunktionen
markitdown.ai unterstützt die Konvertierung aus 7 Eingangsformaten und 3 Ausgangsformaten. Alle Funktionen laufen auf einer gemeinsamen serverseitigen Parsing-Engine, die unabhängig vom Client-Gerät konsistente Ergebnisse erzeugt.
Unterstützte Eingangsformate:
PDF: Native Text-PDFs werden direkt geparst, die Lesereihenfolge bei mehrspaltigen Dokumenten wird neu aufgebaut, gescannte PDFs durchlaufen automatische OCR
DOCX / älteres DOC: Bewährt Überschriften, Listen, Tabellen und Kommentare aus Word-Dateien
PPTX / älteres PPT: Konvertiert Präsentationen Folie für Folie, behält Titel als Überschriften und Aufzählungspunkte bei
XLSX / älteres XLS: Jedes Arbeitsblatt wird zu einer Markdown-Tabelle unter seinem eigenen Blattnamen
PNG / JPG: Screenshots und gescannte Bilder werden per OCR verarbeitet, optional steht KI-Bildverstehen für angemeldete Nutzer zur Verfügung
HTML: Entfernt Skripte und Styles, behält Artikelstruktur, Links und Tabellen aus gespeicherten Webseiten bei
URL: Ruft öffentliche Webseiten serverseitig ab, blockiert private und interne Adressen, um das Lecken von eingeschränktem Inhalt zu vermeiden
Unterstützte umgekehrte Ausgangsformate, die vollständig lokal im Browser ausgeführt werden, ohne dass Nutzertexte hochgeladen werden:
Markdown zu HTML: Erzeugt semantisches Standard-HTML mit Unterstützung für GitHub-Tabellen, Aufgabenlisten und Code-Hervorhebung
Markdown zu Klartext: Wandelt die Struktur in lesbaren, unformatierten Text um, für Chat-Fenster, Support-Tickets und Formulareingaben
Markdown zu PDF: Stellt eine lokale Druckvorschau dar, die Nutzer über die native Druckfunktion ihres Browsers speichern können
Workflow-Optionen
Das Produkt bietet drei unterschiedliche Möglichkeiten, Konvertierungen auszuführen. Alle sind mit demselben Nutzerkonto und dem gemeinsamen Guthaben an Credits verbunden:
Web-App (Browser): Für anonyme Testnutzung ist keine Anmeldung erforderlich. Sie unterstützt das Hochladen einzelner Dateien oder Einfügen von URLs, mit einer maximalen Dateigröße von 10 MB und einem Limit von 25 Seiten im kostenlosen Testbereich. Nutzer können das gerenderte Markdown in der Vorschau anzeigen, Inhalte kopieren oder .md-Dateien direkt herunterladen.
Batch-Modus: Für Nutzer mit kostenpflichtigem Tarif. Er unterstützt die Verarbeitung mehrerer Dateien in einem Durchgang, mit Statusverfolgung pro Datei und einer gespeicherten Konvertierungsbibliothek.
Developer API: Nutzt exakt dieselbe Parsing-Pipeline wie die Weboberfläche. Sie unterstützt synchrone Konvertierungen unter 60 Sekunden, asynchrone Konvertierungen für längere Dateien mit Abfrage- oder Webhook-Benachrichtigungen zum Abschluss, bereichsgebundene API-Schlüssel und vollständige Aktivitätsprotokolle. Die öffentliche API-Referenz ist unter /docs/api abrufbar, die OpenAPI-Spezifikation liegt direkt unter /v1/openapi.json vor.
Zielgruppe und Anwendungsfälle
Das Tool ist für diese Kerngruppen und Anwendungsfälle ausgelegt:
RAG- und KI-Pipeline-Teams: Konvertieren Sie Quelldokumente vor dem Aufteilen und Einbetten, um Layout-Störungen zu beseitigen, Überschriftenhierarchien und Tabellenstrukturen zu bewahren und konsistente Abfrageergebnisse über Tausende von Dateien hinweg zu gewährleisten.
Forscher und Analysten: Wandeln Sie wissenschaftliche Arbeiten, Whitepaper und Präsentationen in durchsuchbares, bearbeitbares Markdown um, um das manuelle Neueingeben von Tabellen zu vermeiden und die korrekte Lesereihenfolge aus mehrspaltigen, dichten PDFs beizubehalten.
Betriebsteams: Verarbeiten Sie Verträge, Rechnungen, Richtlinien und interne Dokumente ohne manuelle Kopier- und Einfügebereinigung. Der gespeicherte Markdown-Verlauf vereinfacht die Überprüfung, den Vergleich und die Wiederverwendung von wiederkehrenden Dokumentenarbeiten.
Entwickler-Automatisierungsteams: Binden Sie die Konvertierung direkt in Erfassungsjobs, interne Tools und Dokumentenworkflows ein, mit vorhersehbarer Ausgabe, die zuverlässig in CMS-Systeme, Wissensdatenbanken und Support-Bots übergeben wird.
Agent-Entwickler: Fügen Sie die Markdown-Konvertierung als Werkzeug für KI-Agenten hinzu, sodass diese unterstützte Dateien und öffentliche Web-URLs verarbeiten können, ohne auf untergeordnete Parsing- oder OCR-Logik zurückzugreifen.
Preise und Nutzungsgrenzen
Die anonyme, anmeldefreie Testnutzung erlaubt 3 Konvertierungen pro Stunde und 10 Konvertierungen pro Tag, mit einer maximalen Dateigröße von 10 MB und maximal 25 Seiten pro Datei.
Für alle Tarife gilt eine kreditbasierte Abrechnung: Jede Standard-Textdateiseite oder per OCR verarbeitete Seite kostet 1 Credit. Die optional aktivierbare KI-Bildverstehens-Funktion kostet 5 Credits pro Bild. Der Preis pro Seite unterscheidet sich nicht zwischen Dokumenten mit Textebene und gescannten Dokumenten.
Kostenpflichtige Abonnements beginnen bei 20 US-Dollar pro Monat. Im Pro-Tarif steigen die Größengrenzen auf maximal 200 MB pro Datei und 200 Seiten pro Datei an. Kostenpflichtige Tarife schalten zudem die Batch-Verarbeitung, den API-Zugriff und einen längeren gespeicherten Verlauf für Konvertierungsergebnisse frei.
Wichtige Einschränkungen
Die Qualität der OCR-Erkennung hängt von der Auflösung des Quellbildes ab. Scans mit 300 dpi liefern deutlich genauere Textausgaben als niedrig aufgelöste Fotos von Smartphones.
Private und interne Webadressen werden für die URL-zu-Markdown-Konvertierung blockiert, um unbefugten Zugriff auf nicht öffentliche Inhalte zu verhindern.
Strukturierte JSON-Extraktion, Audiotranskription und Videotranskription sind als Roadmap-Funktionen aufgeführt und stehen zum aktuellen Zeitpunkt nicht als ausgelieferte Funktionalität zur Verfügung.
Kommentare