核心能力
markitdown.ai 支持7种输入格式和3种输出格式,所有转换都在统一的服务端解析引擎上运行,无论用户使用什么客户端设备,输出结果都能保持一致。
支持的输入格式:
PDF:原生文本PDF可直接解析,自动重建多栏内容的阅读顺序,扫描版PDF支持自动OCR识别
DOCX / 旧版DOC:完整保留Word文件中的标题、列表、表格和批注内容
PPTX / 旧版PPT:逐页转换幻灯片,将原文件标题保留为Markdown标题,项目符号内容直接转为列表
XLSX / 旧版XLS:工作簿里的每一个工作表,都会生成对应命名的Markdown表格
PNG / JPG:截图和扫描图片全部经OCR处理,登录用户可选择开启AI图像理解功能
HTML:自动剥离脚本和样式代码,保留保存网页里的文章结构、链接和表格
URL:服务端拉取公开网页内容,自动拦截私有和内部地址,避免涉密内容泄露
支持的反向输出格式,所有转换全程在浏览器本地运行,不会上传用户任何文本内容:
Markdown 转 HTML:生成符合标准的语义化HTML,支持GitHub表格、任务列表、代码高亮特性
Markdown 转纯文本:将结构化内容平铺为无格式的可读文本,适配聊天窗口、服务工单、表单输入等场景
Markdown 转 PDF:在本地生成打印预览,用户可直接用浏览器自带的打印功能保存文件
工作流选项
本产品提供三种不同的转换运行方式,所有方式都绑定同一个用户账户,共享同一个点数余额:
网页端(浏览器运行):无需注册登录即可匿名试用,支持单文件上传或直接粘贴链接,免费试用单文件上限10MB,最多处理25页内容。用户可以直接预览转换后的Markdown效果,复制内容,或者下载.md格式文件。
批量模式:付费订阅用户可用,支持一次上传多个文件同时处理,可查看每个文件的转换状态,所有转换记录都会保存在个人库中。
开发者API:使用和网页端完全相同的解析流水线,支持60秒内完成的同步转换,处理大文件可选择异步转换,通过轮询或者Webhook接收完成通知,支持作用域受限的API密钥,全程保留完整操作日志。公开API参考文档地址为 /docs/api,OpenAPI 规范文件可直接通过 /v1/openapi.json 访问。
适用人群和使用场景
这款工具主要面向以下核心团队和场景:
RAG 和 AI 流水线团队:在文档分段和向量化之前完成格式转换,消除布局冗余噪音,保留原有标题层级和表格结构,保证数千份文件的检索结果稳定一致。
科研人员和分析师:把学术论文、白皮书、幻灯片转为可搜索、可编辑的Markdown格式,不用手动重新录入表格,还原高密度PDF里的正确多栏阅读顺序。
运营团队:处理合同、发票、规章制度和内部文档,无需手动复制粘贴清理格式。历史转换生成的Markdown文件可直接留存,简化后续重复文档工作的审核、对比和复用。
开发自动化团队:把转换能力直接嵌入数据导入任务、内部工具和文档工作流,输出结果稳定可靠,可以直接对接CMS系统、知识库和客服机器人。
AI Agent 开发人员:把Markdown转换作为AI Agent的调用工具,让Agent可以直接处理支持格式的文件和公开网页链接,不需要自行开发底层解析或OCR逻辑。
定价和使用限制
匿名无需注册的试用权限为每小时最多3次转换,每天最多10次转换,单文件最大10MB,单文件最多处理25页。
所有套餐都采用点数计费规则:每处理1页标准文本页或OCR识别页消耗1个点数,可选开通的AI图像理解功能每张图片消耗5个点数。文本层文档和扫描文档的单页计费标准完全相同。
付费订阅方案每月20美元起,Pro套餐单文件大小上限提升到200MB,单文件最多处理200页。付费套餐同时解锁批量处理、API访问权限,转换结果的存储历史时长也更长。
重要限制说明
OCR识别准确率和原图分辨率直接相关,300dpi的扫描件输出的文本准确率远高于低分辨率的手机拍摄照片。
URL转Markdown功能会自动拦截私有和内部网页地址,禁止未授权访问非公开内容。
结构化JSON提取、音频转文字、视频转文字属于规划中的功能,目前暂未上线可用。
评论