Recursos Principais
O markitdown.ai suporta conversão de 7 formatos de entrada e 3 formatos de saída, todos executados em um motor de análise compartilhado no servidor que produz resultados consistentes, independentemente do dispositivo do cliente.
Formatos de entrada suportados:
PDF: PDFs com texto nativo são analisados diretamente, a ordem de leitura de várias colunas é reconstruída, e PDFs digitalizados passam por OCR automático
DOCX / DOC legado: Preserva títulos, listas, tabelas e comentários de arquivos do Word
PPTX / PPT legado: Converte apresentações de slides um a um, mantém os títulos como cabeçalhos e marcadores
XLSX / XLS legado: Cada planilha do arquivo vira uma tabela em Markdown com o nome da própria planilha
PNG / JPG: Capturas de tela e imagens digitalizadas são processadas por OCR, com opção de compreensão de imagem por IA para usuários logados
HTML: Remove scripts e estilos, preserva a estrutura do artigo, links e tabelas de páginas da web salvas
URL: Busca páginas públicas da web no lado do servidor, bloqueia endereços privados e internos para evitar vazamento de conteúdo restrito
Formatos de saída reversos suportados, que funcionam totalmente local no navegador sem enviar o texto do usuário para servidores:
Markdown para HTML: Gera HTML semântico e padrão, com suporte a tabelas do GitHub, listas de tarefas e destaque de código
Markdown para texto simples: Achata a estrutura em texto legível sem formatação para janelas de chat, tickets de suporte e campos de formulário
Markdown para PDF: Renderiza uma pré-visualização de impressão local que o usuário pode salvar usando a função nativa de impressão do navegador
Opções de Workflow
O produto oferece três formas distintas de executar conversões, todas conectadas à mesma conta de usuário e saldo de créditos compartilhado:
Aplicativo web (navegador): Não precisa de cadastro para uso de teste anônimo, suporta envio de arquivos individuais ou colagem de URLs, com limite de tamanho de arquivo de até 10 MB e 25 páginas no plano de teste gratuito. Os usuários podem visualizar o Markdown renderizado, copiar o conteúdo ou baixar arquivos .md diretamente.
Modo em lote: Para usuários de planos pagos, suporta o processamento de vários arquivos em uma única execução, com acompanhamento de status de cada arquivo e uma biblioteca de conversões salvas.
API para desenvolvedores: Usa exatamente o mesmo pipeline de análise da interface web. Ela suporta conversão síncrona em até 60 segundos, conversão assíncrona para arquivos maiores com notificações de conclusão por polling ou webhook, chaves de API com permissões específicas e registros completos de atividade. A referência pública da API está disponível no caminho /docs/api, e a especificação OpenAPI pode ser acessada diretamente no caminho /v1/openapi.json.
Público e Casos de Uso
A ferramenta é feita para estas equipes e casos de uso principais:
Equipes de RAG e pipelines de IA: Convertem documentos de origem antes da divisão em trechos e incorporação, para eliminar ruídos de layout, preservar hierarquia de títulos e estrutura de tabelas, e manter resultados de recuperação consistentes em milhares de arquivos.
Pesquisadores e analistas: Convertem artigos acadêmicos, whitepapers e apresentações de slides em Markdown pesquisável e editável, para evitar digitação manual de tabelas e preservar a ordem correta de leitura de várias colunas de PDFs com conteúdo denso.
Equipes de operações: Processam contratos, notas fiscais, políticas e documentos internos sem necessidade de limpeza manual com copiar e colar. O histórico de Markdown armazenado simplifica a revisão, comparação e reutilização de trabalho com documentos recorrentes.
Equipes de automação para desenvolvedores: Incorporam a conversão diretamente em tarefas de ingestão, ferramentas internas e document workflows, com saída previsível que funciona de forma confiável para sistemas CMS, bases de conhecimento e bots de suporte.
Criadores de agentes: Adicionam a conversão de Markdown como uma ferramenta para agentes de IA, para que eles possam processar arquivos suportados e URLs públicas da web sem precisar lidar com lógica de análise de baixo nível ou OCR.
Preços e Limites de Uso
O teste anônimo, sem necessidade de cadastro, permite 3 conversões por hora e 10 conversões por dia, com limite de tamanho máximo de arquivo de 10 MB e máximo de 25 páginas por arquivo.
A precificação baseada em créditos é válida para todos os planos: cada página de texto padrão ou página processada por OCR custa 1 crédito, enquanto a opção de compreensão de imagem por IA custa 5 créditos por imagem. Não há diferença no custo por página entre um documento com camada de texto e um documento digitalizado.
As assinaturas pagas começam em R$ 20 por mês, e aumentam os limites de tamanho para até 200 MB por arquivo e 200 páginas por arquivo no plano Pro. Os planos pagos também liberam o processamento em lote, acesso a API e histórico de armazenamento maior para os resultados de conversão.
Limitações Importantes
A qualidade do reconhecimento de OCR depende da resolução da imagem de origem, então digitalizações de 300 dpi produzem saída de texto muito mais precisa que fotos tiradas com celular de baixa resolução.
Endereços da web privados e internos são bloqueados para a conversão de URL para Markdown, para evitar acesso não autorizado a conteúdo não público.
Extração de JSON estruturado, transcrição de áudio e transcrição de vídeo são recursos previstos no roteiro de desenvolvimento e ainda não estão disponíveis como funcionalidades prontas para uso.
Comentários