Comece pela opção que exige menos trabalho
Para converter um arquivo comum uma única vez, o navegador costuma ser mais rápido: abra o documento, confira o Markdown e baixe o resultado.
O Agent Skill vale a instalação quando o Codex ou o Claude Code já está trabalhando com os arquivos. O agente pode extrair um relatório, ajustar o Markdown, criar outra entrega e verificar o arquivo final dentro da mesma tarefa.
| Situação | Melhor ponto de partida |
|---|---|
| Um arquivo simples e uma única saída | Conversor no navegador |
| Edição ou visualização rápida | Ferramenta no navegador |
| Conversões repetidas dentro do agente | Agent Skill |
| PDF → Markdown → DOCX ou outra saída | Agent Skill |
| O agente precisa verificar o arquivo gerado | Agent Skill |
| O layout complexo precisa ficar idêntico | Fluxo específico do formato com revisão manual |
Use o Markdown como etapa de trabalho
Markdown representa bem títulos, parágrafos, listas, links, código e muitas tabelas simples. É leve o suficiente para o agente editar diretamente e estruturado o bastante para virar outro documento depois.
Essa etapa intermediária também define o limite de fidelidade. Ao converter um PowerPoint, você recupera o conteúdo legível dos slides, não o design original. Um PPTX gerado depois nasce do Markdown e não recompõe posições, animações, fontes ou mídia perdidas na extração.
Escolha esse fluxo quando o conteúdo importa mais do que uma cópia visual exata.
Instale o Markdown Converter Agent Skill
O Skill segue o formato aberto Agent Skills e pode ser usado por Codex, Claude Code e clientes compatíveis. Ele exige Node.js 20 ou mais recente e inclui o mecanismo de conversão, OCR, dados dos idiomas disponíveis, fontes, renderizador e verificador.
A variável MARKDOWN_CONVERTER_DIR deve apontar para a pasta instalada que contém SKILL.md. Não presuma que o terminal foi aberto dentro do repositório do Skill.
npx skills add agent-tools-lab/markdown-converter --skill markdown-converternode "$MARKDOWN_CONVERTER_DIR/scripts/runtime/convert.mjs" INPUT --to FORMAT -o OUTPUTConverta um PDF com camada de texto para Markdown
Se for possível selecionar uma frase no leitor de PDF, comece pela extração de texto. Parágrafos, títulos e marcadores costumam deixar pistas suficientes para um rascunho editável.
PDF guarda conteúdo posicionado na página, não uma estrutura semântica completa. Colunas, tabelas complexas, fórmulas, notas de rodapé e tipografia incomum ainda podem exigir correção, principalmente na ordem de leitura.
node "$MARKDOWN_CONVERTER_DIR/scripts/runtime/convert.mjs" relatorio.pdf --to markdown -o relatorio.mdrelatorio.md — rascunho editável extraído da camada de textoAplique OCR somente nas páginas que são imagens
Um PDF digitalizado pode parecer normal e, ainda assim, não ter texto selecionável. O Skill aproveita o texto nativo quando ele existe e executa OCR local apenas nas páginas sem uma camada de texto útil.
Os modelos incluídos reconhecem inglês, espanhol, alemão, japonês e chinês simplificado. O limite atual é 30 MB, 100 páginas no total e até 20 páginas de OCR por arquivo.
Não há modelo de OCR em português no pacote atual. Para um escaneamento em português, o caminho de OCR não deve ser anunciado como compatível; PDFs que já tenham camada de texto em português continuam podendo ser extraídos normalmente.
Todo resultado de OCR precisa de conferência. Compare nomes, datas, valores, pontuação, títulos e tabelas com a imagem original. Caligrafia e reconstrução exata de tabelas complexas não fazem parte da promessa.
node "$MARKDOWN_CONVERTER_DIR/scripts/runtime/convert.mjs" scan.pdf --to markdown --ocr-language eng -o scan.mdConfirme o idioma real do documento e revise nomes, números, datas e ordem de leitura| Idioma de OCR disponível | Código |
|---|---|
| Inglês | eng |
| Espanhol | spa |
| Alemão | deu |
| Japonês | jpn |
| Chinês simplificado | chi_sim |
Transforme um DOCX em Markdown editável
Documentos do Word centrados em texto são os melhores candidatos. Parágrafos, títulos, listas, links e tabelas simples têm equivalentes razoáveis em Markdown e ficam mais fáceis de revisar com o agente.
Não espere preservar com fidelidade o layout da página, mídia incorporada, comentários, controle de alterações, macros, objetos flutuantes, fontes ou espaçamento. Se o design for parte essencial do arquivo, mantenha e edite o DOCX original.
node "$MARKDOWN_CONVERTER_DIR/scripts/runtime/convert.mjs" relatorio.docx --to markdown -o relatorio.mdRevisar títulos, listas e tabelas antes de editar ou exportar novamenteGere um PDF pesquisável a partir do Markdown
O gerador cria um documento A4 novo com objetos de texto reais, em vez de transformar cada página em uma captura de tela. Nos caracteres compatíveis, o conteúdo pode ser pesquisado, selecionado, copiado e extraído.
Se o fluxo começou em outro PDF, o projeto visual daquele arquivo não volta automaticamente. O resultado é diagramado de novo a partir do Markdown revisado.
node "$MARKDOWN_CONVERTER_DIR/scripts/runtime/convert.mjs" notas.md --to pdf -o notas.pdfAbrir notas.pdf e selecionar uma frase representativaEntenda o que cada formato representa
Toda entrada que não seja Markdown vira primeiro um Markdown editável. Se você pedir outra saída, ela será criada a partir dessa etapa intermediária, e não como uma cópia direta do arquivo original.
Alguns nomes precisam de contexto: JSON contém os tokens do Markdown; Confluence gera Wiki Markup legado; Notion produz Markdown voltado à importação. Nenhum deles representa dados empresariais arbitrários, chamada de API ou compatibilidade universal com editores modernos.
| Família | Exemplos | Limite principal |
|---|---|---|
| Entradas | PDF, DOCX, XLSX/XLS, PPTX, HTML, TXT, CSV, JSON, XML | Conteúdo e estrutura viram Markdown; layout e comportamento do aplicativo podem se perder |
| Documentos | PDF, DOCX, XLSX, PPTX, EPUB | São arquivos novos gerados a partir do Markdown |
| Publicação e texto | HTML, LaTeX, AsciiDoc, RTF, RST, Confluence, Notion, Reveal, WeChat | Cada destino tem limites próprios |
| Dados e imagens | CSV, JSON de tokens, mapa mental, PNG, JPG, Card | A fonte precisa ter estrutura adequada; Card é um resumo visual |
Verifique o arquivo antes de encerrar a tarefa
Um comando concluído sem erro não prova que o documento está correto. Execute o verificador incluído e abra trechos representativos no aplicativo em que a saída será usada.
Se o verificador falhar, trate a conversão como falha. Preserve o arquivo de origem e grave a saída em outro caminho, sem substituir a única cópia disponível.
- Confirme que o arquivo existe, não está vazio e abre no aplicativo de destino.
- Compare títulos e parágrafos representativos com a fonte.
- Confira acentos e outros caracteres fora de ASCII.
- No PDF, selecione ou extraia uma frase real.
- No OCR, confira nomes, números, títulos e pelo menos um parágrafo contra o escaneamento.
python3 "$MARKDOWN_CONVERTER_DIR/scripts/verify_output.py" notas.pdf --format pdfComparar títulos, parágrafos, listas, tabelas, links e caracteres não ASCIIProcessamento local não torna a conversão sem perdas
Os arquivos gerados não recebem logotipo, marca-d'água, rodapé promocional, link de atribuição nem metadados ocultos do produto.
Mesmo assim, Markdown não representa com exatidão layout de página, fórmulas e comportamento de planilhas, comentários, alterações controladas, animações, notas do apresentador, mídia incorporada, equações ou tabelas complexas. Quando esses elementos forem o resultado principal, use o fluxo profissional do formato original.
Ferramentas relacionadas
Perguntas frequentes
O Codex consegue converter PDF para Markdown com este Skill?
Sim. PDFs com texto usam extração local. Páginas que sejam apenas imagens podem usar OCR local quando estiverem dentro dos idiomas e limites documentados.
O mesmo Skill funciona no Claude Code?
Sim. O repositório usa o formato Agent Skills e é compatível com Codex, Claude Code e outros clientes que adotam esse formato.
Todo PDF precisa de OCR?
Não. PDFs com uma camada de texto utilizável devem usar extração direta. OCR é reservado às páginas sem texto nativo legível.
Há OCR em português?
Não nesta versão. PDFs em português com camada de texto podem ser extraídos, mas páginas escaneadas em português não devem usar um modelo de outro idioma como se houvesse suporte nativo.
Word, Excel e PowerPoint podem virar Markdown?
DOCX, XLSX/XLS e PPTX são entradas aceitas. O foco é conteúdo legível e estrutura básica, não layout completo, fórmulas, animações ou mídia.
Markdown pode voltar para Word ou PowerPoint?
DOCX e PPTX são saídas aceitas. Eles são gerados de novo a partir do Markdown e não reconstroem com exatidão um arquivo anterior.
O PDF gerado tem texto pesquisável?
Sim, para os caracteres compatíveis. O gerador escreve objetos de texto reais e a verificação confere se existe texto extraível.
Quando é melhor usar o ilovemd.net?
Quando você quer converter, editar ou visualizar um arquivo uma única vez no navegador. Use o Skill em tarefas repetidas, encadeadas ou que precisem de verificação.
Onde instalar o Markdown Converter?
No repositório https://github.com/agent-tools-lab/markdown-converter, com o comando npx skills add agent-tools-lab/markdown-converter --skill markdown-converter.
