Comece pela opção que exige menos trabalho

Para converter um arquivo comum uma única vez, o navegador costuma ser mais rápido: abra o documento, confira o Markdown e baixe o resultado.

O Agent Skill vale a instalação quando o Codex ou o Claude Code já está trabalhando com os arquivos. O agente pode extrair um relatório, ajustar o Markdown, criar outra entrega e verificar o arquivo final dentro da mesma tarefa.

SituaçãoMelhor ponto de partida
Um arquivo simples e uma única saídaConversor no navegador
Edição ou visualização rápidaFerramenta no navegador
Conversões repetidas dentro do agenteAgent Skill
PDF → Markdown → DOCX ou outra saídaAgent Skill
O agente precisa verificar o arquivo geradoAgent Skill
O layout complexo precisa ficar idênticoFluxo específico do formato com revisão manual

Use o Markdown como etapa de trabalho

Markdown representa bem títulos, parágrafos, listas, links, código e muitas tabelas simples. É leve o suficiente para o agente editar diretamente e estruturado o bastante para virar outro documento depois.

Essa etapa intermediária também define o limite de fidelidade. Ao converter um PowerPoint, você recupera o conteúdo legível dos slides, não o design original. Um PPTX gerado depois nasce do Markdown e não recompõe posições, animações, fontes ou mídia perdidas na extração.

Escolha esse fluxo quando o conteúdo importa mais do que uma cópia visual exata.

Instale o Markdown Converter Agent Skill

O Skill segue o formato aberto Agent Skills e pode ser usado por Codex, Claude Code e clientes compatíveis. Ele exige Node.js 20 ou mais recente e inclui o mecanismo de conversão, OCR, dados dos idiomas disponíveis, fontes, renderizador e verificador.

A variável MARKDOWN_CONVERTER_DIR deve apontar para a pasta instalada que contém SKILL.md. Não presuma que o terminal foi aberto dentro do repositório do Skill.

Instalar o Skill
npx skills add agent-tools-lab/markdown-converter --skill markdown-converter
Padrão para chamar o conversor
node "$MARKDOWN_CONVERTER_DIR/scripts/runtime/convert.mjs" INPUT --to FORMAT -o OUTPUT

Converta um PDF com camada de texto para Markdown

Se for possível selecionar uma frase no leitor de PDF, comece pela extração de texto. Parágrafos, títulos e marcadores costumam deixar pistas suficientes para um rascunho editável.

PDF guarda conteúdo posicionado na página, não uma estrutura semântica completa. Colunas, tabelas complexas, fórmulas, notas de rodapé e tipografia incomum ainda podem exigir correção, principalmente na ordem de leitura.

PDF com texto → Markdown
node "$MARKDOWN_CONVERTER_DIR/scripts/runtime/convert.mjs" relatorio.pdf --to markdown -o relatorio.md
Saída
relatorio.md — rascunho editável extraído da camada de texto

Aplique OCR somente nas páginas que são imagens

Um PDF digitalizado pode parecer normal e, ainda assim, não ter texto selecionável. O Skill aproveita o texto nativo quando ele existe e executa OCR local apenas nas páginas sem uma camada de texto útil.

Os modelos incluídos reconhecem inglês, espanhol, alemão, japonês e chinês simplificado. O limite atual é 30 MB, 100 páginas no total e até 20 páginas de OCR por arquivo.

Não há modelo de OCR em português no pacote atual. Para um escaneamento em português, o caminho de OCR não deve ser anunciado como compatível; PDFs que já tenham camada de texto em português continuam podendo ser extraídos normalmente.

Todo resultado de OCR precisa de conferência. Compare nomes, datas, valores, pontuação, títulos e tabelas com a imagem original. Caligrafia e reconstrução exata de tabelas complexas não fazem parte da promessa.

Exemplo com OCR em idioma disponível
node "$MARKDOWN_CONVERTER_DIR/scripts/runtime/convert.mjs" scan.pdf --to markdown --ocr-language eng -o scan.md
Antes de usar
Confirme o idioma real do documento e revise nomes, números, datas e ordem de leitura
Idioma de OCR disponívelCódigo
Inglêseng
Espanholspa
Alemãodeu
Japonêsjpn
Chinês simplificadochi_sim

Transforme um DOCX em Markdown editável

Documentos do Word centrados em texto são os melhores candidatos. Parágrafos, títulos, listas, links e tabelas simples têm equivalentes razoáveis em Markdown e ficam mais fáceis de revisar com o agente.

Não espere preservar com fidelidade o layout da página, mídia incorporada, comentários, controle de alterações, macros, objetos flutuantes, fontes ou espaçamento. Se o design for parte essencial do arquivo, mantenha e edite o DOCX original.

DOCX → Markdown
node "$MARKDOWN_CONVERTER_DIR/scripts/runtime/convert.mjs" relatorio.docx --to markdown -o relatorio.md
Próxima etapa
Revisar títulos, listas e tabelas antes de editar ou exportar novamente
Conferir a sintaxe MarkdownRevise tabelas, listas, links e código antes da próxima saída

Gere um PDF pesquisável a partir do Markdown

O gerador cria um documento A4 novo com objetos de texto reais, em vez de transformar cada página em uma captura de tela. Nos caracteres compatíveis, o conteúdo pode ser pesquisado, selecionado, copiado e extraído.

Se o fluxo começou em outro PDF, o projeto visual daquele arquivo não volta automaticamente. O resultado é diagramado de novo a partir do Markdown revisado.

Markdown → PDF
node "$MARKDOWN_CONVERTER_DIR/scripts/runtime/convert.mjs" notas.md --to pdf -o notas.pdf
Verificação mínima
Abrir notas.pdf e selecionar uma frase representativa
Converter Markdown para PDF no navegadorEdite a fonte, veja a prévia e baixe um PDF com texto real

Entenda o que cada formato representa

Toda entrada que não seja Markdown vira primeiro um Markdown editável. Se você pedir outra saída, ela será criada a partir dessa etapa intermediária, e não como uma cópia direta do arquivo original.

Alguns nomes precisam de contexto: JSON contém os tokens do Markdown; Confluence gera Wiki Markup legado; Notion produz Markdown voltado à importação. Nenhum deles representa dados empresariais arbitrários, chamada de API ou compatibilidade universal com editores modernos.

FamíliaExemplosLimite principal
EntradasPDF, DOCX, XLSX/XLS, PPTX, HTML, TXT, CSV, JSON, XMLConteúdo e estrutura viram Markdown; layout e comportamento do aplicativo podem se perder
DocumentosPDF, DOCX, XLSX, PPTX, EPUBSão arquivos novos gerados a partir do Markdown
Publicação e textoHTML, LaTeX, AsciiDoc, RTF, RST, Confluence, Notion, Reveal, WeChatCada destino tem limites próprios
Dados e imagensCSV, JSON de tokens, mapa mental, PNG, JPG, CardA fonte precisa ter estrutura adequada; Card é um resumo visual

Verifique o arquivo antes de encerrar a tarefa

Um comando concluído sem erro não prova que o documento está correto. Execute o verificador incluído e abra trechos representativos no aplicativo em que a saída será usada.

Se o verificador falhar, trate a conversão como falha. Preserve o arquivo de origem e grave a saída em outro caminho, sem substituir a única cópia disponível.

  • Confirme que o arquivo existe, não está vazio e abre no aplicativo de destino.
  • Compare títulos e parágrafos representativos com a fonte.
  • Confira acentos e outros caracteres fora de ASCII.
  • No PDF, selecione ou extraia uma frase real.
  • No OCR, confira nomes, números, títulos e pelo menos um parágrafo contra o escaneamento.
Verificar um PDF
python3 "$MARKDOWN_CONVERTER_DIR/scripts/verify_output.py" notas.pdf --format pdf
Depois do verificador
Comparar títulos, parágrafos, listas, tabelas, links e caracteres não ASCII

Processamento local não torna a conversão sem perdas

Os arquivos gerados não recebem logotipo, marca-d'água, rodapé promocional, link de atribuição nem metadados ocultos do produto.

Mesmo assim, Markdown não representa com exatidão layout de página, fórmulas e comportamento de planilhas, comentários, alterações controladas, animações, notas do apresentador, mídia incorporada, equações ou tabelas complexas. Quando esses elementos forem o resultado principal, use o fluxo profissional do formato original.

Ferramentas relacionadas

Guia rápido de MarkdownConfira títulos, listas, tabelas, links e blocos de códigoPDF para MarkdownExtraia o texto ou use OCR local nos idiomas disponíveisMarkdown para PDFGere um PDF novo com texto pesquisável e selecionável
FAQ

Perguntas frequentes

O Codex consegue converter PDF para Markdown com este Skill?

Sim. PDFs com texto usam extração local. Páginas que sejam apenas imagens podem usar OCR local quando estiverem dentro dos idiomas e limites documentados.

O mesmo Skill funciona no Claude Code?

Sim. O repositório usa o formato Agent Skills e é compatível com Codex, Claude Code e outros clientes que adotam esse formato.

Todo PDF precisa de OCR?

Não. PDFs com uma camada de texto utilizável devem usar extração direta. OCR é reservado às páginas sem texto nativo legível.

Há OCR em português?

Não nesta versão. PDFs em português com camada de texto podem ser extraídos, mas páginas escaneadas em português não devem usar um modelo de outro idioma como se houvesse suporte nativo.

Word, Excel e PowerPoint podem virar Markdown?

DOCX, XLSX/XLS e PPTX são entradas aceitas. O foco é conteúdo legível e estrutura básica, não layout completo, fórmulas, animações ou mídia.

Markdown pode voltar para Word ou PowerPoint?

DOCX e PPTX são saídas aceitas. Eles são gerados de novo a partir do Markdown e não reconstroem com exatidão um arquivo anterior.

O PDF gerado tem texto pesquisável?

Sim, para os caracteres compatíveis. O gerador escreve objetos de texto reais e a verificação confere se existe texto extraível.

Quando é melhor usar o ilovemd.net?

Quando você quer converter, editar ou visualizar um arquivo uma única vez no navegador. Use o Skill em tarefas repetidas, encadeadas ou que precisem de verificação.

Onde instalar o Markdown Converter?

No repositório https://github.com/agent-tools-lab/markdown-converter, com o comando npx skills add agent-tools-lab/markdown-converter --skill markdown-converter.