MarkItDown: convierte tus PDF, Word y Excel antes de dárselos a tu IA
Cuando le pasas un PDF a Claude por la API, cada página le llega dos veces: como texto y como imagen, y las dos ocupan espacio. MarkItDown, una herramienta gratis de Microsoft, deja solo el texto con su estructura (títulos, listas, tablas). Aquí va cómo instalarla bien, qué convierte de verdad y cuándo no te conviene usarla.
- 01Qué esQué es MarkItDown
- 02Qué esPor qué convertir antes de pasárselo a Claude
- 03DecidirQué archivos convierte (y qué no)
- 04Paso a pasoCómo instalarla bien
- 05Paso a pasoCómo convertir un PDF, Word o Excel
- 06Paso a pasoSi algo falla
- 07Paso a pasoConectarla a Claude Desktop
- 08CuidadoLo honesto
Qué es MarkItDown y para qué sirve
MarkItDown es un programa de Python, publicado por Microsoft en GitHub, que convierte archivos a Markdown: un formato de texto simple que conserva la estructura (títulos, listas, tablas, enlaces) y deja fuera el diseño visual. Microsoft lo describe como una utilidad para preparar archivos para modelos de IA y herramientas de análisis de texto. (microsoft/markitdown)
| Dato | Detalle |
|---|---|
| Quién la hace | Microsoft (repositorio oficial microsoft/markitdown) |
| Licencia | MIT: libre y gratis, también para uso comercial |
| Versión | 0.1.8, publicada el 21-09-2026; el propio proyecto se marca como beta |
| Requisito | Python 3.10 a 3.14 |
Fuentes: README · PyPI · pyproject.toml
Por qué convertir un PDF antes de pasárselo a Claude
La documentación de Claude explica qué pasa cuando le mandas un PDF por la API: convierte cada página en una imagen y además extrae su texto, y Claude recibe las dos cosas. Solo el texto ya ocupa, según Anthropic, entre 1.500 y 3.000 tokens por página, y la imagen de cada página se cobra aparte, como cualquier imagen. (PDF support · Claude Docs)
Si el documento es casi todo texto (un contrato, un informe, unas bases), la imagen de cada página no le aporta mucho a Claude y sí le quita espacio. Al convertirlo a Markdown le llega solo el texto con su estructura. Menos espacio ocupado significa que te quema la cuenta más lento y que cabe más material en la misma conversación. Si no tienes claro por qué importa ese espacio, lo explicamos en qué es la ventana de contexto.
Microsoft da una segunda razón: los modelos de IA «hablan» Markdown con naturalidad, porque se entrenaron con muchísimo texto en ese formato, y el formato gasta pocos tokens. (README · Why Markdown?)
La otra cara: al convertir, se pierden las imágenes. Si lo que te importa del PDF es un gráfico, un plano o una tabla dibujada como imagen, pásale el PDF original: según la documentación de Anthropic, Claude recibe cada página también como imagen.
Qué archivos convierte MarkItDown (y qué no)
Desde la versión 0.1.0, cada formato necesita su propio paquete extra. Por eso la instalación del paso 04 lleva [all], que los instala todos. Esta tabla sale de la lista oficial y del código de cada conversor:
| Archivo | Qué saca | Extra que necesita |
|---|---|---|
| El texto y las tablas. No lee texto dentro de imágenes (un escaneo sale casi vacío) | pdf | |
| Word (.docx) | Texto con títulos, listas y tablas | docx |
| PowerPoint (.pptx) | El texto de las diapositivas | pptx |
| Excel (.xlsx y .xls) | Las hojas, como tablas | xlsx · xls |
| Correo de Outlook (.msg) | El mensaje | outlook |
| HTML, CSV, JSON, XML | El contenido en texto | Ninguno |
| ZIP | Recorre y convierte lo que hay dentro | Según lo que traiga |
| EPub | El texto del libro | Ninguno |
| Audio (.wav, .mp3, .m4a, .mp4) | La transcripción, con el reconocedor de voz de Google (ver «Lo honesto») | audio-transcription |
| Enlaces de YouTube | La transcripción del video | youtube-transcription |
| Imágenes (.jpg, .png) | Solo metadatos y, si lo configuras desde Python con un modelo de IA, una descripción. Desde la terminal no te da el texto de una foto | Ninguno |
Fuentes: README · Optional Dependencies · código de los conversores
Cómo instalar MarkItDown
1. Revisa tu versión de Python. Abre una terminal (en Windows, PowerShell; en Mac, Terminal) y escribe:
python --versionTiene que decir 3.10 o más, hasta 3.14. Si no tienes Python o es más viejo, descárgalo desde python.org.
2. Instala MarkItDown con todos sus formatos. Es la forma que indica el repositorio oficial. Las comillas dobles hacen que funcione igual en Windows, Mac y Linux:
python -m pip install "markitdown[all]"3. Comprueba que quedó instalada:
markitdown --versionEl error más común: instalar solo pip install markitdown. Así se instala el núcleo, pero no los paquetes de PDF, Word, PowerPoint ni Excel, y al convertir te sale un error de dependencia que falta. Si ya lo hiciste, repite el paso 2.
Microsoft recomienda instalarla dentro de un entorno virtual de Python para que no choque con otros programas. Si ya sabes usarlos, hazlo así; si no, la instalación de arriba funciona igual.
Cómo convertir un PDF a Markdown (y pasárselo a Claude)
En la terminal, entra en la carpeta donde está el archivo y usa -o para decir cómo se llama el resultado:
Un informe en PDF:
markitdown informe.pdf -o informe.mdUna presentación de PowerPoint:
markitdown presentacion.pptx -o presentacion.mdUna planilla de Excel:
markitdown planilla.xlsx -o planilla.mdDespués, adjunta el archivo .md en el chat de Claude, o ábrelo con cualquier editor de texto y pega su contenido. Si el nombre del archivo tiene espacios, ponlo entre comillas: markitdown "mi informe.pdf" -o informe.md.
Fuente: README · Command-Line
Si algo falla
| Qué pasa | Qué hacer |
|---|---|
| «markitdown» no se reconoce como comando | Usa python -m markitdown informe.pdf -o informe.md, o cierra y vuelve a abrir la terminal |
| «No module named 'markitdown'» | Se instaló en otro Python. Instálala con python -m pip install "markitdown[all]", que usa el mismo Python con el que la vas a ejecutar |
| Error de una dependencia que falta al convertir un PDF o un Word | La instalaste sin [all]. Repite el paso 2 de la sección 04 |
| El resultado sale casi vacío | El PDF es un escaneo (fotos de páginas) y MarkItDown no lee texto dentro de imágenes. Pásale el PDF original a Claude, que recibe cada página también como imagen. Las opciones oficiales para sacar ese texto con MarkItDown son técnicas: el complemento markitdown-ocr (necesita un modelo de visión por API) o Azure Document Intelligence, un servicio en la nube de Microsoft |
Conectar MarkItDown a Claude Desktop
Si no usas Docker ni editas archivos de configuración, salta esta sección: con la terminal basta. Microsoft publica también markitdown-mcp, un servidor MCP (la forma estándar de darle herramientas a Claude) con una sola herramienta, convert_to_markdown, que convierte un archivo o un enlace sin salir del chat.
Para Claude Desktop, su documentación recomienda usarlo con Docker: se construye la imagen desde el repositorio y se agrega una entrada en el archivo claude_desktop_config.json. El paso a paso completo está en la página de MarkItDown-MCP.
Microsoft avisa que está pensado solo para uso local: no lo expongas a otras máquinas de tu red ni a internet.
Fuente: MarkItDown-MCP · README
Lo honesto
- No te vamos a prometer «el triple de preguntas». Las cifras de tokens por página son de la documentación de la API de Claude. Cuánto ahorras con tu documento depende de cuánto texto e imágenes tenga, y en la app de Claude no encontramos el proceso documentado con ese detalle. No lo medimos.
- Microsoft no la vende como conversor perfecto. Su README dice que el resultado suele ser legible, pero que está pensado para herramientas de análisis de texto, no para conversiones fieles para personas.
- Las fotos no dan texto desde la terminal. La lista oficial menciona «OCR» en imágenes, pero el código del conversor solo saca metadatos y una descripción hecha por un modelo de IA que hay que configurar desde Python. Nuestra guía anterior decía lo contrario: estaba mal.
- El audio sale de tu computadora. La transcripción usa el reconocedor de voz de Google, así que la grabación se envía a Google. No la uses con audios confidenciales.
- Es beta y cambia rápido. Pasó de la versión 0.1.7 (julio) a la 0.1.8 (septiembre de 2026) y, desde la 0.1.0, cambió cómo se instala. Si un comando de esta guía deja de funcionar, manda el repositorio oficial.
- Seguridad: MarkItDown abre todo lo que tu usuario puede abrir, también enlaces. Microsoft pide no pasarle archivos ni enlaces de origen desconocido sin revisarlos, sobre todo si la montas en un servidor.
Antes de pasarle a Claude un PDF que es puro texto, conviértelo con markitdown archivo.pdf -o archivo.md: ocupa menos y le llega igual de claro. Si lo que importa son los gráficos o es un escaneo, pásale el PDF tal cual. Y para que Claude sepa qué hacer con ese texto, empieza por configurar tu IA antes de usarla.
¿Y ahora qué?
Tres formas de seguir, según lo que prefieras.
El mensaje para tu grupo
¿Le sirve a alguien de tu equipo o de tu grupo? Cópialo tal cual o ábrelo directo en WhatsApp.
Te paso esta guía: Convierte cualquier archivo para tu IA. PDFs, Excel, audio: todo legible para Claude. https://iactn.com/arsenal/markitdown/Fuentes, leídas el 29-09-2026
- microsoft/markitdown · GitHub. Qué es, formatos, instalación con
[all], extras por formato, comandos, complementos, seguridad y «Why Markdown?». - markitdown · PyPI. Versión 0.1.8 del 21-09-2026 y el historial de versiones.
- pyproject.toml · GitHub. Python 3.10 a 3.14, licencia MIT, estado beta y qué instala cada extra.
- Código de los conversores · GitHub. Qué saca de imágenes (metadatos y descripción con IA), audio (reconocedor de Google) y PDF (sin OCR).
- MarkItDown-MCP · GitHub. Servidor MCP, uso con Claude Desktop vía Docker, solo uso local.
- PDF support · Claude Docs. Cada página como imagen más texto; 1.500 a 3.000 tokens de texto por página.