Markdown vs. HTML: ¿qué formato conviene para SEO y LLM?
El auge de los modelos de lenguaje ha generado una pregunta recurrente entre desarrolladores y profesionales del posicionamiento SEO: ¿conviene convertir un sitio web a Markdown para facilitar que los LLM comprendan su contenido? Aunque este formato ofrece una estructura limpia y sencilla, eso no significa que sustituya al HTML ni que mejore por sí mismo la visibilidad en buscadores o sistemas de inteligencia artificial.
Durante un episodio de Search Off the Record, Martin Splitt y John Mueller analizaron el debate sobre markdown vs. html, el uso de archivos llms.txt y las ventajas reales de cada formato. Su conclusión principal es clara: Markdown puede ser práctico para crear contenido, pero HTML sigue siendo la base para que un sitio pueda rastrearse, descubrirse e indexarse de forma normal.
¿Qué es Markdown y por qué resulta tan sencillo?
Para entender qué es markdown, hay que verlo como un formato de texto estructurado que facilita la creación de contenido. Con este es posible definir encabezados, listas, tablas, enlaces, imágenes y otros elementos sin tener que escribir toda la sintaxis propia de HTML.
Su principal atractivo es la simplicidad. Mientras HTML requiere etiquetas de apertura, cierre y diferentes niveles de anidamiento, Markdown reduce gran parte de esa complejidad. El contenido puede seguir siendo comprensible incluso cuando se observa directamente desde un editor de texto.
Además, Markdown separa con mayor claridad el contenido de su presentación. El archivo puede definir qué elemento es un encabezado, un enlace o un texto en negrita, mientras que el aspecto visual se añade posteriormente mediante otros recursos al convertirlo en HTML.
Esta característica facilita reutilizar el mismo contenido en diferentes formatos. Un texto escrito en Markdown puede utilizarse para generar una página web, un PDF u otro tipo de documento sin alterar su estructura original.
¿Para qué sirve Markdown en un sitio web?

Martin Splitt y John Mueller coinciden en que resulta especialmente práctico como formato de escritura y como paso intermedio antes de generar una página HTML.
De hecho, ambos explican que utilizan o han utilizado Markdown para algunos de sus propios sitios. En estos casos, el contenido se escribe en este formato y un generador de sitios estáticos lo convierte posteriormente en HTML. Para el usuario final, el resultado sigue siendo una página web convencional.
Este uso evita tener que trabajar directamente con etiquetas HTML durante la redacción. El autor puede concentrarse en el texto y su estructura, mientras otro sistema se ocupa de generar la página que finalmente se publica en internet.
Markdown puede resultar especialmente adecuado para documentación técnica, código, ejemplos de API y otros contenidos dirigidos a desarrolladores. En esos casos, un archivo más limpio y estructurado puede facilitar que un sistema automatizado identifique instrucciones, fragmentos de código y relaciones entre diferentes partes del documento.
Sin embargo, esto no significa que cualquier sitio necesite una versión en Markdown. Como señala Mueller, si una web vende zapatos, no tiene sentido crear un catálogo completo en este formato solo con la esperanza de mejorar su comprensión por parte de los LLM.
Markdown vs. HTML: ¿cuál es mejor para los LLM?
Una de las razones por las que Markdown se ha popularizado en las conversaciones sobre inteligencia artificial es su minimalismo. Un archivo HTML puede contener etiquetas, estilos en línea y numerosos elementos adicionales que rodean al texto principal. En cambio, Markdown presenta el contenido de una forma más limpia y con menos elementos.
Esta diferencia puede llevar a pensar que un LLM entenderá mejor un documento en Markdown. Sin embargo, Splitt señala que los rastreadores actuales ya han tenido que resolver el problema de procesar HTML porque ese es el formato predominante en la web.
Los sistemas que rastrean internet no pueden limitarse a buscar archivos Markdown e ignorar el resto de la información disponible. Por ello, llevan años trabajando con HTML y disponen de mecanismos para extraer y procesar su contenido.
Por tanto, Markdown puede facilitar la creación del contenido, pero HTML sigue cumpliendo funciones fundamentales para su publicación, navegación y descubrimiento.
Te puede interesar: ¿Cómo optimizar tu sitio web para la IA y ganar visibilidad?
¿Para qué sirve HTML en el rastreo y descubrimiento?
Comprender para qué sirve html requiere mirar más allá del texto visible de una página. Una web incluye navegación, enlaces internos, encabezados, pies de página, barras laterales, categorías y otras conexiones que ayudan a comprender cómo se relaciona una URL con el resto del sitio.
Según Mueller, todos estos elementos son importantes para los motores de búsqueda y probablemente también para sistemas LLM genéricos. Un rastreador puede visitar una página HTML, reconocer sus enlaces y descubrir otras secciones o contenidos disponibles dentro del mismo dominio.
Parte de esta información puede desaparecer cuando el contenido se reduce únicamente a un archivo Markdown. Esto puede afectar la comprensión de la estructura general del sitio y la relación existente entre sus páginas.
Por esa razón, Mueller considera que disponer de páginas HTML normales es un requisito fundamental para ser rastreado e indexado de la manera habitual. Los motores de búsqueda ya saben procesarlas y llevan décadas trabajando con este formato.
HTML, además, hace posible crear diseños, incorporar imágenes, aplicar estilos y añadir interactividad. Markdown está pensado principalmente para estructurar contenido, no para reemplazar todas las funciones que puede ofrecer una página web.
¿Conviene crear una versión en Markdown exclusiva para LLM?
La respuesta general de la conversación es no. Crear una página HTML para usuarios y otra versión separada en Markdown para sistemas de inteligencia artificial puede duplicar el trabajo y aumentar la complejidad del mantenimiento.
El principal riesgo es que ambas versiones terminen desincronizadas. Mientras un usuario puede avisar si una página visible deja de funcionar, una versión creada exclusivamente para sistemas automatizados podría romperse sin que nadie lo advierta.
Splitt relaciona este problema con la experiencia del renderizado dinámico, una solución que generaba versiones diferentes de una misma página y que, en la práctica, podía resultar difícil de mantener y depurar.
La situación cambia cuando Markdown es la fuente original del contenido y la versión HTML se genera automáticamente a partir de ella. En ese caso, no existen dos documentos independientes que deban actualizarse por separado, lo que reduce el riesgo de inconsistencias.
¿Los archivos llms.txt ayudan a posicionar un sitio?

Durante la conversación también se aborda el uso de llms.txt. Mueller explica que la propuesta no fue concebida originalmente como un mecanismo para que los motores de búsqueda o los LLM descubrieran todo el contenido de un sitio.
Su posible utilidad aparecería cuando un sistema ya conoce una web y necesita comprender qué más puede encontrar en ella o cómo realizar una acción concreta.
Por ejemplo, un agente que ya se encuentra dentro de un sitio podría consultar instrucciones sobre cómo adquirir un producto o utilizar determinado servicio. Sin embargo, eso es distinto a esperar que el archivo ayude al sistema a decidir cuál es el mejor sitio entre diferentes competidores.
Mueller sostiene que un sistema no puede confiar simplemente en las afirmaciones que cada web hace sobre sí misma para decidir cuál debe recomendar. Por eso, utilizar llms.txt como herramienta destinada a mejorar el descubrimiento o la visibilidad en buscadores y sistemas de IA no tendría sentido bajo ese enfoque.
Además, todavía existen diversas propuestas en discusión, desde archivos JSON hasta otros mecanismos e interfaces programáticas. Ninguna se ha consolidado todavía como un estándar único adoptado por todos los grandes sistemas.
Te puede interesar: Google AI Mode reveló cómo buscan las personas hoy: los datos reales
¿Cuándo tiene sentido usar Markdown?
Markdown puede tener sentido cuando facilita la creación y gestión del contenido. Es especialmente adecuado para documentación dirigida a desarrolladores, instrucciones técnicas, ejemplos de código y materiales relacionados con APIs.
En estos casos, una buena solución consiste en mantener la documentación original en Markdown y utilizarla para generar automáticamente la página HTML que verán los usuarios. De esta forma, ambas versiones proceden de una misma fuente y se evita que el contenido se desincronice.
Para el resto de los sitios, crear archivos Markdown adicionales únicamente para LLM no ofrece una ventaja clara según lo expuesto en la conversación. La prioridad debe seguir siendo disponer de páginas HTML que funcionen correctamente y que permitan a rastreadores y usuarios recorrer el sitio.
En conclusión, el debate sobre markdown vs. html no exige elegir un único ganador. Markdown es un formato sencillo para escribir, estructurar y reutilizar contenido, mientras que HTML sigue siendo fundamental para publicar páginas, conectar secciones y facilitar el rastreo, el descubrimiento y la indexación.
Para contenidos técnicos y documentación dirigida a desarrolladores, Markdown puede aportar valor, sobre todo cuando se utiliza como fuente para generar automáticamente la versión HTML. En cambio, crear versiones paralelas exclusivamente para LLM añade complejidad y no garantiza una mayor visibilidad. Para SEO y descubrimiento de contenido, la recomendación expuesta en la conversación sigue siendo clara: un sitio web HTML normal continúa siendo la base.