Saltar al contenido
jungladigital

Por qué la IA lee Markdown y no Word

Los mismos horarios de la barbería, guardados de dos maneras: 107 caracteres en un archivo md, y 10 759 bytes repartidos en dieciséis archivos dentro de un .docx. Esa diferencia es la que decide si el agente te entiende al primer intento.

Tienes los horarios y los precios del negocio en un documento de Word. Se los pasas al agente y algo sale torcido: te pregunta un dato que está escrito ahí, o te contesta con otro. Guardas lo mismo en un archivo .md, se lo pasas otra vez, y responde al primer intento.

La razón se puede ver con los ojos en menos de un minuto. Los dos archivos dicen exactamente lo mismo. Por dentro no se parecen en nada.

Los dos archivos, abiertos en la terminal

Los horarios de la barbería, guardados de las dos maneras. Esto es lo que sale al pedirle a la terminal que los lea:

~/barbería la esquina
$ lshorarios.docxhorarios.md$ cat horarios.md# Barbería La Esquina## HorariosLunes a sábado, de 9 a 19.## Precios- Corte: 8- Corte y barba: 12$ cat horarios.docxPK  [Content_Types].xml���N�0E%�%nY ��X ]B%������=�=���$4B����H�̜{}c+

Arriba está el texto tal cual, con unas almohadillas y unos guiones. Abajo está lo que la computadora tiene guardado de verdad cuando guardas en Word. No está roto ni corrupto: así es un .docx por dentro.

Un documento de Word es una carpeta comprimida

Esas dos letras del principio, PK, son la firma de todo archivo comprimido. Un .docx es un ZIP con carpetas dentro. Al descomprimir el de la barbería aparecen dieciséis archivos: uno con tu texto envuelto en etiquetas, otro con la lista de fuentes, otro con el tema de colores, otro con las relaciones entre las partes, y uno solo de estilos que ocupa veintisiete mil caracteres de definiciones de formato.

Los números del ejemplo son estos: el archivo .md pesa 107 caracteres. El .docx con la misma información pesa 10 759 bytes repartidos en esos dieciséis archivos. Todo lo que sobra es formato, y el formato al agente no le dice nada.

Lo que pasa cuando el agente abre los dos

Esta es una sesión de verdad, con los dos archivos en la misma carpeta y una pregunta que se contesta con cualquiera de los dos:

~/barbería la esquina — claude
> en esta carpeta tengo los datos de mi barbería en dos archivos. Léelos y dime a qué hora abro los sábados y cuánto cuesta el corte con barba
Reading… 3s (esc to interrupt)
Read(horarios.md)
9 líneas
Read(horarios.docx)
This tool cannot read binary files.
Bash(textutil -convert txt -stdout horarios.docx)
This command requires approval
Del horarios.md: los sábados abres a las 9 y el corte con barba cuesta 12. El .docx no lo pude abrir.
$

El .md lo leyó de una. Con el .docx probó cinco caminos distintos para desenvolverlo, todos pedían tu permiso, y terminó contestando con lo que había sacado del archivo de texto. Treinta y seis segundos para leer un archivo que ya tenía en la mano.

Las almohadillas también son información

Cuando escribes ## Precios, no estás poniendo un título en negrita. Estás diciendo «aquí empieza la sección de precios», y eso el modelo lo entiende porque aprendió leyendo millones de archivos escritos igual. Lo mismo con - [ ]: es una tarea pendiente, no un cuadradito.

Lo que escribes · horarios.md
# Barbería La Esquina

## Horarios

Lunes a sábado, de 9 a 19.

## Precios

- Corte: 8

- Corte y barba: 12
Lo que se ve

Barbería La Esquina

Horarios

Lunes a sábado, de 9 a 19.

Precios

  • Corte: 8
  • Corte y barba: 12

Un visor lo pinta con títulos grandes; el agente lee las almohadillas. Son la misma información contada dos veces, y por eso puedes escribir para los dos a la vez sin elegir. Si quieres el detalle de qué es este formato, está en qué es un archivo md.

Dónde Word sigue ganando

Casi siempre, si el que va a leer es una persona. Una carta a un cliente, un presupuesto que se imprime, un documento que revisas con alguien más usando comentarios y control de cambios: en todo eso Word gana y no hay discusión. También gana en lo más simple de todo, que es que la otra persona pueda abrirlo con doble clic sin preguntarte qué es eso.

Markdown gana cuando quien lee es la máquina, o cuando eres tú dentro de seis meses buscando un dato. Y no es una elección para toda la vida: convertir un archivo md a PDF o a Word es un paso, y se puede dar el día que haga falta.

El claro de Markdown

Cinco respuestas al mismo tema, cada una por su lado. No hay orden ni requisitos: entra por la que te trajo hasta aquí y sal cuando tengas lo que buscabas.

Si vas a probarlo hoy, empieza por el archivo más útil que puedes escribir: el README.md, el que se lee primero.