IA y automatización 8 min de lectura

El archivo que le falta a tu sitio: qué es (y para qué sirve) llms.txt

Los modelos de IA ya leen los sitios web como antes lo hacían los buscadores. llms.txt es el estándar emergente que les dice qué es confiable — cómo funciona y cómo implementarlo.

Durante años, los buscadores fueron la única audiencia para la que había que escribir un sitio web. Eso ya no es así. Una parte creciente del tráfico que llega a tus páginas hoy no es una persona haciendo clic en un link azul: es un modelo de lenguaje leyendo tu sitio para responder la pregunta de otra persona. Y la mayoría de los sitios todavía no ajustó nada pensando en ese lector.

Uno de los ajustes más simples y menos conocidos es un pequeño archivo de texto llamado llms.txt. No es un truco para posicionar mejor y no reemplaza un buen trabajo de SEO, pero resuelve un problema real: los rastreadores de IA llegan a tu sitio sin mapa, sin contexto y con un presupuesto limitado de páginas que van a procesar de verdad. llms.txt les da ese mapa.

Qué es realmente llms.txt

llms.txt es un archivo de texto plano, en formato Markdown, que se publica en la raíz de tu dominio (tusitio.com/llms.txt) y resume qué es tu sitio, qué ofrece y cuáles son sus páginas más importantes. Pensalo como un resumen ejecutivo escrito para una máquina en lugar de para una persona: sin textos de marketing, sin relleno, solo un mapa claro de tu contenido más relevante, en un formato que un modelo de lenguaje puede procesar de una sola pasada.

Se propuso como una convención abierta (todavía no es un estándar oficial de la web, y no lo controla ninguna empresa en particular), pero ya lo leen varias herramientas de IA y rastreadores, y su adopción está creciendo de la misma forma en que creció sitemap.xml hace más de una década: en silencio, hasta estar en todas partes.

robots.txt, sitemap.xml y llms.txt: tres trabajos distintos

Se confunden seguido porque los tres viven en la raíz del dominio, pero cada uno responde una pregunta diferente.

robots.txtsitemap.xmlllms.txt
Responde¿Qué se puede rastrear?¿Qué páginas existen?¿Qué es lo importante, y qué significa?
AudienciaRastreadores de buscadoresIndexadores de buscadoresModelos de lenguaje y asistentes de IA
FormatoReglas (permitir/denegar)Lista XML de URLsResumen en Markdown legible
¿Es opcional?RecomendadoRecomendadoOpcional, práctica emergente

Ninguno reemplaza a los otros. Un sitio con buen SEO técnico ya tiene los primeros dos. llms.txt es la pieza que falta para la audiencia que no rastrea todo tu sitio como lo hace Googlebot: muestrea, resume y sigue de largo.

Por qué esto importa ahora

Los asistentes de IA responden preguntas trayendo contexto de la web en tiempo real, o habiendo sido entrenados sobre ella. En cualquiera de los dos casos, trabajan con ventanas de contexto limitadas: no pueden leer todo tu sitio como lo haría una persona investigando. Si tu información más importante está enterrada a tres clics de profundidad, repartida en diez páginas, o envuelta en JavaScript que nunca se renderiza en una consulta liviana, directamente no llega a la respuesta.

llms.txt no arregla contenido malo ni una estructura de sitio confusa. Lo que sí hace es sacar la adivinanza de la ecuación: en lugar de esperar que un rastreador se tope con tu página de servicios o tu documentación, la señalás directamente, con una descripción de una línea que le dice al modelo por qué importa. Es un archivo chico que compensa una limitación real de cómo estos sistemas leen la web hoy.

Qué contiene un buen archivo llms.txt

La convención es deliberadamente simple: un H1 con el nombre de tu sitio o empresa, una línea de resumen, y una serie de secciones H2 que enlazan páginas agrupadas por tema. En la práctica, un llms.txt útil suele incluir:

  • Una descripción corta y factual de qué hace la empresa, sin adjetivos ni eslóganes.
  • Links directos a las páginas que realmente responden preguntas de compra: servicios, lógica de precios, casos de éxito, documentación.
  • Una descripción de una línea junto a cada link, explicando qué cubre esa página.
  • Una sección “opcional” para contenido secundario (blog, novedades, páginas legales) que es útil pero no esencial.

Un ejemplo mínimo se ve así:

# Codexia

> Desarrollo web a medida y sistemas de IA aplicada para empresas, con base en Argentina.

## Páginas principales

- [Servicios](https://codexia.com.ar/servicios): desarrollo web a medida, arquitectura API-first y automatización con IA.
- [Blog](https://codexia.com.ar/blog): artículos técnicos sobre arquitectura web, automatización e implementación de IA.
- [Contacto](https://codexia.com.ar/contacto): cómo comunicarte con el equipo y arrancar un proyecto.

## Opcional

- [Legal](https://codexia.com.ar/legal): términos y política de privacidad.

Fijate lo que falta: sin relleno de keywords, sin llamados a la acción, sin diseño. Está escrito para ser procesado, no para persuadir.

Cómo agregarlo en WordPress sin romper nada

En WordPress específicamente, hay dos formas seguras de hacerlo:

  1. Archivo estático en la raíz: la opción más limpia. Subís llms.txt directo al directorio raíz del sitio por SFTP para que se sirva en tusitio.com/llms.txt, igual que robots.txt. Sin plugin, sin base de datos, nada que se pueda romper con una actualización del tema.
  2. Regla de reescritura: si no tenés acceso al sistema de archivos, una regla que mapee /llms.txt a una página o a un endpoint virtual también funciona, aunque suma una pieza más para mantener.

De cualquier forma, mantenelo en tu control de versiones o en tu checklist de despliegue. Es un archivo que se desactualiza en silencio: nadie nota un link roto dentro de un archivo que casi ninguna persona abre, que es justamente por qué conviene revisarlo cada vez que cambian las páginas principales del sitio.

Errores comunes que vemos

  • Tratarlo como el meta keywords de antes. Rellenarlo con términos objetivo no funciona como funcionaban los trucos viejos de SEO, y arruina lo único que hace útil al archivo: ser confiable y específico.
  • Enlazar páginas que requieren login o renderizado en JavaScript. Si la página enlazada no se puede traer y leer como texto plano, esa entrada sirve para casi nada.
  • Escribirlo una vez y olvidarlo. Un llms.txt que apunta a un producto discontinuado o a una página caída en 404 hace más daño que no tener el archivo.
  • Esperar que resuelva un problema de contenido. Si las páginas enlazadas son pobres, están desactualizadas o se contradicen, ningún archivo resumen va a lograr que un sistema de IA te recomiende.

Preguntas frecuentes

¿llms.txt es un estándar oficial?

No. Es una convención propuesta por la comunidad, parecida a cómo empezó sitemap.xml antes de que los buscadores lo adoptaran formalmente. El soporte hoy es inconsistente entre las distintas herramientas de IA, pero la dirección es lo bastante clara como para que agregarlo cueste casi nada y cierre un vacío real.

¿Esto mejora mi posicionamiento en Google?

No está pensado para eso, y no hay evidencia de que afecte el posicionamiento tradicional en buscadores. Su función es ayudar a que los asistentes de IA y los modelos de lenguaje entiendan y citen tu sitio correctamente, un objetivo distinto y complementario al SEO clásico.

¿Necesito un plugin para agregarlo en WordPress?

No. Alcanza con un solo archivo estático subido a la raíz del sitio, y es la opción más confiable porque no depende del ecosistema de plugins ni de cambios de tema.

¿Cada cuánto hay que actualizarlo?

Cada vez que cambien de forma significativa tus páginas principales, tus servicios o tu estructura de precios: el mismo disparador que usarías para revisar tu sitemap.

Nada de esto reemplaza una base técnica sólida: páginas rápidas, HTML limpio, contenido real detrás de cada link. llms.txt es un agregado chico y de bajo esfuerzo sobre esa base, un detalle más que sumamos a los sitios que desarrollamos, junto con el sitemap y el schema markup, porque ignorar cómo leen un sitio las máquinas ya no es una opción, sea esa máquina un buscador o un asistente de IA.