llms.txt: cómo entregar tu contenido a los buscadores de IA — guía paso a paso para principiantes
Contenido del artículo
- Introducción: por qué tu sitio necesita un archivo llms.txt
- Preparación previa
- Conceptos básicos: qué es llms.txt y cómo funciona
- Paso 1: auditoría de contenido y selección de páginas para ia
- Paso 2: crear el archivo llms.txt y su esqueleto
- Paso 3: llenar las secciones y los enlaces
- Paso 4: crear llms-full.txt y versiones limpias en texto de las páginas
- Paso 5: subir los archivos al servidor
- Paso 6: configurar los encabezados de respuesta del servidor
- Verificación del resultado: checklist de preparación del llms.txt
- Errores típicos al crear llms.txt y sus soluciones
- Posibilidades adicionales: trabajo avanzado con llms.txt
- Faq: preguntas frecuentes sobre llms.txt
- Conclusión
Introducción: por qué tu sitio necesita un archivo llms.txt
Hace un par de años, el camino del usuario hacia tu contenido era simple: una consulta en el buscador, una lista de enlaces, un clic. En 2026 el panorama es distinto. Cada vez más personas hacen preguntas a asistentes de IA y buscadores de IA, y estos leen los sitios por su cuenta, los resumen y los citan. Si el modelo no entiende de qué trata tu sitio, lo ignorará o lo resumirá mal. El archivo llms.txt resuelve justamente ese problema: les explica a los modelos de lenguaje qué tienes y dónde está lo más importante.
Esta guía práctica te llevará desde un documento en blanco hasta un archivo llms.txt funcionando en tu dominio. Nada de teoría por la teoría misma, solo acciones concretas con verificación en cada paso.
Qué obtendrás al final
- Un archivo llms.txt listo, ubicado en la raíz de tu sitio y accesible en una dirección como tu-dominio/llms.txt.
- Una versión ampliada llms-full.txt con el texto completo de las páginas clave.
- Claridad sobre qué páginas conviene mostrarle a la IA y cuáles no.
- Una verificación configurada: sabrás que el archivo se lee y que los bots de IA llegan a él.
- Una base para seguir trabajando con optimización generativa, es decir, con la visibilidad de la marca en las respuestas de IA.
Para quién es esta guía
Para dueños de negocios, marketers, especialistas en arbitraje y desarrolladores que quieren que su producto, landing page o blog aparezcan correctamente en las respuestas de los asistentes de IA. Si tienes un sitio web y sabes subirle archivos, o conoces a quien lo hace, tienes las habilidades suficientes. Hay un bloque aparte al final para quienes quieren automatizar el proceso y monitorear el comportamiento de los bots de IA mediante logs.
Qué conviene saber de antemano
- Cómo está armado tu sitio: en un constructor, en un CMS como WordPress o con código propio.
- Dónde se guardan los archivos del sitio y cómo acceder: panel de hosting, FTP, repositorio.
- Una noción básica de Markdown: encabezados con numeral, listas con guion, enlaces entre corchetes y paréntesis. Si no lo conoces, no pasa nada: lo explicaremos con ejemplos.
Cuánto tiempo tomará
La versión mínima para un sitio de hasta 30 páginas toma alrededor de una hora. La versión completa con llms-full.txt, verificación y configuración de encabezados del servidor requerirá dos o tres horas. Para catálogos grandes y documentación, calcula un día entero, pero el resultado será notablemente mejor.
Preparación previa
Una buena preparación ahorra más tiempo que cualquier truco. Repasa la lista de abajo y asegúrate de tener todo a mano.
Herramientas y accesos necesarios
- Acceso a los archivos del sitio. Puede ser un panel de control de hosting con gestor de archivos, un cliente FTP como FileZilla, acceso SSH al servidor o un repositorio del proyecto desde donde se hace el deploy. Verifica que el usuario y la contraseña estén vigentes y que realmente puedas crear un archivo en la carpeta raíz del sitio.
- Editor de texto. Sirve cualquiera que guarde texto plano sin formato: Visual Studio Code, Sublime Text, Notepad++ en Windows, TextEdit en modo texto sin formato en Mac. Word y Google Docs no sirven: agregan caracteres invisibles y comillas tipográficas.
- Lista de páginas del sitio. Sácala del sitemap.xml, del panel del CMS o de cualquier crawler, por ejemplo Screaming Frog. Con una tabla con la dirección y el título de cada página es suficiente.
- Acceso a estadísticas. Google Analytics, Yandex Metrica o los logs del servidor te ayudarán a entender qué páginas son realmente importantes para los usuarios.
- Navegador y la utilidad curl. Curl viene preinstalada en Mac y Linux, y en Windows 10 y 11 está disponible desde la línea de comandos. La necesitarás para verificar los encabezados de respuesta del servidor.
Requisitos del sistema
Ninguno. El archivo llms.txt es texto plano. No necesita PHP, ni base de datos, ni un módulo especial en el servidor. El único requisito: que el servidor entregue archivos estáticos desde la raíz del dominio, y eso lo hace cualquier hosting.
Qué descargar e instalar
- Un editor de código, si aún no tienes uno. Recomendamos Visual Studio Code: es gratuito, resalta Markdown y muestra caracteres invisibles.
- Un cliente FTP, si el panel de hosting no tiene gestor de archivos.
- Opcional: Python 3 y el paquete llms-txt para generar contexto a partir del archivo ya creado. Servirá en el bloque avanzado, para la configuración básica no es obligatorio.
Copias de seguridad
Crear llms.txt no modifica los archivos existentes del sitio, así que el riesgo es mínimo. Sin embargo, en el paso de configuración de encabezados del servidor editarás la configuración, por ejemplo el archivo .htaccess o el config de Nginx. Antes de eso, descarga obligatoriamente la versión actual del archivo de configuración a tu computadora y guárdala con la fecha marcada. Si después de la edición el sitio deja de abrir, simplemente restaurarás la versión anterior.
Consejo: Crea una carpeta de proyecto aparte en tu computadora, por ejemplo site-llms. Guarda ahí la tabla de páginas, los borradores del archivo y las copias de los configs. En seis meses, cuando llegue el momento de actualizar llms.txt, te lo agradecerás.
Conceptos básicos: qué es llms.txt y cómo funciona
Antes de crear el archivo, repasemos algunos términos en lenguaje sencillo. Tomará cinco minutos, pero después todo quedará claro.
Qué es llms.txt
llms.txt es un archivo de texto en formato Markdown que se coloca en la raíz del sitio. Contiene una descripción breve del proyecto y una lista estructurada de enlaces a las páginas clave con explicaciones. El nombre se lee como «ele-ele-eme-ese-punto-te-eme-ese»: LLMs son Large Language Models, grandes modelos de lenguaje.
La propuesta del estándar apareció en otoño de 2024 de parte del desarrollador Jeremy Howard, de la empresa Answer.AI. La idea era simple: los modelos de lenguaje tienen una «ventana de atención» limitada y procesan mal las páginas HTML pesadas con menús, publicidad, scripts y pop-ups. El archivo llms.txt les da un mapa limpio del contenido sin ruido. Desde entonces, cientos de empresas adoptaron el formato, sobre todo en el ámbito de documentación y desarrollo, y en 2025-2026 se convirtió en uno de los elementos básicos para preparar un sitio web de cara a la IA.
Qué no es llms.txt
Es importante entenderlo de inmediato para no confundir herramientas.
- No es un archivo de prohibiciones. No bloquea ni permite nada. Las reglas de acceso para bots viven en otro archivo, y sobre él tenemos materiales aparte en nuestro blog. Aquí no tocamos ese tema.
- No es un mapa del sitio en el sentido de sitemap.xml. El sitemap enumera todas las direcciones para indexación. El archivo llms.txt, al contrario, selecciona lo esencial y explica el sentido de cada enlace.
- No es una garantía de aparecer en las respuestas de IA. El archivo ayuda a los modelos a entender el contenido, pero no los obliga a citarlo.
Dos archivos: llms.txt y llms-full.txt
El estándar propone dos entidades:
- llms.txt — navegación breve. Título, resumen, secciones con enlaces. Normalmente de 20 a 200 líneas.
- llms-full.txt — el contenido completo de las páginas clave en un solo texto. El modelo o la herramienta pueden cargarlo entero y no tener que ir siguiendo enlaces.
El primer archivo es obligatorio, el segundo es deseable. Haremos ambos.
Cómo se ve la estructura del archivo
La especificación establece un orden estricto de bloques:
- Encabezado de primer nivel con el nombre del proyecto. Es el único elemento obligatorio.
- Bloque de cita con una descripción breve: una a tres oraciones sobre qué es este sitio y a quién le sirve.
- Párrafos opcionales con detalles: características, limitaciones, contexto.
- Secciones de segundo nivel, cada una con una lista de enlaces. Formato de la línea: guion, nombre del enlace entre corchetes, dirección entre paréntesis, dos puntos y una descripción corta.
- Sección opcional con el nombre Optional. Los enlaces de ahí el modelo puede omitirlos si le queda poco espacio en el contexto.
Aquí va un ejemplo mínimo al que volveremos:
# Nombre del proyecto
> Una o dos oraciones: qué es y para quién.
## Documentación
- [Inicio rápido](https://example.com/docs/start): cómo empezar en 10 minutos
- [Planes](https://example.com/pricing): precios y límites
## Optional
- [Historial de cambios](https://example.com/changelog): qué se ha actualizadoAquí el salto de línea se muestra de forma simbólica; en el archivo real son simplemente líneas nuevas. No parece complicado, ¿verdad? El trabajo principal no está en la sintaxis, sino en elegir las páginas y redactar las descripciones. A eso nos dedicaremos.
Quién lee llms.txt en 2026
Respuesta honesta: no todos, y no de la misma manera. El formato lo usan activamente herramientas de IA para desarrolladores, editores de código con asistentes de IA, algunos buscadores de IA y agentes que entran al sitio en el momento de la consulta del usuario. Las mayores compañías de búsqueda no han confirmado oficialmente su soporte. Aun así, el estándar se volvió un lenguaje común en la industria, el archivo no cuesta nada mantenerlo, y su ausencia definitivamente no ayuda. Además hay un beneficio colateral: al armar el llms.txt, pones orden en tu propio contenido.
Paso 1: Auditoría de contenido y selección de páginas para IA
Objetivo de esta etapa: obtener una tabla de 10 a 50 páginas que entrarán en llms.txt, con la sección marcada y un borrador de descripción para cada una.
El error más común de los principiantes es meter todo lo que haya. El modelo recibe mil líneas, no encuentra lo esencial y trabaja peor que sin el archivo. Tu tarea es seleccionar lo que realmente explica el producto y responde a las preguntas de la audiencia.
Instrucciones
- Abre la tabla con la lista de páginas del sitio que preparaste antes. Si no la tienes, abre la dirección tu-dominio/sitemap.xml en el navegador y copia las direcciones a una hoja de cálculo.
- Agrega columnas: «Título», «Sección», «Descripción para IA», «Prioridad».
- Repasa cada fila y responde la pregunta: «Si alguien le pregunta a la IA sobre mi producto, ¿esta página ayudará a dar una respuesta precisa?» Si sí, marca prioridad 1. Si la página es útil pero secundaria, marca 2. Todo lo demás márcalo con cero.
- Incluye obligatoriamente con prioridad 1: la página principal con la descripción del producto, la página de planes o precios, la página «Sobre la empresa», las secciones de documentación o instructivos, la página de contacto y los términos de uso. Para una tienda en línea: las páginas de categorías y de envíos. Para un proyecto de arbitraje o de afiliados: la página con las condiciones del programa y la descripción de la oferta.
- Abre las estadísticas. Mira las 20 páginas más visitadas de los últimos tres meses. Si alguna no quedó en prioridad 1, reconsidera la decisión: los usuarios la consideran importante.
- Excluye las páginas de servicio: carrito, cuenta personal, resultados de búsqueda, páginas de paginación, duplicados con etiquetas UTM, promociones antiguas.
- Agrupa las páginas con prioridad 1 y 2 en tres a seis secciones. Nombres típicos: «Producto», «Documentación», «Planes», «Blog», «Soporte», «Casos». Anota el nombre de la sección en la columna «Sección».
- Para cada página seleccionada escribe un borrador de descripción de 8 a 15 palabras. No copies la meta descripción: está escrita para las personas en los resultados de búsqueda. Escribe de forma que el modelo entienda cuándo conviene abrir esa página. Mal: «Nuestros planes». Bien: «Costo de proxies móviles por país, límites de tráfico y condiciones de cambio de IP».
Consejo: Imagina que las descripciones las lee un nuevo empleado de soporte que debe entender en un minuto a dónde enviar al cliente. Si tu descripción le basta, también le servirá a un modelo de lenguaje.
Resultado esperado
Tienes una tabla donde están filtradas las páginas con prioridad 1 y 2, cada una asignada a una sección y con un borrador de descripción. Normalmente son de 10 a 50 líneas para un sitio típico y hasta 200 para documentación extensa.
Verificación: Lee solo la columna «Descripción para IA» de arriba hacia abajo, sin mirar las direcciones. Si con las descripciones queda claro a qué se dedica el sitio y cómo está armado el producto, la auditoría está bien hecha.
Posibles problemas
- Demasiadas páginas con prioridad 1. Si son más de 60, no fuiste lo bastante estricto. Pregúntate otra vez: ¿sin qué página el modelo no podrá responder correctamente? El resto pásalo a prioridad 2 o a la sección Optional.
- El contenido está disperso, no hay secciones claras. Es una señal de problemas en la estructura del sitio. Para llms.txt simplemente crea grupos lógicos, aunque no existan en el menú. Después podrás ajustar también la navegación.
- Las páginas están cerradas a la indexación o solo son accesibles tras iniciar sesión. No las incluyas. El modelo tampoco podrá leerlas, y le estarás dando enlaces falsos.
Paso 2: Crear el archivo llms.txt y su esqueleto
Objetivo de esta etapa: crear el archivo con el nombre y la codificación correctos, llenar el título, el resumen y los párrafos de contexto.
Instrucciones
- Abre el editor de texto. Crea un archivo nuevo desde el menú «Archivo» y la opción «Nuevo archivo», o con la combinación Ctrl+N.
- Guárdalo de inmediato: menú «Archivo», opción «Guardar como». En el campo del nombre escribe exactamente llms.txt en minúsculas. Verifica que el editor no haya agregado una segunda extensión como llms.txt.txt. En Windows, para eso activa la visualización de extensiones en el Explorador.
- Asegúrate de que la codificación del archivo sea UTF-8 sin BOM. En Visual Studio Code la codificación se muestra en la esquina inferior derecha de la ventana; haz clic en ella, elige «Guardar con codificación» e indica UTF-8. En Notepad++ abre el menú «Codificación» y elige «Codificar en UTF-8» sin la marca BOM.
- En la primera línea escribe el encabezado de primer nivel: el símbolo de numeral, un espacio, el nombre del proyecto. Por ejemplo: # MobileProxy.space. Usa el nombre de la marca tal como la conocen los clientes, sin eslóganes.
- Deja una línea vacía.
- Escribe el bloque de cita: el símbolo «mayor que», un espacio y una a tres oraciones sobre la esencia del proyecto. Responde a las preguntas «qué es», «para quién», «en qué se diferencia». Ejemplo: > Servicio de alquiler de proxies móviles con IP de operadores de telefonía para marketers, especialistas en arbitraje y desarrolladores. Admite rotación de direcciones por enlace y API, funciona con navegadores antidetect y herramientas de scraping.
- Deja una línea vacía.
- Agrega uno a tres párrafos normales con contexto que ayude al modelo a no equivocarse. Aquí encajan bien: la geografía de operación, los idiomas que admite el sitio, lo que el servicio no hace, la fecha de vigencia de la información. Ejemplo: «Los precios están indicados en rublos y se actualizan mensualmente. El sitio está disponible en ruso e inglés; la versión en inglés está en la subcarpeta /en/. El servicio provee infraestructura y no ofrece servicios de configuración de campañas publicitarias».
- Guarda el archivo con Ctrl+S.
Atención: En el archivo debe haber exactamente un encabezado de primer nivel, y debe ir en la primera línea. Si pones antes un comentario, una línea vacía con espacios o un segundo encabezado, las herramientas que siguen estrictamente la especificación pueden negarse a procesar el archivo.
Cómo escribir el resumen para que funcione
El bloque de cita es el lugar más leído del archivo. Es justamente lo que el modelo usa con más frecuencia cuando resume de qué trata tu sitio. Algunas reglas:
- Nada de palabras valorativas. «El mejor», «único», «número uno» no aportan información y reducen la confianza del modelo en el resto del texto.
- Concreción en lugar de abstracciones. No «soluciones para negocios», sino «alquiler de proxies móviles con IP de operadores rusos y europeos».
- Indica la audiencia objetivo de forma explícita. El modelo la compara con la pregunta del usuario.
- Mantente dentro de 300-400 caracteres. Más largo, el modelo puede recortarlo.
Consejo: Escribe tres versiones del resumen e inserta cada una en cualquier asistente de IA disponible con la pregunta: «¿A qué se dedica esta empresa y a quién le sirve? Responde en una oración». Elige la versión con la que el asistente respondió con mayor precisión.
Resultado esperado
El archivo llms.txt existe en el disco, está guardado en UTF-8, empieza con un solo encabezado, contiene el resumen en el bloque de cita y uno a tres párrafos de contexto. Todavía no hay secciones con enlaces, eso es el siguiente paso.
Verificación: Abre el archivo en el navegador arrastrándolo a la ventana. Debes ver texto limpio sin caracteres extraños en lugar del cirílico. Si en vez de letras rusas aparecen signos de interrogación o rombos, la codificación no es la correcta; vuelve al punto 3.
Posibles problemas
- El editor reemplazó automáticamente las comillas por «tipográficas» o los guiones por rayas largas. Desactiva el autorreemplazo en la configuración o usa un editor de código. En los enlaces Markdown, esos caracteres rompen el formato.
- El archivo se guardó como llms.txt.txt. Renómbralo desde el Explorador o Finder, activando antes la visualización de extensiones.
Paso 3: Llenar las secciones y los enlaces
Objetivo de esta etapa: pasar las páginas seleccionadas de la tabla al archivo con la sintaxis correcta, agruparlas por secciones y agregar el bloque Optional.
Instrucciones
- Abre llms.txt y la tabla del paso 1 uno junto al otro.
- Después de los párrafos de contexto deja una línea vacía y escribe el encabezado de segundo nivel para la primera sección: dos numerales, un espacio, el nombre. Por ejemplo: ## Producto.
- Deja una línea vacía.
- Para cada página de esta sección escribe una línea de lista estrictamente según la plantilla: guion, espacio, corchete de apertura, nombre de la página, corchete de cierre, paréntesis de apertura, dirección completa con protocolo, paréntesis de cierre, dos puntos, espacio, descripción. Ejemplo: - [Planes de proxies móviles](https://example.com/pricing): costo por país y operador, límites de tráfico, condiciones de rotación de IP.
- Usa direcciones absolutas con https al inicio. Las rutas relativas como /pricing muchas herramientas no podrán resolverlas, porque leen el archivo fuera del contexto del navegador.
- Toma el nombre del enlace del encabezado de la página, pero redúcelo a cinco u ocho palabras. La descripción, de la columna «Descripción para IA».
- Repite los puntos 2-6 para cada sección. El orden de las secciones va de lo más importante a lo menos importante: primero producto y precios, después documentación, luego blog y casos.
- Dentro de cada sección coloca también las páginas por relevancia. Los primeros tres enlaces de cada sección son los que más se leen.
- Como última sección agrega ## Optional. Pasa ahí las páginas con prioridad 2: archivo del blog, historial de cambios, casos secundarios, páginas de vacantes. El nombre de la sección debe estar escrito exactamente en latín: Optional. Es una palabra reservada de la especificación.
- Guarda el archivo.
Consejo: Si el sitio ya tiene páginas que entregan el contenido en formato limpio, por ejemplo versiones en Markdown o páginas de documentación en texto simple, enlaza esas y no las versiones HTML. El modelo recibirá el texto sin menús ni scripts y lo entenderá mejor.
Ejemplo de una sección terminada
## Documentación
- [Conexión de proxy en navegador antidetect](https://example.com/docs/antidetect): configuración paso a paso del perfil, verificación de IP y errores típicos
- [API de cambio de IP](https://example.com/docs/api): métodos, parámetros de solicitudes, límites y ejemplos de respuestas en JSON
- [Formatos de conexión](https://example.com/docs/formats): HTTP, SOCKS5, autenticación por usuario y por IPCómo escribir las descripciones de los enlaces
La descripción después de los dos puntos es una pista para el modelo sobre cuándo conviene abrir la página. Cuanto más precisa sea la pista, mejor elegirá el modelo la fuente para responder. Las reglas son simples:
- Responde a la pregunta «qué hay dentro», no «por qué leerlo». No «artículo útil sobre proxies», sino «comparación de proxies móviles, residenciales y de servidor por velocidad, costo y riesgo de bloqueos».
- Usa las palabras con las que los usuarios hacen sus preguntas. Si los clientes preguntan «cómo cambiar la ip», en la descripción debe decir «cambio de IP».
- No dupliques el nombre del enlace. El nombre dice «qué es», la descripción dice «qué hay concretamente ahí».
- Mantente dentro de una sola línea. Los saltos de línea dentro de un elemento de lista rompen el procesamiento.
Resultado esperado
El archivo contiene de tres a seis secciones de segundo nivel, cada una con 2 a 20 enlaces con descripciones, y la sección Optional al final. El volumen total va de 20 a 200 líneas.
Verificación: Pega el contenido del archivo en cualquier visor de Markdown en línea o abre la vista previa en el editor de código. Todos los enlaces deben volverse clicables, los encabezados grandes, las listas con viñetas. Si alguna línea se muestra como texto plano con paréntesis, tiene un error de sintaxis.
Posibles problemas
- El enlace no se volvió clicable. Lo más común es que falte el espacio después del guion, falte un corchete o haya un espacio entre el corchete de cierre y el paréntesis de apertura. Ahí no debe haber espacio.
- La dirección tiene espacios o cirílico. Codifica la dirección: el espacio se reemplaza por %20, los caracteres cirílicos por sus representaciones porcentuales. Lo más fácil es copiar la dirección desde la barra del navegador, ya viene codificada.
- La descripción contiene dos puntos. Los primeros dos puntos después del paréntesis de cierre se consideran el separador; los siguientes dos puntos dentro de la descripción sí son admisibles, pero mejor reformular para evitar confusión.
Paso 4: Crear llms-full.txt y versiones limpias en texto de las páginas
Objetivo de esta etapa: reunir un archivo ampliado con el texto completo de las páginas clave, para que las herramientas puedan cargar todo el contenido en una sola solicitud.
Este paso es opcional, pero es justamente el que da la mayor ganancia para documentación, instructivos y descripciones detalladas del producto. Si llms.txt es un índice, entonces llms-full.txt es el libro completo.
Instrucciones
- Crea un archivo nuevo y guárdalo como llms-full.txt con la misma codificación UTF-8.
- Copia al inicio el encabezado de primer nivel y el bloque de cita de llms.txt. Los archivos deben empezar igual.
- Para cada página con prioridad 1 ábrela en el navegador y copia el texto principal: encabezados, párrafos, listas, tablas. No copies menús, pies de página, formularios de suscripción, comentarios ni bloques publicitarios.
- Pega el texto en el archivo bajo un encabezado de segundo nivel con el nombre de la página. Los encabezados dentro de la página bájalos uno o dos niveles: lo que en el sitio era encabezado de segundo nivel, en el archivo pasará a ser tercero. Así se conserva la jerarquía.
- Después de cada bloque agrega una línea con la dirección de la fuente, por ejemplo: Fuente: https://example.com/docs/api. Esto ayuda al modelo a referenciar la página concreta.
- Separa los bloques de páginas con una línea vacía y una línea de tres guiones, el separador horizontal estándar de Markdown.
- Pasa las tablas a formato Markdown con barras verticales o conviértelas en listas si la estructura es simple.
- Elimina frases de servicio como «haz clic aquí», «lee más», «compartir». En un texto sin interfaz, carecen de sentido.
- Guarda el archivo.
Atención: No incluyas en llms-full.txt datos personales de clientes, documentos internos, cupones ni cualquier información que no estés dispuesto a ver en la respuesta de un asistente de IA a un desconocido. Todo lo que entre en este archivo queda, en esencia, publicado.
Cuánto texto debe tener
Una referencia razonable es de 20 a 300 mil caracteres. Menos: el archivo no justifica su existencia, basta con llms.txt. Más: muchas herramientas no lo cargarán entero. Si hay mucho contenido, haz varios archivos temáticos, por ejemplo llms-full-docs.txt y llms-full-blog.txt, y enlázalos desde llms.txt en una sección aparte.
Consejo: Para sitios en WordPress y en la mayoría de los CMS existen plugins y módulos que generan llms.txt y llms-full.txt automáticamente a partir de las entradas publicadas. Búscalos en el catálogo de extensiones por «llms txt». La autogeneración ahorra horas, pero revisa el resultado manualmente sin falta: los plugins suelen arrastrar al archivo todo lo que haya, incluidas páginas de etiquetas y borradores.
Resultado esperado
El archivo llms-full.txt contiene el mismo encabezado y resumen que llms.txt, y a continuación el texto limpio completo de las páginas clave con indicación de fuentes.
Verificación: Abre el archivo y lee un fragmento al azar del medio. Si queda claro de qué página se trata y el texto se lee sin basura de interfaz, todo está bien. Si aparecen fragmentos como «Menú Inicio Planes Contacto», límpialos.
Posibles problemas
- Al copiar desde el navegador se pierde la estructura de encabezados. Copia por partes y coloca los numerales a mano, o usa una extensión del navegador para guardar la página en Markdown.
- El archivo quedó de varios megabytes. Divídelo en partes temáticas o deja solo las páginas con prioridad 1.
Paso 5: Subir los archivos al servidor
Objetivo de esta etapa: colocar llms.txt y llms-full.txt en la raíz del sitio, de modo que se abran en la dirección tu-dominio/llms.txt.
El método depende de cómo esté armado tu sitio. Abajo hay cuatro escenarios típicos. Elige el tuyo.
Opción A: panel de hosting con gestor de archivos
- Entra al panel de control del hosting con el usuario y la contraseña del correo del proveedor.
- Encuentra la sección llamada «Gestor de archivos», «Archivos» o «Administrador de archivos».
- Ve a la carpeta raíz del sitio. Normalmente se llama public_html, www, htdocs o lleva el nombre del dominio. Referencia: ahí está el archivo index.html o index.php y el sitemap.xml ya existente.
- Haz clic en el botón «Subir» o «Upload». Se abrirá la ventana de selección de archivos.
- Elige llms.txt y llms-full.txt de tu computadora, confirma la subida. Espera el indicador de finalización.
- Verifica que los archivos aparezcan en la lista junto al archivo index y que los permisos sean 644, es decir, lectura para todos, escritura solo para el propietario. Normalmente el panel los asigna solo.
Opción B: cliente FTP
- Abre FileZilla o un cliente similar.
- En el panel superior ingresa el host, el usuario, la contraseña y el puerto del correo del proveedor. Haz clic en «Conexión rápida».
- En la parte derecha de la ventana encuentra la carpeta raíz del sitio por las mismas señales que arriba.
- En la parte izquierda encuentra la carpeta con tus archivos en la computadora.
- Arrastra llms.txt y llms-full.txt de izquierda a derecha. En la parte inferior de la ventana aparecerá la cola de transferencia; espera a que se vacíe.
- Haz clic derecho sobre el archivo subido, elige «Permisos de archivo» y verifica el valor 644.
Opción C: sitio desde un repositorio con deploy automático
- Determina la carpeta desde la que se publican los archivos estáticos. En la mayoría de los frameworks se llama public o static y está en la raíz del proyecto.
- Coloca llms.txt y llms-full.txt en esa carpeta, junto al favicon y al archivo robots.
- Haz commit de los cambios y envíalos a la rama desde la que se hace el deploy.
- Espera a que termine la compilación. El tiempo depende del proyecto, normalmente de uno a diez minutos.
Opción D: constructor de sitios
Aquí todo es más complicado: no todos los constructores permiten agregar un archivo arbitrario en la raíz del dominio. El procedimiento es:
- Abre la configuración del sitio y busca una sección como «Archivos», «Subida de archivos», «SEO» o «Avanzado».
- Si hay posibilidad de subir un archivo indicando la ruta, especifica la ruta /llms.txt.
- Si no hay esa posibilidad, pero sí hay configuración de redirecciones o reglas, crea una regla: la solicitud a /llms.txt redirigirla con código 200 o 301 al archivo subido. Algunas plataformas lo llaman «redirección» o «reglas de enrutamiento».
- Si tampoco eso está disponible, contacta al soporte del constructor con la solicitud de colocar un archivo de texto en la raíz. La formulación: «Necesito colocar un archivo estático llms.txt en la dirección dominio/llms.txt con tipo text/plain».
Atención: El archivo debe estar exactamente en la raíz del dominio, no en una subcarpeta. Una dirección como dominio/files/llms.txt las herramientas no la encontrarán, porque buscan el archivo en una ruta fija, como el favicon o el sitemap.
Consejo: Si el sitio funciona en varios dominios o subdominios, por ejemplo el dominio principal y un subdominio aparte para la documentación, coloca llms.txt en cada uno. El archivo de cada dominio describe solo su propio contenido, y en la sección de enlaces puede apuntar al dominio vecino.
Resultado esperado
Al escribir en la barra del navegador la dirección tu-dominio/llms.txt, se abre tu texto. Lo mismo para llms-full.txt.
Verificación: Abre ambas direcciones en modo incógnito para excluir el caché del navegador. Debes ver el texto del archivo tal cual: el encabezado con numeral, la cita con el signo «mayor que», la lista con guiones. Si el navegador ofreció descargar el archivo en lugar de mostrarlo, no es crítico, pero lo corregiremos en el siguiente paso.
Posibles problemas
- Error 404. El archivo no está en la raíz o el nombre está mal escrito. Verifica el uso de mayúsculas: LLMS.txt y llms.txt en servidores Linux son archivos distintos.
- Error 403. Permisos incorrectos. Configura 644 desde el gestor de archivos o FTP.
- Se abre la versión antigua después de actualizar. Está funcionando el caché del hosting o del CDN. Limpia el caché en el panel o espera el tiempo de vida del caché.
- El cirílico se muestra mal. El servidor no informa la codificación. Esto se resuelve en el siguiente paso.
Paso 6: Configurar los encabezados de respuesta del servidor
Objetivo de esta etapa: lograr que el servidor entregue el archivo con el tipo de contenido y la codificación correctos, permita el acceso a agentes de IA desde herramientas del navegador y no cachee el archivo por demasiado tiempo.
Este paso no es para todos. Si la verificación del paso 5 mostró texto correcto con letras rusas, puedes limitarte al punto de verificación de abajo. Pero los encabezados correctos aumentan la probabilidad de que las herramientas procesen el archivo sin sorpresas.
Qué encabezados se necesitan
- Content-Type: text/plain; charset=utf-8 o text/markdown; charset=utf-8. La primera opción es más universal.
- Cache-Control: max-age=3600 — caché por una hora. Es suficiente para aliviar la carga, pero las actualizaciones se toman rápido.
- Access-Control-Allow-Origin: * — permiso para leer el archivo desde aplicaciones web en otros dominios. Algunas herramientas de IA funcionan directamente en el navegador y sin este encabezado no podrán cargar el archivo.
Instrucciones para Apache a través de .htaccess
- Descarga el archivo .htaccess actual de la raíz del sitio a tu computadora y guarda una copia. Si no existe, crea uno nuevo vacío.
- Abre el archivo en el editor y agrega al final el bloque:
<Files "llms.txt">
Header set Content-Type "text/plain; charset=utf-8"
Header set Cache-Control "max-age=3600"
Header set Access-Control-Allow-Origin "*"
</Files>
<Files "llms-full.txt">
Header set Content-Type "text/plain; charset=utf-8"
Header set Cache-Control "max-age=3600"
Header set Access-Control-Allow-Origin "*"
</Files>- Guarda y sube el archivo de vuelta a la raíz del sitio, reemplazando el antiguo.
- Abre de inmediato la página principal del sitio. Si abre, todo bien. Si ves un error 500, restaura de inmediato la copia guardada: probablemente en el hosting no está habilitado el módulo de encabezados. Entonces contacta al soporte del hosting con la solicitud de habilitar mod_headers.
Instrucciones para Nginx
- Conéctate al servidor por SSH.
- Haz una copia del archivo de configuración del sitio, normalmente está en la carpeta /etc/nginx/sites-available/.
- Dentro del bloque server agrega:
location = /llms.txt {
default_type text/plain;
charset utf-8;
add_header Cache-Control "max-age=3600";
add_header Access-Control-Allow-Origin "*";
}
location = /llms-full.txt {
default_type text/plain;
charset utf-8;
add_header Cache-Control "max-age=3600";
add_header Access-Control-Allow-Origin "*";
}- Verifica la configuración con el comando nginx -t. Debe aparecer un mensaje de verificación exitosa.
- Recarga la configuración con el comando systemctl reload nginx.
Instrucciones para constructores y plataformas en la nube
Busca en la configuración la sección «Encabezados» o «Headers». Muchas plataformas admiten un archivo con reglas de encabezados en la raíz del proyecto; la sintaxis es distinta en cada una, pero el sentido es el mismo: para la ruta /llms.txt definir Content-Type y Cache-Control. Si no existe esa posibilidad, no te preocupes: la mayoría de los servidores entregan los .txt como text/plain por defecto, y eso ya es aceptable.
Resultado esperado
El servidor entrega el archivo con código 200 y los encabezados necesarios.
Verificación: Abre la línea de comandos o la terminal y ejecuta el comando curl -I https://tu-dominio/llms.txt. En la respuesta debes ver la línea HTTP/2 200 o HTTP/1.1 200 OK, la línea content-type: text/plain; charset=utf-8 y la línea cache-control: max-age=3600. Si quieres ver también el contenido, quita la opción -I.
Posibles problemas
- Error 500 después de editar .htaccess. Restaura la copia, verifica que no hayan quedado caracteres de más y aclara con el proveedor si el módulo de encabezados está habilitado.
- Los encabezados no cambiaron. Delante del servidor hay un CDN o un proxy caché que entrega la versión antigua. Limpia el caché del CDN en su panel.
- Content-Type sigue siendo text/html. Alguna regla reescribe todas las solicitudes a index.php. Asegúrate de que la regla excluya los archivos existentes, normalmente mediante la condición «si el archivo no existe».
Verificación del resultado: checklist de preparación del llms.txt
Ya pasaste por todos los pasos. Ahora asegurémonos de que el resultado sea realmente funcional, y no solo «un archivo que está ahí». Repasa el checklist punto por punto y marca lo cumplido.
Checklist
- La dirección dominio/llms.txt abre en el navegador en modo incógnito y muestra el texto.
- La primera línea del archivo es el único encabezado de primer nivel con el nombre del proyecto.
- Justo después del encabezado viene el bloque de cita con un resumen de hasta 400 caracteres.
- Todos los enlaces son absolutos, empiezan con https y abren sin redirecciones ni errores.
- Cada enlace tiene una descripción después de los dos puntos.
- Las secciones están ordenadas por importancia, lo secundario está en Optional.
- El cirílico se muestra correctamente, la codificación es UTF-8.
- El comando curl -I muestra el código 200 y el tipo text/plain o text/markdown.
- Si se creó llms-full.txt, abre en su dirección y empieza igual que llms.txt.
- En los archivos no hay datos personales ni información interna.
Cómo probar de verdad
- Verificación de enlaces. Copia todas las direcciones del archivo en cualquier verificador masivo de enlaces o en una herramienta de verificación de respuesta del servidor. Todas deben devolver 200. Un enlace roto no rompe el archivo, pero reduce la confianza del modelo.
- Verificación de validez. Pega el contenido en un validador de llms.txt en línea; en 2026 hay varios servicios así, búscalos por el nombre del estándar. El validador mostrará si reconoció el encabezado, el resumen y las secciones.
- Prueba con un modelo real. Abre cualquier asistente de IA que sepa leer enlaces. Dale la dirección de tu archivo y pídele: «Estudia este archivo y cuéntame a qué se dedica la empresa, cuánto cuesta el servicio y adónde ir para ver el instructivo de conexión». Si la respuesta es precisa y el asistente cita las páginas correctas, lo lograste. Si se confunde, mira qué descripciones lo desviaron y afínalas.
- Prueba desde distintas redes. Si tienes acceso a proxies móviles en distintas regiones, abre el archivo a través de ellos. Esto mostrará si el servidor entrega contenido distinto según el país y si la protección antibots bloquea el acceso al archivo para ciertos rangos de IP. Los agentes de IA llegan desde direcciones muy variadas, y el archivo debe estar disponible para todos.
Indicadores de éxito
- Los diez puntos del checklist están cumplidos.
- El asistente de IA resumió la esencia del sitio sin errores factuales.
- Dentro de dos a cuatro semanas aparecen en los logs del servidor solicitudes a /llms.txt de agentes de compañías de IA. Cómo encontrarlas lo contaremos en el bloque avanzado.
Errores típicos al crear llms.txt y sus soluciones
Abajo están los problemas con los que se topa casi todo el que hace el archivo por primera vez. Formato: problema, causa, solución.
1. El archivo abre, pero la herramienta de IA dice que no lo encontró
Causa: la protección antibots a nivel de hosting o CDN muestra un captcha o una verificación JavaScript a todo lo que parece una solicitud automática. El navegador pasa la verificación sin problemas, el agente no.
Solución: en la configuración de la protección agrega una excepción para la ruta /llms.txt y /llms-full.txt. Verifica el resultado con el comando curl sin encabezados de navegador: si curl recibe el texto y no una página HTML con verificación, todo está corregido.
2. El modelo resume mal el sitio, aunque el archivo existe
Causa: el resumen es vago o las descripciones de los enlaces repiten los nombres y no aportan información.
Solución: reescribe el resumen según las reglas del paso 2, y las descripciones según las reglas del paso 3. Vuelve a hacer la prueba con el asistente.
3. En el archivo hay cientos de enlaces y se volvió inútil
Causa: autogeneración por plugin o perfeccionismo: «que esté todo».
Solución: vuelve a la auditoría del paso 1. Deja en las secciones principales no más de 50 enlaces, el resto pásalo a Optional o elimínalo. La completitud la da llms-full.txt, no la longitud del índice.
4. Las letras rusas se convirtieron en signos de interrogación
Causa: el archivo se guardó en codificación Windows-1251 o el servidor no transmite el charset.
Solución: vuelve a guardar el archivo en UTF-8 sin BOM y agrega charset=utf-8 al encabezado Content-Type según las instrucciones del paso 6.
5. Se actualizó el archivo, pero la IA ve la versión antigua
Causa: caché prolongado en el CDN o en la propia herramienta.
Solución: configura Cache-Control con un max-age no mayor a una hora, limpia el caché del CDN. Las herramientas actualizan sus copias con distinta periodicidad, dales unos días.
6. Los enlaces llevan a páginas con redirección
Causa: en el archivo están indicadas direcciones sin la barra al final o con http en vez de https, y el servidor redirige.
Solución: abre cada enlace y copia la dirección final de la barra del navegador. Reemplázala en el archivo. Los agentes no siempre siguen redirecciones.
7. El encabezado de primer nivel no es el primero en el archivo
Causa: antes de él quedó una línea vacía con espacios, un carácter BOM invisible o un comentario.
Solución: en el editor de código activa la visualización de caracteres invisibles, elimina todo hasta el primer numeral, guarda sin BOM.
8. El archivo describe varios sitios a la vez
Causa: el deseo de ahorrar y enlazar desde un solo archivo a todos los proyectos de la empresa.
Solución: un dominio, un archivo sobre ese dominio. A otros proyectos puedes enlazarlos en una sección aparte, pero el resumen y las secciones principales deben ser sobre el sitio actual.
Posibilidades adicionales: trabajo avanzado con llms.txt
La configuración básica está lista. Esta sección es para quienes quieren sacarle el máximo al archivo: automatizar actualizaciones, monitorear los bots de IA y usar llms.txt como parte de una estrategia de posicionamiento.
Generación automática desde el CMS o el build
Para sitios donde el contenido cambia con frecuencia, actualizar el archivo a mano cansa rápido. Opciones de automatización:
- Plugin de CMS. Para WordPress, Joomla y otros sistemas hay módulos que arman llms.txt a partir de tipos de entrada seleccionados. Configúralos para que incluyan solo las categorías necesarias y para que las descripciones se tomen de un campo especial, y no de las primeras líneas del texto.
- Script en la etapa de build. Para sitios estáticos y frameworks, escribe un pequeño script que lea los metadatos de las páginas, por ejemplo los campos title y llm_description en el encabezado de los archivos Markdown, y arme con ellos el llms.txt. Ejecútalo antes del deploy.
- Versiones Markdown aparte de las páginas. Algunos sitios entregan cada página tanto en HTML como en Markdown en una dirección con el sufijo .md. Entonces en llms.txt puedes enlazar las versiones limpias, y armar llms-full.txt con una simple concatenación. Es el formato más cómodo para los modelos.
Verificar el archivo con herramientas de línea de comandos
Existe un paquete oficial para Python llamado llms-txt. Convierte el archivo en contexto para el modelo y de paso verifica la estructura. Instalación y ejecución:
pip install llms-txt
llms_txt2ctx https://tu-dominio/llms.txtSi el comando mostró texto estructurado con secciones, el archivo se procesó correctamente. Si arrojó un error, mira en qué línea tropezó: por lo general es la sintaxis incorrecta de un enlace.
Monitoreo de bots de IA en los logs
La forma más honesta de saber si leen tu archivo es mirar los logs del servidor web. El procedimiento:
- Encuentra el archivo de logs de acceso. En Nginx normalmente es /var/log/nginx/access.log, en Apache es access.log en la carpeta de logs del sitio. En hosting virtual los logs están disponibles en el panel, en la sección «Estadísticas» o «Logs».
- Filtra las líneas que contengan llms.txt. En la terminal: grep llms.txt access.log.
- Mira el campo User-Agent en las líneas encontradas. Los agentes de compañías de IA normalmente se identifican con nombres reconocibles que contienen el nombre de la compañía o palabras como Bot, Agent, User.
- Arma una tabla simple: fecha, agente, archivo. Una vez al mes compara quién llega y con qué frecuencia. El crecimiento del número de solicitudes es buena señal.
Consejo: Si quieres ver el sitio «con los ojos» del agente que llega desde otro país, usa un proxy móvil de la región necesaria y haz la solicitud a través de él: curl -x dirección-del-proxy https://tu-dominio/llms.txt. Así verificarás que la configuración geográfica del CDN, las redirecciones regionales y la protección antibots no impiden obtener el archivo desde el extranjero. Esto es especialmente relevante para proyectos que operan en varios países.
llms.txt para landings y proyectos de afiliados
Los especialistas en arbitraje y dueños de landings pequeños a menudo piensan que no necesitan el archivo: son pocas páginas. En la práctica, incluso para una one-page el llms.txt es útil: le da al modelo una formulación precisa de la oferta, las condiciones, la geografía y el enlace a las reglas. Cuando el usuario le pregunte al asistente sobre el producto, este tomará los datos de tu archivo y no los inventará. Para una red de landings, haz una plantilla común y sustituye el nombre, el resumen y los enlaces de forma automática.
Vínculo con la optimización generativa
El archivo llms.txt es uno de los elementos de la dirección que en 2026 se conoce como optimización generativa: el trabajo para que la marca aparezca de forma correcta y frecuente en las respuestas de IA. Otros elementos son los datos estructurados en las páginas, respuestas claras a las preguntas al inicio de los artículos, autoría y fecha de actualización, uniformidad de los hechos sobre la empresa en todas las fuentes. El archivo une todo esto en un solo mapa. Actualízalo con cada cambio significativo del producto o de los precios, y los modelos recibirán el panorama actualizado.
Versionado y fecha de vigencia
Agrega en el párrafo de contexto una línea con la fecha de la última actualización, por ejemplo: «La información está vigente a marzo de 2026». Esto ayuda al modelo a evaluar la frescura de los datos. Guarda el archivo en un sistema de control de versiones junto con el código del sitio, para ver el historial de cambios.
FAQ: preguntas frecuentes sobre llms.txt
¿Es obligatorio hacer llms-full.txt?
No. Solo llms.txt es obligatorio. Pero si tienes documentación, instructivos o descripciones detalladas, la versión completa mejora notablemente la calidad de las respuestas de las herramientas que la usan. Para un landing de cinco páginas puedes arreglártelas con un solo archivo.
¿Se puede escribir el archivo en español?
Sí. Usa el idioma del contenido principal del sitio. Si el sitio es bilingüe, indica en el párrafo de contexto dónde está la segunda versión y, si quieres, crea un archivo aparte en el subdominio o en la carpeta de idioma, enlazándolo desde el principal. Los nombres de las secciones también pueden estar en español, excepto la palabra reservada Optional.
¿Con qué frecuencia actualizar llms.txt?
Con cada cambio de precios, lanzamiento de una nueva sección, cambio de condiciones o eliminación de páginas. Si no pasa nada significativo, basta con una revisión trimestral: verificar los enlaces, actualizar las descripciones, renovar la fecha.
¿Hay que indicar llms.txt en el sitemap o registrarlo en algún lugar?
No. Las herramientas buscan el archivo en la ruta estándar en la raíz del dominio, como el favicon. No existe un registro especial. Algunos directorios públicos recopilan sitios con llms.txt; agregarlo ahí no es obligatorio, pero tampoco perjudica.
¿El archivo influirá en las posiciones en la búsqueda tradicional?
No tiene influencia directa: el archivo no se indexa como página ni es un factor de ranking. Indirectamente ayuda: pone orden en la estructura, y las menciones correctas en las respuestas de IA traen tráfico de marca.
¿Qué hacer si el sitio está en un constructor que no permite colocar el archivo en la raíz?
Primero busca la configuración de subida de archivos con ruta arbitraria o las reglas de redirección. Si no hay nada, escribe al soporte del constructor: en 2026, la solicitud de colocar llms.txt ya no es novedad para ellos. La opción extrema es llevar el archivo a un subdominio aparte y enlazarlo desde la página «Sobre la empresa», aunque la ruta estándar es preferible.
¿Vale la pena incluir páginas del blog en el archivo?
Incluye los artículos que responden a las preguntas frecuentes de los clientes y siguen vigentes: instructivos, comparaciones, análisis. Las noticias y los anuncios de promociones mejor no incluirlos o mandarlos a Optional. Para un blog grande, haz una sección aparte con los 10 a 20 materiales más útiles.
¿Se puede usar un solo archivo para varios dominios de la empresa?
No. Cada dominio se describe con su propio archivo. Los enlaces mutuos entre proyectos son admisibles en una sección aparte, pero el resumen y las secciones principales deben referirse al dominio actual.
¿Cómo entender que la IA realmente usa el archivo?
Mira los logs según las instrucciones del bloque avanzado y pregunta periódicamente a los asistentes sobre tu producto. Si las formulaciones en las respuestas coinciden con tu resumen y el asistente nombra las páginas correctas, el archivo funciona. Lleva una tabla de verificaciones una vez al mes para seguir la dinámica.
¿Qué hacer si después de editar la configuración del servidor el sitio dejó de abrir?
Restaura de inmediato la copia guardada del archivo de configuración y verifica que el sitio vuelva a estar disponible. Luego contacta al soporte del hosting para preguntar por la habilitación de los módulos necesarios. El archivo llms.txt mientras tanto seguirá funcionando sin encabezados adicionales: el servidor entrega los .txt como texto normal por defecto.
Conclusión
Hagamos un resumen del trabajo realizado. Hiciste una auditoría del contenido y seleccionaste las páginas que realmente explican tu producto. Creaste el archivo llms.txt con un encabezado claro, un resumen honesto y secciones estructuradas de enlaces. Armaste la versión ampliada llms-full.txt con el texto completo de las páginas clave. Subiste los archivos a la raíz del sitio, configuraste los encabezados del servidor y verificaste el resultado con el comando curl, con un validador y con un asistente de IA real. Ahora los modelos de lenguaje reciben de tu sitio no un caos de páginas HTML, sino un mapa claro con explicaciones.
Qué hacer después
- Pon un recordatorio para revisar el archivo en tres meses. Verifica los enlaces, actualiza los precios y la fecha de vigencia.
- Una vez al mes revisa los logs y anota qué agentes leen llms.txt. Es analítica gratuita del interés de la IA en tu proyecto.
- Hazle a varios asistentes preguntas sobre tu producto y compara las respuestas con los hechos. Las discrepancias son señal de afinar las descripciones en el archivo o en las propias páginas.
Hacia dónde desarrollarse
El archivo llms.txt es el primer paso en el trabajo con la visibilidad en IA. Los siguientes: datos estructurados en las páginas, respuestas claras a las preguntas al inicio de cada artículo, versiones Markdown de los materiales clave, hechos uniformes sobre la empresa en todos los directorios y catálogos. Si trabajas con varias regiones, agrega verificaciones periódicas de disponibilidad del contenido a través de proxies móviles de los países necesarios: los agentes llegan desde direcciones distintas, y el archivo debe estar disponible para cada uno de ellos. Cuanto más transparente y estructurado sea tu contenido, con mayor precisión hablará la IA de ti a los usuarios. Y eso significa que más personas llegarán a ti ya preparadas y con las expectativas correctas.