Qué ye'l llms.txt

Posicionamientu web axéntica · Guía

Qué ye'l llms.txt

25 de agosto de 2026

El posicionamiento web entra nuna etapa nueva col auxe de los LLMs xenerativos, tres décades d'un SEO yá mui especializáu. El llms.txt ye un exemplu direutu d'esa etapa: una propuesta de 2024 pa declarar qué conteníu d'un sitiu val la pena lleer y citar un LLM. Esti artículu esplica'l so orixe, cómo se diferencia del robots.txt, qué diz l'adopción real fasta agora y cómo lu implementa esti mesmu sitiu.

Una nueva etapa nel posicionamiento web

El SEO (Search Engine Optimization) lleva más de dos décades afinándose: dende los años 90, buscadores como Google fueron publicando —y los profesionales del sector, descifrando— señales cada vez más precises pa determinar qué páxina merez apaecer primero nuna llista de resultaos. Enllaces entrantes, velocidá de carga, datos estructuraos, esperiencia d’usuariu… el terrén yá ta mui camináu, con reglas razonablemente estables y ferramientes maduros pa midiles.

Col auxe de los LLMs xenerativos —sistemes que nun devuelven una llista d’enllaces, sinón una rempuesta sintetizada, citando o non les fontes que la sofiten— esi terrén tan camináu volvió abrise. Nun ye que’l SEO dexe de valir: sigue siendo la base de la indexación y de la visibilidá en buscadores clásicos. Ye que apaeció un espaciu nuevu, onde entá nun hai reglas asentaes nin ferramientes maduros equivalentes —el GEO— y onde tolos actores, dende los sitios web fasta los propios proveedores de LLMs, tán entá probando qué señales importen de verdá.

El llms.txt ye un exemplu direutu d’esa etapa inicial: una propuesta concreta, non un estándar consolidáu, que trata de resolver un problema real —cómo facer qu’un sitiu web declare qué conteníu val la pena lleer— ensin que entá se sepa con certeza si los proveedores grandes lu van adoptar de mou xeneralizáu. Esti artículu esplica qué ye, d’ónde vien, y qué diz l’adopción real fasta agora.

Qué ye’l llms.txt

llms.txt ye un ficheru de testu en formatu markdown que se publica na raíz d’un sitiu web (/llms.txt) pa declarar esplícitamente qué conteníu ta pensáu pa ser lleíu, fragmentáu y citáu por sistemes xenerativos basaos en modelos de llingua —GPTBot (OpenAI), ClaudeBot (Anthropic), PerplexityBot y otros crawlers d’IA. Nun tien un organismu de estandarización formal únicu: ye una convención propuesta, adoptada de mou creciente por sitios que prautiquen GEO.

La definición curtia val como respuesta autocontenida: el llms.txt ye’l ficheru que declara, na raíz d’un sitiu, qué conteníu val la pena que llea y cite un LLM, ensin que l’axente tenga que rastrexar y deducilo per so cuenta.

D’ónde vien la propuesta

El llms.txt nun ye un estándar impuestu por un consorciu web nin por un proveedor de LLMs: propúnxolu Jeremy Howard, cofundador d’Answer.AI y de fast.ai, en setiembre de 2024, publicáu en llmstxt.org. La motivación de partida yera concreta: les ventanes de contestu de los LLMs son pequeñes en comparanza col volume total d’un sitiu web, y les páxines HTML —con navegación, publicidá y JavaScript— son costoses de procesar pa una máquina que solo necesita’l conteníu real. El formatu propuestu ye deliberadamente mínimu: un títulu H1, un párrafu resume en cita, seiciones H2 con enllaces a recursos, y una seición opcional pa conteníu secundariu.

Analoxía y diferencia con robots.txt

El nome y la ubicación (na raíz del dominiu) evoquen deliberadamente al clásicu robots.txt, pero la función ye distinta:

  • robots.txt declara permisos de rastrexu: qué rutes pue o nun pue visitar un crawler determináu. Ye una llista de reglas d’accesu.
  • llms.txt declara legibilidá y citabilidá: qué conteníu esiste, qué val la pena lleer y cómo ta organizáu pa ser resumíu o citáu con precisión. Nun ye una llista de reglas d’accesu, ye un índiz orientáu a máquines.

Dambos ficheros pueden convivir nun mesmu sitiu ensin conflictu: robots.txt sigue controlando qué pue rastrexase, y llms.txt amuesa, dientro de lo permitío, qué ye lo más relevante pa citar.

La estensión llms-full.txt

Xunto al llms.txt básicu (un índiz curtiu con enllaces y resúmenes) estendióse una segunda convención, llms-full.txt, que inclúi’l conteníu completu del sitiu embebíu direutamente en formatu markdown. La diferencia práutica ye’l costu de consulta pal axente: col llms.txt sólo, un LLM tien que faer una petición HTTP adicional por cada páxina que quiera lleer enteres; col llms-full.txt, tolo conteníu llega nuna única respuesta, ensin round-trips adicionales.

Cuánto s’adoptó de verdá

L’adopción real del llms.txt medióse en delles ocasiones dende que se propunxo. A mediaos de 2025 yá había miles de sitios web con un llms.txt espublizáu, ente ellos empreses téuniques conocíes como Anthropic, Stripe, Cloudflare y Vercel; los sectores con más adopción son los que dependen más de la precisión téunica —intelixencia artificial, ferramientes pa desendolcadores, SaaS. Esiste dafechu direutorios comunitarios que catalogan sitios con llms.txt implementáu.

Pero l’adopción del formatu nun ye lo mesmo que la so llectura real por parte de los proveedores de LLMs. En xunu de 2025, John Mueller (Google) declaró públicamente que nengún sistema d’IA usa’l llms.txt de mou confirmáu, y que los rexistros de servidor amuesen que los crawlers d’IA nun lu faen peticiones con volume significativu. Nengún de los grandes proveedores —OpenAI, Google, Anthropic— espublizó documentación que confirme que lu consulten en tiempu d’inferencia. Esto nun invalida la práutica —un ficheru declarativu barato, ensin coste real de mantenimientu automatizáu, sigue siendo razonable— pero sí matiza cualquier promesa de que esponer un llms.txt vaya, per sí mesmu, meyorar la citabilidá d’un sitiu de mou mensurable a curtiu plazu.

Casu real: implementación en Xiringase-web

Esti mesmu sitiu implementa dambos ficheros en producción, xeneraos automáticamente a partir del conteníu real del sitiu (nun se mantienen a mano):

  • /llms.txt xenera un llistáu resumíu: los proyeutos propios de Xiringase, los artículos del blog (con enllaz y resume curtiu) y les páxines indexables (manifiestu, sofitu).
  • /llms-full.txt embebe’l conteníu completu en markdown: el cuerpu enteru de cada artículu del blog, los reportaxes de los proyeutos y les seiciones editoriales de la home, tolo nun únicu ficheru de testu planu.

Dambos se sirven namás en asturianu (la llingua-canon del sitiu); les traducciones a español, inglés y francés viven baxo /es, /en y /fr respeutivamente, ensin duplicase nel llms.txt.

Relación col GEO

El llms.txt ye una de les práutiques concretes que definen el GEO: ye lliteralmente ún de los “feeds pensaos pa máquines” que se cita como pilar práuticu nesa disciplina —ficheros que faciliten a un axente automáticu saber qué conteníu esiste nun sitiu y ónde s’atopa, ensin tener que rastrexar toa la web pa deducilo.

Importa marcar el llímite: el llms.txt nun ye la fonte de la citabilidá d’un sitiu, ye namás una capa d’índiz enriba d’ella. Un sitiu que tenga conteníu bien estructuráu —atómicu, con datos estructuraos, factualmente verificable— sigue siendo citable magar nun espón un llms.txt. Y al aviesu, esponer un llms.txt ensin conteníu de calidá debaxo nun meyora la citabilidá real: namás facilita’l descubrimientu d’un conteníu que, per sí mesmu, tien o nun tien valor pa ser citáu.

Fontes