Posicionamientu web axéntica · Guía
Qué ye'l llms.txt
25 de agosto de 2026
El posicionamiento web entra nuna etapa nueva col auxe de los LLMs xenerativos, tres décades d'un SEO yá mui especializáu. El llms.txt ye un exemplu direutu d'esa etapa: una propuesta de 2024 pa declarar qué conteníu d'un sitiu val la pena lleer y citar un LLM. Esti artículu esplica'l so orixe, cómo se diferencia del robots.txt, qué diz l'adopción real fasta agora y cómo lu implementa esti mesmu sitiu.
Una nueva etapa nel posicionamiento web
El SEO (Search Engine Optimization) lleva más de dos décades afinándose: dende los años 90, buscadores como Google fueron publicando —y los profesionales del sector, descifrando— señales cada vez más precises pa determinar qué páxina merez apaecer primero nuna llista de resultaos. Enllaces entrantes, velocidá de carga, datos estructuraos, esperiencia d’usuariu… el terrén yá ta mui camináu, con reglas razonablemente estables y ferramientes maduros pa midiles.
Col auxe de los LLMs xenerativos —sistemes que nun devuelven una llista d’enllaces, sinón una rempuesta sintetizada, citando o non les fontes que la sofiten— esi terrén tan camináu volvió abrise. Nun ye que’l SEO dexe de valir: sigue siendo la base de la indexación y de la visibilidá en buscadores clásicos. Ye que apaeció un espaciu nuevu, onde entá nun hai reglas asentaes nin ferramientes maduros equivalentes —el GEO— y onde tolos actores, dende los sitios web fasta los propios proveedores de LLMs, tán entá probando qué señales importen de verdá.
El llms.txt ye un exemplu direutu d’esa etapa inicial: una propuesta concreta, non un estándar consolidáu, que trata de resolver un problema real —cómo facer qu’un sitiu web declare qué conteníu val la pena lleer— ensin que entá se sepa con certeza si los proveedores grandes lu van adoptar de mou xeneralizáu. Esti artículu esplica qué ye, d’ónde vien, y qué diz l’adopción real fasta agora.
Qué ye’l llms.txt
llms.txt ye un ficheru de testu en formatu
markdown que se publica na
raíz d’un sitiu web (/llms.txt) pa declarar esplícitamente qué conteníu
ta pensáu pa ser lleíu, fragmentáu y citáu por sistemes xenerativos
basaos en modelos de llingua —GPTBot (OpenAI), ClaudeBot (Anthropic),
PerplexityBot y otros crawlers d’IA. Nun tien un organismu de
estandarización formal únicu: ye una convención propuesta, adoptada
de mou creciente por sitios que prautiquen GEO.
La definición curtia val como respuesta autocontenida: el llms.txt ye’l ficheru que declara, na raíz d’un sitiu, qué conteníu val la pena que llea y cite un LLM, ensin que l’axente tenga que rastrexar y deducilo per so cuenta.
D’ónde vien la propuesta
El llms.txt nun ye un estándar impuestu por un consorciu web nin por un
proveedor de LLMs: propúnxolu Jeremy Howard, cofundador d’Answer.AI y
de fast.ai, en setiembre de 2024, publicáu en llmstxt.org. La
motivación de partida yera concreta: les ventanes de contestu de los
LLMs son pequeñes en comparanza col volume total d’un sitiu web, y les
páxines HTML —con navegación, publicidá y JavaScript— son costoses de
procesar pa una máquina que solo necesita’l conteníu real. El formatu
propuestu ye deliberadamente mínimu: un títulu H1, un párrafu resume en
cita, seiciones H2 con enllaces a recursos, y una seición opcional pa
conteníu secundariu.
Analoxía y diferencia con robots.txt
El nome y la ubicación (na raíz del dominiu) evoquen deliberadamente al
clásicu robots.txt, pero la función ye distinta:
robots.txtdeclara permisos de rastrexu: qué rutes pue o nun pue visitar un crawler determináu. Ye una llista de reglas d’accesu.llms.txtdeclara legibilidá y citabilidá: qué conteníu esiste, qué val la pena lleer y cómo ta organizáu pa ser resumíu o citáu con precisión. Nun ye una llista de reglas d’accesu, ye un índiz orientáu a máquines.
Dambos ficheros pueden convivir nun mesmu sitiu ensin conflictu: robots.txt
sigue controlando qué pue rastrexase, y llms.txt amuesa, dientro de lo
permitío, qué ye lo más relevante pa citar.
La estensión llms-full.txt
Xunto al llms.txt básicu (un índiz curtiu con enllaces y resúmenes)
estendióse una segunda convención, llms-full.txt, que inclúi’l conteníu
completu del sitiu embebíu direutamente en formatu markdown. La diferencia
práutica ye’l costu de consulta pal axente: col llms.txt sólo, un LLM
tien que faer una petición HTTP adicional por cada páxina que quiera lleer
enteres; col llms-full.txt, tolo conteníu llega nuna única respuesta,
ensin round-trips adicionales.
Cuánto s’adoptó de verdá
L’adopción real del llms.txt medióse en delles ocasiones dende que se propunxo. A mediaos de 2025 yá había miles de sitios web con un llms.txt espublizáu, ente ellos empreses téuniques conocíes como Anthropic, Stripe, Cloudflare y Vercel; los sectores con más adopción son los que dependen más de la precisión téunica —intelixencia artificial, ferramientes pa desendolcadores, SaaS. Esiste dafechu direutorios comunitarios que catalogan sitios con llms.txt implementáu.
Pero l’adopción del formatu nun ye lo mesmo que la so llectura real por parte de los proveedores de LLMs. En xunu de 2025, John Mueller (Google) declaró públicamente que nengún sistema d’IA usa’l llms.txt de mou confirmáu, y que los rexistros de servidor amuesen que los crawlers d’IA nun lu faen peticiones con volume significativu. Nengún de los grandes proveedores —OpenAI, Google, Anthropic— espublizó documentación que confirme que lu consulten en tiempu d’inferencia. Esto nun invalida la práutica —un ficheru declarativu barato, ensin coste real de mantenimientu automatizáu, sigue siendo razonable— pero sí matiza cualquier promesa de que esponer un llms.txt vaya, per sí mesmu, meyorar la citabilidá d’un sitiu de mou mensurable a curtiu plazu.
Casu real: implementación en Xiringase-web
Esti mesmu sitiu implementa dambos ficheros en producción, xeneraos automáticamente a partir del conteníu real del sitiu (nun se mantienen a mano):
/llms.txtxenera un llistáu resumíu: los proyeutos propios de Xiringase, los artículos del blog (con enllaz y resume curtiu) y les páxines indexables (manifiestu, sofitu)./llms-full.txtembebe’l conteníu completu en markdown: el cuerpu enteru de cada artículu del blog, los reportaxes de los proyeutos y les seiciones editoriales de la home, tolo nun únicu ficheru de testu planu.
Dambos se sirven namás en asturianu (la llingua-canon del sitiu); les
traducciones a español, inglés y francés viven baxo /es, /en y /fr
respeutivamente, ensin duplicase nel llms.txt.
Relación col GEO
El llms.txt ye una de les práutiques concretes que definen el
GEO: ye lliteralmente ún de los “feeds pensaos pa
máquines” que se cita como pilar práuticu nesa disciplina —ficheros que
faciliten a un axente automáticu saber qué conteníu esiste nun sitiu y
ónde s’atopa, ensin tener que rastrexar toa la web pa deducilo.
Importa marcar el llímite: el llms.txt nun ye la fonte de la
citabilidá d’un sitiu, ye namás una capa d’índiz enriba d’ella. Un sitiu
que tenga conteníu bien estructuráu —atómicu, con datos estructuraos,
factualmente verificable— sigue siendo citable magar nun espón un
llms.txt. Y al aviesu, esponer un llms.txt ensin conteníu de calidá
debaxo nun meyora la citabilidá real: namás facilita’l descubrimientu
d’un conteníu que, per sí mesmu, tien o nun tien valor pa ser citáu.
Fontes
- Howard, J. The /llms.txt file. Answer.AI, setiembre 2024. https://llmstxt.org
- Sherman, C. Meet llms.txt, a proposed standard for AI website content crawling. Search Engine Land, setiembre 2024. https://searchengineland.com/llms-txt-proposed-standard-453676
- Implementación real d’esti sitiu: https://xiringase.com/llms.txt y https://xiringase.com/llms-full.txt.