Guida · verificata ad agosto 2026
llms.txt è un file di testo in Markdown, posto alla radice di un dominio, che dice a un modello linguistico cos'è il sito e quali pagine contano. È una convenzione proposta, non uno standard ratificato.
La struttura è semplice: un H1 col nome del sito, una citazione in blocco come sommario, poi sezioni di link con una nota di una riga ciascuno. Va su https://esempio.it/llms.txt, servito come text/plain.
Non è lo stesso file
Tre file alla radice che vengono confusi continuamente. Rispondono a domande diverse, e li vuoi tutti e tre.
| File | A che domanda risponde | Chi lo legge | Stato |
|---|---|---|---|
robots.txt | Puoi scaricare questo percorso? | Ogni crawler importante, compresi quelli AI | Standard di fatto, rispettato |
sitemap.xml | Quali pagine esistono e quando sono cambiate? | I motori di ricerca | Standard, rispettato |
llms.txt | Cos'è questo sito, e cosa leggo prima? | Non confermato | Convenzione proposta |
Se ne fai uno solo dei tre, fai robots.txt — è quello con un effetto misurabile, perché un crawler che non hai ammesso non può leggere nient'altro. Timbaly genera tutti e tre per ogni sito.
In questa pagina
È Markdown, di proposito, così possono leggerlo sia un modello sia una persona. La convenzione chiede quattro cose, in ordine:
[Titolo](url): nota di una riga.Una sezione chiamata ## Optional ha un significato speciale: marca i link che un modello può saltare se è a corto di contesto. Tutto il resto è considerato degno di lettura.
Questa è la forma di un file vero, per un'ipotetica termoidraulica. Copia la struttura, non i fatti.
Due cose fanno la differenza fra un file utile e uno decorativo. Primo, le note portano fatti, non aggettivi — «risposta entro 4 ore, 7:00–20:00» è citabile; «servizio rapido e affidabile» no. Secondo, tutto quello che c'è dentro deve corrispondere alle pagine. Un file che dichiara orari contraddetti dal sito rende meno affidabili entrambi, che è peggio di non avere nessun file.
Un compagno facoltativo che contiene il testo completo delle pagine principali invece dei link, così un modello può leggere tutto in una richiesta. Utile per i siti di documentazione, dove l'intero corpus è il prodotto. Per il sito di una piccola attività è ridondante: le pagine sono corte e già scansionabili, e mantenere una seconda copia dei contenuti è un buon modo per ritrovarsi con due versioni che si contraddicono.
text/plain. Un file che arriva come pagina web impaginata non è il file./contatti.robots.txt vieta GPTBot, nessun llms.txt cambierà quella cosa.Timbaly genera e mantiene questo file per ogni sito, insieme a robots.txt coi crawler AI nominati esplicitamente e a una sitemap che resta al passo con quello che è pubblicato. Il resto del livello tecnico è qui, e il ragionamento GEO più ampio è qui.
Domande
Un file Markdown alla radice di un dominio che dice a un modello linguistico cos'è il sito e quali pagine contano: un H1 col nome, una citazione in blocco come sommario, poi sezioni di link con note di una riga. Una convenzione proposta, non uno standard ratificato.
No. robots.txt governa l'accesso ed è rispettato da ogni crawler importante. llms.txt riguarda la comprensione, per un modello già ammesso. Uno è un permesso, l'altro un indice.
Non è dimostrato. Nessun grande fornitore ha confermato di leggerlo come segnale di recupero o posizionamento. È gratis, reversibile e utile come documentazione — pubblicalo, ma non costruirci una strategia sopra, e non pagare un canone a nessuno per farlo.
https://tuodominio.it/llms.txt, servito come text/plain. Non in una sottocartella, non dietro un redirect.
Sì, per ogni sito, e lo tiene al passo con quello che viene pubblicato — insieme a robots.txt, sitemap.xml e la chiave IndexNow. Puoi anche modificarlo direttamente, anche da Claude o ChatGPT tramite il connettore MCP.
Timbaly genera llms.txt, robots.txt e la sitemap per ogni sito che costruisce, e li tiene aggiornati mentre le pagine cambiano.