Guida · verificata ad agosto 2026

llms.txt, senza entusiasmi.

llms.txt è un file di testo in Markdown, posto alla radice di un dominio, che dice a un modello linguistico cos'è il sito e quali pagine contano. È una convenzione proposta, non uno standard ratificato.

La struttura è semplice: un H1 col nome del sito, una citazione in blocco come sommario, poi sezioni di link con una nota di una riga ciascuno. Va su https://esempio.it/llms.txt, servito come text/plain.

La parte che quasi tutte le guide salta: nessun grande fornitore AI ha confermato di usare llms.txt come segnale di recupero o di posizionamento. Il suo effetto non è dimostrato. Non costa niente, per rimuoverlo basta una cancellazione, e serve anche come documentazione leggibile da una persona — quindi pubblicalo come assicurazione economica, e diffida di chi te lo vende come servizio.

Non è lo stesso file

Permesso, indice, e sitemap.

Tre file alla radice che vengono confusi continuamente. Rispondono a domande diverse, e li vuoi tutti e tre.

FileA che domanda rispondeChi lo leggeStato
robots.txtPuoi scaricare questo percorso?Ogni crawler importante, compresi quelli AIStandard di fatto, rispettato
sitemap.xmlQuali pagine esistono e quando sono cambiate?I motori di ricercaStandard, rispettato
llms.txtCos'è questo sito, e cosa leggo prima?Non confermatoConvenzione proposta

Se ne fai uno solo dei tre, fai robots.txt — è quello con un effetto misurabile, perché un crawler che non hai ammesso non può leggere nient'altro. Timbaly genera tutti e tre per ogni sito.

La sintassi

È Markdown, di proposito, così possono leggerlo sia un modello sia una persona. La convenzione chiede quattro cose, in ordine:

  1. Un solo H1 — il nome del sito o del progetto. Obbligatorio.
  2. Una citazione in blocco subito dopo — un sommario breve di cos'è il sito. È la frase che ha più probabilità di essere estratta, quindi scrivila con la stessa cura di una meta description.
  3. Paragrafi facoltativi di contesto in più: a chi serve, cosa è fuori ambito, fatti chiave.
  4. Sezioni H2 con elenchi di link, ognuno nella forma [Titolo](url): nota di una riga.

Una sezione chiamata ## Optional ha un significato speciale: marca i link che un modello può saltare se è a corto di contesto. Tutto il resto è considerato degno di lettura.

Un esempio completo

Questa è la forma di un file vero, per un'ipotetica termoidraulica. Copia la struttura, non i fatti.

# Rossi Termoidraulica > Impresa di idraulica e riscaldamento a Torino, fondata nel 1998. > Riparazione e installazione caldaie, rifacimento bagni, interventi > di urgenza entro 4 ore su Torino e prima cintura. > P. IVA IT01234567890. # Fatti citabili: # - Intervento d'urgenza entro 4 ore, da lunedì a sabato, 7:00-20:00. # - Certificati per caldaie a condensazione e pompe di calore. # - Preventivo scritto gratuito prima di iniziare qualsiasi lavoro. # - Zone servite: Torino, Moncalieri, Collegno, Rivoli, Nichelino. ## Servizi - [Riparazione caldaie](https://esempio.it/riparazione-caldaie): Riparazione in giornata su tutte le marche principali, con il costo di chiamata dichiarato prima. - [Installazione caldaie](https://esempio.it/installazione-caldaie): Caldaie a condensazione e pompe di calore, pratica di detrazione inclusa. - [Idraulico urgente](https://esempio.it/idraulico-urgente): Risposta entro 4 ore, 7:00-20:00, da lunedì a sabato. ## Chi siamo e contatti - [Chi siamo](https://esempio.it/chi-siamo): Impresa familiare dal 1998, quattro tecnici, lavori garantiti 24 mesi. - [Contatti](https://esempio.it/contatti): Telefono, email e zone coperte. ## Optional - [Informativa privacy](https://esempio.it/privacy) - [Informativa cookie](https://esempio.it/cookie)

Due cose fanno la differenza fra un file utile e uno decorativo. Primo, le note portano fatti, non aggettivi — «risposta entro 4 ore, 7:00–20:00» è citabile; «servizio rapido e affidabile» no. Secondo, tutto quello che c'è dentro deve corrispondere alle pagine. Un file che dichiara orari contraddetti dal sito rende meno affidabili entrambi, che è peggio di non avere nessun file.

E llms-full.txt?

Un compagno facoltativo che contiene il testo completo delle pagine principali invece dei link, così un modello può leggere tutto in una richiesta. Utile per i siti di documentazione, dove l'intero corpus è il prodotto. Per il sito di una piccola attività è ridondante: le pagine sono corte e già scansionabili, e mantenere una seconda copia dei contenuti è un buon modo per ritrovarsi con due versioni che si contraddicono.

Cinque errori comuni

  • Servirlo come HTML. Deve essere text/plain. Un file che arriva come pagina web impaginata non è il file.
  • Usare link relativi. Solo URL assoluti. Un modello che legge il file fuori contesto non può risolvere /contatti.
  • Elencare tutte le pagine. Il valore è la selezione. Quaranta link senza note sono una sitemap scritta male.
  • Lasciarlo invecchiare. Un file che descrive servizi che non offri più è una passività attiva. Se non riesci a tenerlo aggiornato, non pubblicarlo.
  • Aspettarsi che sostituisca robots.txt. Non concede niente e non blocca niente. Se robots.txt vieta GPTBot, nessun llms.txt cambierà quella cosa.

Timbaly genera e mantiene questo file per ogni sito, insieme a robots.txt coi crawler AI nominati esplicitamente e a una sitemap che resta al passo con quello che è pubblicato. Il resto del livello tecnico è qui, e il ragionamento GEO più ampio è qui.

Domande

Sul file.

Cos'è llms.txt?

Un file Markdown alla radice di un dominio che dice a un modello linguistico cos'è il sito e quali pagine contano: un H1 col nome, una citazione in blocco come sommario, poi sezioni di link con note di una riga. Una convenzione proposta, non uno standard ratificato.

È la stessa cosa di robots.txt?

No. robots.txt governa l'accesso ed è rispettato da ogni crawler importante. llms.txt riguarda la comprensione, per un modello già ammesso. Uno è un permesso, l'altro un indice.

Funziona davvero?

Non è dimostrato. Nessun grande fornitore ha confermato di leggerlo come segnale di recupero o posizionamento. È gratis, reversibile e utile come documentazione — pubblicalo, ma non costruirci una strategia sopra, e non pagare un canone a nessuno per farlo.

Dove va messo esattamente?

https://tuodominio.it/llms.txt, servito come text/plain. Non in una sottocartella, non dietro un redirect.

Timbaly lo scrive per me?

Sì, per ogni sito, e lo tiene al passo con quello che viene pubblicato — insieme a robots.txt, sitemap.xml e la chiave IndexNow. Puoi anche modificarlo direttamente, anche da Claude o ChatGPT tramite il connettore MCP.

Oppure lo scrive il sito.

Timbaly genera llms.txt, robots.txt e la sitemap per ogni sito che costruisce, e li tiene aggiornati mentre le pagine cambiano.

English Italiano