Vai al contenuto
GET-GEO.AI
/
Tutte le guide

// guida

Che cos'è llms.txt — e il vostro sito ne ha bisogno?

Aggiornato: 2026-08-19

// risposta breve

llms.txt è uno standard proposto: una mappa in markdown delle pagine chiave del sito, pensata per i sistemi di IA e servita su /llms.txt. «Proposto» è la parola che conta: nessun grande vendor di IA si è impegnato a leggerlo, e le misurazioni mostrano che il 97% dei file pubblicati riceve zero richieste in un mese. Pubblicatelo se la vostra architettura lo genera gratis; per ora non aspettatevi nulla da lui.

Che cos'è llms.txt

La proposta è di Jeremy Howard di Answer.AI, pubblicata il 3 settembre 2024 su llmstxt.org. L'idea: le pagine HTML sono pesanti e affollate per i modelli linguistici, quindi un sito dovrebbe offrire una mappa markdown curata su /llms.txt — un solo H1 con il nome del sito, una citazione a blocco che riassume «le informazioni essenziali per capire il resto del file», poi sezioni di link, ciascuno un collegamento markdown con una nota facoltativa di una riga. Una sezione «Optional» segnala i link che un agente può saltare quando serve un contesto più corto. La specifica raccomanda anche gemelli markdown puliti delle vostre pagine, allo stesso URL con .md in coda.

Due cose che llms.txt non è. Non controlla l'accesso: non concede e non nega nulla; quello è il lavoro di robots.txt, e abbiamo mappato gli interruttori di ogni crawler IA nella nostra guida a robots.txt. E llms-full.txt — il file unico che porta l'intero testo del sito — non è affatto nella specifica: è una convenzione dell'ecosistema, diffusasi a novembre 2024, quando Mintlify ha iniziato a generare automaticamente entrambi i file per ogni sito di documentazione che ospita.

Qualcuno legge davvero llms.txt?

È la domanda che la maggior parte delle guide gira alla larga — i crawler IA usano davvero llms.txt? — e la risposta misurata è senza giri di parole: quasi nessuno.

Nessun vendor di IA si è impegnato a consumarlo. Non OpenAI, non Anthropic, non Google, non Perplexity: nessuna documentazione ufficiale di nessuno di loro dice che i propri sistemi scaricano o interpretano llms.txt. Google è apertamente sbrigativa: John Mueller ha scritto ad aprile 2025 che «per quanto ne so nessun servizio di IA ha dichiarato di usare LLMs.TXT (e dai log del server si vede che non lo cercano nemmeno). Per me è paragonabile al meta tag keywords», e Gary Illyes ha confermato a luglio 2025 che Google non lo supporta e non intende farlo.

I log del server dicono la stessa cosa. Ahrefs ha controllato 137.000 domini a giugno 2026: il 97% dei file llms.txt pubblicati non ha ricevuto alcuna richiesta nel mese precedente, e anche per il 3% che ha avuto traffico solo l'1% circa arrivava da bot di recupero IA. Evil Martians ha passato al setaccio due mesi di log del proprio sito: su circa 770 recuperi del file, 37 venivano da agenti IA identificati. Otterly ha osservato 62.100 visite di bot IA in 90 giorni — 84 hanno toccato /llms.txt, un terzo di quanto riceve una pagina di contenuto media. E SE Ranking ha testato 300.000 domini in cerca di una relazione tra avere il file ed essere citati nelle risposte delle IA: nessuna.

Intanto l'adozione continua a salire — da circa 4.100 file pubblicati a giugno 2025 a 36.100 un anno dopo, quasi un aumento di nove volte per file che quasi nulla legge. L'elenco di chi lo pubblica è impressionante e ironico in egual misura: Anthropic, Cloudflare, Zapier, Stripe e Vercel ne servono uno — soprattutto sui domini di documentazione — e Perplexity pubblica il proprio llms.txt senza aver mai dichiarato di leggere quello degli altri.

Negli stessi log si nasconde un segnale autentico, che punta a un'altra parte della proposta: Evil Martians ha rilevato che Claude Code chiede markdown tramite content negotiation nel 76% dei suoi recuperi. Le macchine preferiscono davvero il markdown pulito all'HTML: quello che ignorano è il file indice, non l'idea.

llms.txt ad agosto 2026 — affermazione per affermazione
AffermazioneStatoProve
I vendor di IA leggono llms.txtNo — nessun impegnoNessuna documentazione dei vendor lo sostiene; Google rifiuta esplicitamente (Mueller, Illyes)
I bot IA scaricano il file in praticaAppena misurabile97% dei file: zero richieste (Ahrefs, 137.000 domini); 37 recuperi da agenti identificati in 2 mesi (Evil Martians)
Averlo migliora le citazioni IANessun effetto rilevatoSE Ranking, 300.000 domini: nessuna relazione con la frequenza di citazione
Gli editori lo adottano comunqueSì — in fretta4.100 → 36.100 file in un anno (Ahrefs); tra loro Anthropic, Stripe, Cloudflare, Zapier
Le macchine preferiscono il markdown all'HTMLSì — misuratoClaude Code chiede markdown nel 76% dei recuperi (Evil Martians)
llms.txt ad agosto 2026 — affermazione per affermazione

Perché ne teniamo uno comunque

Il nostro sito serve /llms.txt e file llms-full per lingua, e non rivendichiamo alcun effetto: non abbiamo prove che un assistente abbia trovato i nostri contenuti tramite la mappa invece che tramite scansione e indici di ricerca, e diamo per scontato che il nostro file non vada meglio della media misurata. Allora perché tenerlo?

Perché nella nostra architettura non costa nulla e non può invecchiare male. Il file è generato dallo stesso registro dei contenuti che costruisce le pagine, la sitemap e l'hub delle guide: quando una guida esce o cambia, llms.txt si aggiorna nello stesso commit. Una mappa che si mantiene da sé è un'opzione gratuita su un futuro in cui qualche agente la legga davvero; una mappa da mantenere a mano è una passività che finirà per scollarsi dal sito senza far rumore.

Tenerne uno in produzione fa emergere anche i vincoli tecnici reali che gli articoli d'opinione saltano. Il nostro export llms-full ha superato due volte il proprio limite di dimensione da quando è arrivata la lingua hindi — il devanagari occupa circa tre byte per carattere in UTF-8 e, anche con i testi hindi più corti, le stesse guide pesano circa il doppio rispetto all'inglese — così il limite ora è a 300 kilobyte, il triplo di quello originale. Se il vostro llms-full.txt è più grande del budget di contesto di un modello, avete ricreato esattamente il problema che il file doveva risolvere.

Questa è la forma onesta della decisione: lo pubblichiamo come scommessa a costo zero e lo descriviamo esattamente così — parte dello strato tecnico documentato nella nostra guida su come facciamo GEO sul nostro sito, non una leva di posizionamento. Ciò che ha un effetto misurabile sulle citazioni è trattato lì: accesso dei crawler, pagine estraibili, lavoro sull'entità.

Come costruirne uno che non vi faccia sfigurare

Se llms.txt è gratis nel vostro stack — un plugin, un hook del generatore statico, un template del CMS — ecco il formato llms.txt, direttamente dalla specifica.

Un esempio minimo di llms.txt: un solo H1 con il nome del sito, poi una citazione a blocco che riassume che cos'è il sito in due o tre frasi che un agente potrebbe citare. Sezioni H2 — pagine, guide, documentazione — ciascuna con un elenco di link markdown e una nota di una riga per link. Una sezione «Optional» per quello che un agente può saltare. Lo standard è tutto qui.

I tre errori che rendono il file peggiore della sua assenza:

  • Pubblicarlo dietro un Disallow generalizzato. Se robots.txt blocca il bot, la mappa non la vedrà mai. Prima l'accesso, poi la navigazione: controllate gli interruttori dei crawler prima di disegnare mappe.
  • Riversarci dentro tutti gli URL che avete. L'unico valore teorico del file è la selezione: cento link indistinguibili sono una sitemap, e sitemap.xml esiste già. Dieci pagine chiave con note oneste di una riga battono tutto il resto.
  • Lasciarlo scollare dal sito. Un llms.txt scritto a mano che descrive pagine riscritte da allora è esattamente il meta tag keywords a cui Mueller lo paragonava: un'autodescrizione che nessuno verifica. Generatelo dalla stessa fonte delle pagine, oppure non tenetelo.

Domande correlate

Qual è la differenza tra llms.txt e robots.txt?

Compiti del tutto diversi. Robots.txt controlla l'accesso — quali crawler possono scaricare quali percorsi — e ogni grande vendor di IA documenta di rispettarlo (con le eccezioni dei fetcher avviati dall'utente, trattate nella guida a robots.txt). llms.txt non controlla nulla: è una lista di letture suggerite che un bot conforme può consultare e che, secondo le misurazioni attuali, praticamente nessuno consulta. Sistemate prima l'accesso; la mappa è un contorno facoltativo.

Oggi llms.txt aiuta la SEO o la visibilità nelle IA?

Nessun effetto misurabile: SE Ranking ha testato 300.000 domini senza trovare relazione tra avere il file ed essere citati nelle risposte delle IA, e Google dichiara di non usarlo affatto. Ciò che muove le citazioni è quanto tratta il resto di questa serie — accesso dei crawler, pagine estraibili con la risposta in apertura, conferme esterne — e la nostra guida sulla misurazione della visibilità nelle IA mostra come verificarlo sui vostri numeri. Trattate llms.txt come un esperimento, mai come il piano.

Come si crea un file llms.txt?

Risposta breve: non scrivetelo a mano. Se la vostra piattaforma lo genera dai contenuti — gli host di documentazione lo fanno da soli e per la maggior parte di framework e CMS esistono plugin — attivate quella funzione e ottenete un file che resta allineato a costo zero. Scriverlo a mano è accettabile per un sito di dieci pagine: a quella scala il costo di manutenzione è trascurabile; oltre, collegatelo alla stessa fonte che costruisce le pagine.

Conviene pubblicare anche llms-full.txt?

Solo se è generato. Non fa parte della specifica: è una convenzione per consegnare tutti i contenuti in un unico file markdown, utile soprattutto per incollare a mano la documentazione di un sito nel contesto di uno strumento di IA. Attenzione alla dimensione: oltre qualche centinaio di kilobyte state sfondando proprio le finestre di contesto che il file dovrebbe servire. Il nostro è limitato e diviso per lingua esattamente per questo.

I vendor di IA adotteranno llms.txt prima o poi?

Non si sa, e la tendenza si legge in due modi: in un anno l'adozione da parte degli editori è cresciuta di quasi nove volte, mentre l'impegno dei vendor è rimasto a zero e Google ha detto no in modo esplicito. La parte della proposta con trazione misurata è il markdown stesso: gli agenti chiedono già le versioni .md delle pagine quando ci sono. Se della specifica sopravvive qualcosa, noi scommettiamo su pagine pulite e leggibili dalle macchine, non sul file indice.

Guide correlate

Fonti

  1. 01La nostra guida: Come configurare robots.txt per i crawler IA?
  2. 02La nostra guida: Come si fa GEO sul proprio sito in pratica?
  3. 03La nostra guida: Come si misurano visibilità e citazioni nelle IA?
  4. 04llmstxt.org — la proposta llms.txt (Jeremy Howard, settembre 2024)
  5. 05Search Engine Journal — Mueller di Google: llms.txt paragonabile al meta tag keywords (aprile 2025)
  6. 06Ahrefs — studio su llms.txt: il 97% dei file senza richieste (137.000 domini, giugno 2026)
  7. 07Evil Martians — due mesi di traffico LLM, misurati (luglio 2026)
  8. 08SE Ranking — llms.txt non mostra effetti sulle citazioni IA (300.000 domini, novembre 2025)
  9. 09Otterly — l'esperimento llms.txt: 90 giorni di log dei bot IA (febbraio 2026)
  10. 10Mintlify — generazione automatica di llms.txt per la documentazione ospitata (novembre 2024)
  11. 11Ahrefs — che cos'è llms.txt e vi serve davvero? (aggiornato a giugno 2026)

// condividi

LinkedInXReddit