Cos'è, in concreto
È un file di testo semplice, raggiungibile a un indirizzo fisso del sito, che elenca le sezioni e le pagine più importanti con una riga di descrizione ciascuna. L'idea è offrire a un modello un indice curato invece di costringerlo a ricostruire la struttura del sito da solo.
- Un titolo con il nome dell'azienda e una riga su cosa fa.
- Sezioni raggruppate per tipo: servizi, guide, prezzi, contatti.
- Per ogni voce, l'indirizzo completo e una descrizione breve e onesta.
- Eventualmente una sezione con ciò che è secondario, marcata come tale.
Serve davvero?
| Intervento | Impatto sulla visibilità nelle AI | Costo |
|---|---|---|
| Servire HTML completo senza JavaScript | Decisivo: senza, il sito è invisibile | Medio, dipende da come è fatto il sito |
| Rispondere alle domande in modo diretto e citabile | Molto alto | Alto: è lavoro di contenuto |
| Dati strutturati corretti | Alto | Basso |
| Date di pubblicazione e aggiornamento reali | Medio | Molto basso |
| Mappa del sito e struttura chiara | Medio | Basso |
| File llms.txt | Incerto oggi, potenzialmente utile domani | Molto basso |
L'ordine è quello che conta: dedicare attenzione a llms.txt mentre il sito non serve HTML completo significa curare l'indice di un libro con le pagine bianche.
Detto questo, scriverlo richiede meno di un'ora e non ha controindicazioni. La posizione ragionevole è: fatelo, ma dopo le altre cose, e senza aspettarvi che sia quello a cambiare i risultati.
Chi può leggere il vostro sito
| Tipo di crawler | Cosa fa | Conviene bloccarlo? |
|---|---|---|
| Crawler di ricerca degli assistenti | Recupera pagine per rispondere a una domanda dell'utente, con citazione | No: è il canale da cui arriva visibilità |
| Crawler di raccolta per l'addestramento | Raccoglie testo per addestrare modelli, senza citare | Scelta aziendale legittima in entrambe le direzioni |
| Crawler dei motori di ricerca tradizionali | Indicizzazione classica | No, mai |
| Raccoglitori non dichiarati | Copiano contenuti | Il blocco dichiarato non li ferma comunque |
La distinzione tra le prime due righe è quella che conta: bloccare tutto indistintamente esclude anche il canale che porta traffico e citazioni. È una decisione da prendere consapevolmente, non copiando un elenco trovato online.
Cosa fare, in ordine
- 01
Verificare che il sito sia leggibile senza JavaScript
È il controllo che determina tutto il resto: se il contenuto compare solo dopo l'esecuzione degli script, per i crawler AI la pagina è vuota.
- 02
Decidere quali crawler ammettere
Una decisione aziendale, presa una volta e scritta nel file dei permessi in modo esplicito, distinguendo ricerca e addestramento.
- 03
Sistemare dati strutturati e date
Costo basso, effetto concreto su come i contenuti vengono attribuiti e citati.
- 04
Scrivere llms.txt
Mezz'ora, con selezione onesta delle pagine che contano. Poi aggiornarlo quando cambia qualcosa di rilevante, non a ogni pubblicazione.