Uptonica

Blog · Tecnico

Il tuo negozio è leggibile da un motore AI? Tre controlli

Prima di chiedersi se i motori AI citano i tuoi prodotti conviene sapere se possono leggerli. Tre controlli in venti minuti: robots.txt, llms.txt e dati strutturati. Sul nostro stesso sito uno dei tre era messo male.

Prima di chiedersi se i motori AI citano i tuoi prodotti conviene rispondere a una domanda più noiosa: possono leggerli? Sono tre controlli, si fanno in venti minuti, e sul nostro stesso sito uno dei tre era messo male.

Primo: i crawler possono entrare?

Il file robots.txt, all'indirizzo tuosito.it/robots.txt, dice ai programmi automatici cosa possono leggere. Da qualche anno i motori che rispondono hanno i loro, con nomi propri, e alcuni siti li bloccano senza saperlo: a volte per una scelta fatta anni fa, a volte perché un plugin ha aggiunto regole restrittive per conto suo.

Il controllo è banale: apri quel file e guarda se ci sono blocchi. Se dice User-agent: * seguito da Allow: /, sei aperto a tutti. Se trovi righe che nominano crawler specifici con Disallow, stai escludendo qualcuno, e vale la pena sapere chi.

La decisione non è automatica: bloccare un crawler AI è legittimo se non vuoi che il tuo contenuto finisca nelle risposte di qualcun altro. Ma deve essere una scelta, non un'eredità.

Secondo: hai un llms.txt, ed è aggiornato?

È una convenzione recente: un file di testo che spiega in modo compatto cosa offri e dove stanno le pagine che contano. Non è uno standard imposto da nessuno e non garantisce niente, ma costa un'ora e toglie ai motori la necessità di indovinare la struttura del sito.

Il problema pratico non è crearlo, è mantenerlo. Sul nostro sito esisteva da tempo e non conteneva i casi studio, non conteneva le guide e delle pagine in italiano aveva solo il link alla home: descriveva un sito che non esisteva più. Un llms.txt vecchio è peggio di nessuno, perché indirizza con sicurezza verso la versione sbagliata.

La regola pratica: se pubblichi una pagina che conta, ci va dentro nello stesso momento. Altrimenti fra sei mesi descrive il sito dell'anno scorso.

Terzo: le pagine dichiarano cosa sono?

I dati strutturati sono un blocco di codice che dice a una macchina "questa è una pagina prodotto, questo è il prezzo, queste sono le domande frequenti". Senza, un motore deve dedurre tutto dal testo, e a volte deduce male.

Il controllo si fa guardando il codice sorgente della pagina e cercando application/ld+json. Se non c'è niente, nessuna pagina del tuo sito sta dichiarando cosa è.

Anche qui una cosa che abbiamo trovato su noi stessi vale come avvertimento: lo schema c'era, ma solo sulle pagine che spiegano il tema, cioè blog e guide. Le pagine commerciali, quelle che vuoi vengano citate quando qualcuno cerca cosa vendi, non ne avevano nessuno. Quaranta pagine su settantotto. Il controllo quindi non è "ho i dati strutturati", è "ce l'hanno le pagine che contano".

La cosa che i dati strutturati non fanno

Marcare non crea. Se nella pagina l'informazione non c'è, dichiararla nello schema non la fa esistere: i motori confrontano le due cose, e una discordanza fa più danni dell'assenza.

Prima il contenuto, poi la marcatura. È noioso e fa risparmiare un sacco di tempo perso.

Cosa non si riesce ancora a controllare

Questi tre controlli dicono se sei leggibile. Non dicono se vieni citato, e quella misura oggi non esiste in forma affidabile: nessuno strumento diffuso ti dice quante volte un motore generativo ha ripreso una tua pagina, per quale domanda e in quale lingua.

Quello che si può fare è più artigianale: provare a mano le domande importanti per la tua categoria e guardare chi viene citato, e tenere d'occhio il traffico che arriva dai referrer delle chat AI, che è poco ma sta crescendo. Chi ti promette un conteggio preciso sta stimando.

Come lo risolve Uptonica

Product riempie gli attributi e riscrive le schede perché contengano i dati in chiaro, che è la parte che i dati strutturati possono poi dichiarare. Senza contenuto nella pagina, marcarlo non serve a niente.

Guarda cosa fa Product

Domande frequenti

Conviene bloccare i crawler delle AI?

Dipende da cosa vendi. Un editore che vive di pubblicità sulle proprie pagine ha ragioni serie per bloccarli. Un negozio che vuole che i suoi prodotti vengano consigliati ha l'interesse opposto. La cosa sbagliata è averlo deciso senza saperlo.

llms.txt serve davvero o è una moda?

Oggi nessun motore garantisce di usarlo, quindi va preso per quello che è: un'ora di lavoro con un beneficio possibile e nessun rischio. Il costo è talmente basso che la domanda giusta non è se serve, ma se hai un'ora.

Shopify genera già i dati strutturati?

La maggior parte dei temi ne genera una parte, di solito sulle pagine prodotto. Quasi mai sulle pagine di categoria, sulle pagine informative o sulle FAQ. Vale la pena guardare pagina per pagina invece di dare per scontato che il tema faccia tutto.

Quante volte va rifatto questo controllo?

Il robots.txt quando cambi tema o installi qualcosa che tocca la SEO. Lo schema quando aggiungi tipi di pagina nuovi. Il file llms.txt ogni volta che pubblichi qualcosa che conta, perché è quello che si degrada più in fretta.

Da cosa comincio se ho poco tempo?

Dal secondo controllo capovolto: guarda se le tue pagine commerciali hanno i dati strutturati. È il buco più comune e il più costoso, perché riguarda proprio le pagine su cui vuoi essere trovato.

Guarda un cervello gestire il tuo store.

Walkthrough di 30 minuti sul tuo catalogo Shopify reale.

Prenota una demo