Il sito si fa leggere da tutti. La scheda tecnica la offre un produttore su sei.
Abbiamo letto da fuori i 249 siti dichiarati da produttori ed esportatori nella vetrina dell’ICE per i compratori esteri. I siti si lasciano leggere da tutti, motori di ricerca e assistenti AI compresi. La scheda tecnica che un compratore vuole vedere la offre un produttore alimentare su sei.
19 siti alimentari su 121, il 15,7%, offrono una scheda tecnica da scaricare fra la home e la pagina di un prodotto, e altri 7 la mostrano solo in pagina. Nelle cantine la offrono 13 su 25, negli altri produttori alimentari 6 su 96. Ogni scheda è stata aperta e letta, uno per uno.
121 siti alimentari su 121 lasciano entrare Google, Bing e i crawler di ricerca di ChatGPT, Claude e Perplexity. La distanza sta nella pagina: nel 18,2% il title è solo il nome dell’azienda, il 35,5% non ha una meta description, il 43,8% non dichiara con i dati strutturati chi è l’azienda, l’11,6% ha la mail invisibile agli assistenti AI.
26 indirizzi su 249 della vetrina, il 10,4%, non portano a un sito che funziona: domini che non esistono più, pagine in errore, siti in manutenzione, un WordPress mai configurato, un dominio passato a un casinò online.
Lo studio è di Itria AI (itria.io), indipendente dall’ICE: la directory è la fonte pubblica da cui sono stati presi gli indirizzi dei siti. Le misure sono del 26 settembre 2026. Metodo, verifiche, correzioni e i dati di ogni sito, senza nomi di aziende, sono in questa pagina e nel file scaricabile in fondo, in licenza CC BY 4.0. Per chi esporta, le pagine operative partono dalla guida all’export operativo per il piccolo produttore alimentare.
Dove si fa davvero il commercio export
Di persona, nelle fiere come Anuga e SIAL, e con i campioni. Il CBI, il centro del governo olandese che aiuta gli esportatori dei paesi a reddito medio e basso a vendere in Europa, lo scrive nella guida su come trovare i compratori europei di frutta e verdura trasformate: la maggior parte delle collaborazioni durature nasce ancora da presentazioni personali, analisi dei campioni e visite allo stabilimento.
«Processed food is a face-to-face business, but a website gives you global visibility» (CBI, guida sui compratori europei di frutta e verdura trasformate, aggiornata il 19 settembre 2023)
Prima dell’incontro c’è la ricerca. I compratori europei cercano nuovi fornitori su Google, con il nome del prodotto e parole come «producer» o «supplier», a volte insieme al paese d’origine, e per il CBI comparire in prima pagina per quelle ricerche è «very important». Quando è il produttore a farsi avanti, consiglia una telefonata seguita da una mail.
Sul sito, secondo il CBI, la documentazione di prodotto va tenuta a disposizione di chi compra: specifiche complete, fra cui dimensioni, peso, confezione, durata e valori nutrizionali, cioè le informazioni che il compratore vuole vedere e che lo aiutano a decidere. Come esempio cita un produttore che pubblica una scheda in PDF per ogni prodotto: è la scheda tecnica che questo studio ha cercato.
Lo studio misura quello che si vede da fuori: cosa trovano sul sito un compratore, un motore di ricerca e un assistente AI. Quante richieste export arrivino dal sito lo sa solo l’azienda che le riceve. Nelle fonti pubbliche che abbiamo letto quel numero manca, e in questa pagina non lo stimiamo.
Cosa abbiamo misurato: il compratore, il motore di ricerca, l’assistente AI
Un sito aziendale oggi ha tre lettori. Il compratore estero che lo apre, il motore di ricerca che lo indicizza, l’assistente AI che lo legge al posto di qualcuno. Abbiamo misurato cinque cose che servono al primo e sei che decidono se gli altri due trovano l’azienda e capiscono cosa fa.
| Misura | Cosa conta come sì | Perché conta |
|---|---|---|
| Versione in inglese | hreflang inglese, link a /en/, selettore EN, o home già in inglese. | È la lingua del compratore estero. |
| Canale di contatto | Un modulo con campo mail o messaggio, un mailto, un indirizzo scritto. | Senza, il compratore non scrive. |
| Mail leggibile da un assistente AI | L’indirizzo in chiaro nell’HTML servito, non offuscato. | Gli assistenti che leggono al volo non eseguono JavaScript (Vercel). |
| Scheda tecnica | Da scaricare: un documento di scheda del prodotto, PDF, immagine o pagina web, linkato fra la home e la pagina di un prodotto e aperto. In pagina: una sezione intitolata scheda tecnica o dati tecnici, con i campi sotto. Un catalogo generale non conta. | Il CBI consiglia di tenerla sul sito, a disposizione dei compratori. |
| Condizioni per l’estero | Un listino export o ingrosso, un ordine minimo per rivenditori, una resa Incoterm, un franco fabbrica. Letti caso per caso. | Senza, ogni offerta parte da una mail di domanda. |
| robots.txt aperto a Google e Bing | Googlebot e Bingbot possono leggere la home. | Chi li blocca esce dai risultati di ricerca. |
| robots.txt aperto alla ricerca AI | OAI-SearchBot, PerplexityBot, Claude-SearchBot e Claude-User possono leggere la home. | OpenAI: chi blocca OAI-SearchBot non compare nelle risposte di ricerca di ChatGPT. |
| Home indicizzabile | Nessun noindex nel meta robots né nell’header X-Robots-Tag. | Google toglie del tutto dai risultati una pagina con noindex. |
| Title che dice cosa fa l’azienda | Il title contiene qualcosa oltre al nome dell’azienda e a parole come Home o Benvenuti. | Google chiede title descrittivi ed è esplicito: niente «Home». |
| Meta description | Presente e non vuota. | È una delle fonti del testo che accompagna il risultato. |
| Dati strutturati dell’azienda | La home dichiara schema.org Organization o LocalBusiness. | Aiutano Google a capire chi è l’azienda e a distinguerla nei risultati. |
Il perché di ogni riga viene dalla documentazione di chi decide: le pagine di OpenAI, Anthropic e Perplexity sui loro crawler, le guide di Google su noindex, title e dati dell’organizzazione. Abbiamo misurato anche la sitemap e i dati strutturati di prodotto, riportati a parte perché nessuna di queste fonti li chiede a un sito piccolo.
Perché non abbiamo misurato llms.txt
Perché Google scrive che non lo usa. Nella sua guida alle funzioni di ricerca generativa, aggiornata il 10 luglio 2026, alla voce sui file llms.txt: non servono file speciali per comparire nella ricerca, nemmeno nelle funzioni AI, e crearli «will neither harm nor help» la visibilità, perché la ricerca di Google li ignora.
«You don’t need to create new machine readable files, AI text files, markup, or Markdown to appear in Google Search (including its generative AI capabilities), as Google Search itself doesn’t use them.» (Google Search Central, guida alle funzioni di ricerca generativa)
Anche itria.io ha un file llms.txt, pensato per altri servizi che lo leggono. Lo scriviamo perché il criterio dello studio vale anche per noi: si misura quello che motori e assistenti dichiarano di usare. La stessa guida aggiunge che i dati strutturati non sono un requisito per la ricerca generativa, e per questo li presentiamo per quello che fanno secondo Google: dire chi è l’azienda.
Il metodo: la vetrina ICE, l’HTML servito, la pagina del prodotto nel browser
La cornice è la directory pubblica dell’ICE «Find your Italian partner», pensata per le aziende e gli agenti esteri che cercano prodotti o partner italiani. Le schede sono state raccolte fra il 19 e il 31 agosto 2026 con ricerche per parole legate alla Puglia, come Puglia, Apulia, Bari e Salento, e per prodotto, come conserve e formaggio.
La directory non registra la regione e la ricerca confronta il testo delle schede, quindi le aziende trovate vengono da tutta Italia. Le schede dichiaravano 249 siti diversi, e li abbiamo letti tutti, senza campionare. Il campione rappresenta chi si presenta ai compratori esteri in quella vetrina, e l’export alimentare italiano nel suo insieme resta fuori dalla sua portata.
Per ogni sito abbiamo letto il robots.txt, la home, la pagina contatti e la pagina prodotti se linkate dalla home, il 26 settembre 2026 fra le 13:34 e le 14:39. Abbiamo letto l’HTML che il server consegna, cioè quello che legge un assistente AI che non esegue JavaScript, con uno strumento che dichiara la propria identità, rispetta il robots.txt e aspetta almeno 2,5 secondi fra una richiesta e l’altra.
Ogni misura ha tre esiti: sì, no, e non misurabile. Un sito che rifiuta la lettura o risponde con un errore si conta a parte e resta fuori dalle percentuali. Pagine, header e robots.txt sono stati salvati, così ogni misura si ricontrolla sul codice letto quel giorno.
Per la scheda tecnica siamo andati un clic più in là. La sera del 26 settembre abbiamo aperto in un browser, un sito alla volta, la pagina del primo prodotto di ogni sito alimentare e fino a due pagine per professionisti o di documenti linkate dalla home o dalla pagina dei prodotti. Ogni documento candidato è stato aperto e letto: catalogo generale, brochure e listino non contano.
La vetrina: 26 indirizzi su 249 non portano a un sito che funziona
Il 10,4% degli indirizzi che la vetrina ICE mostra ai compratori esteri porta a qualcosa che non è il sito di un’azienda. 14 domini non esistono più, 2 home rispondono con un errore, e 10 pagine sono altro: una pagina predefinita del server, due siti in manutenzione, un WordPress mai configurato, un dominio parcheggiato, un dominio passato a un casinò online.
| Esito sui 249 indirizzi | Indirizzi | Quota |
|---|---|---|
| Letti | 195: 121 siti alimentari su 122 indirizzi, 71 di altri settori, 1 non classificabile, 1 negozio in manutenzione | 78,3% |
| Home quasi vuota nell’HTML | 14: 5 costruite in JavaScript, 7 che non sono un sito, 2 minime ma funzionanti | 5,6% |
| Dominio che non esiste più | 14 | 5,6% |
| Home in errore | 2 | 0,8% |
| robots.txt irraggiungibile o in errore | 14, contati come non misurabili | 5,6% |
| Lettura vietata o rifiutata | 6 | 2,4% |
| Altri non misurabili | 4: due siti che rispondono a un browser e non allo strumento, un dominio tornato attivo, un indirizzo scritto male nella scheda | 1,6% |
Le 10 pagine che non sono un sito, una per una: la pagina predefinita di un server, un segnaposto di server, un sito in manutenzione, un negozio online in manutenzione dietro una pagina password, uno in aggiornamento, un WordPress con la pagina d’esempio e il noindex attivo, un dominio parcheggiato, un rimando a un dominio che non esiste più, un dominio passato a un sito di casinò online, una home fatta solo di messaggi d’errore PHP. Tutti gli indirizzi senza sito sono stati riaperti in un browser il 26 settembre.
Chi cura una vetrina di aziende per i compratori esteri ha qui un controllo che si fa in un’ora: aprire gli indirizzi. Per l’azienda, il sito dichiarato in una directory è una promessa fatta a un compratore che non si conosce ancora.
La tabella: 121 siti di produttori alimentari
Dei 195 siti letti, 121 sono di produttori o distributori di alimenti e bevande. Li abbiamo classificati tutti uno per uno, leggendo title, descrizione e testo della home: la directory restituisce anche aziende di altri settori, dalla cosmetica ai macchinari, perché la ricerca è testuale. Le percentuali sono calcolate sui 121 siti: due indirizzi della vetrina portano alla stessa cantina.
| Cosa trova il compratore | Siti con il sì | Su 121 |
|---|---|---|
| Canale di contatto nel codice | 120 | 99,2% |
| Versione in inglese | 93 | 76,9% |
| Mail leggibile da un assistente AI | 107 (7 offuscate, 7 assenti dal codice) | 88,4% |
| Scheda tecnica da scaricare, fra la home e la pagina di un prodotto | 19 | 15,7% |
| Scheda tecnica in pagina, con i campi | 10 (7 senza la scheda da scaricare) | 8,3% |
| Condizioni per l’estero o l’ingrosso | 1 (2 contando un caso di confine) | 0,8% |
Il compratore estero trova quasi sempre il modo di scrivere. La scheda tecnica la trova da scaricare in un sito su sei, le condizioni per ordinare in uno su 121. Ogni informazione che manca diventa una mail di domanda.
E il tempo di risposta pesa: nello studio InsideSales.com e MIT del 2007 chi richiama entro cinque minuti ha fino a cento volte più probabilità di parlare con il contatto, come raccontiamo in i cinque minuti che decidono una richiesta.
Il costo delle domande che arrivano per mail si somma in ore che nessuno fattura: il conto di quanto costa rispondere a mano ha sei righe. Due documenti bastano a entrare fra chi li offre: il modello di scheda tecnica di un prodotto alimentare, con la sua versione in inglese campo per campo, e il listino export con EXW e DDP.
Dove sta la scheda tecnica: una cantina su due, un altro produttore su sedici
La scheda tecnica da scaricare si concentra nel vino: la offrono 13 cantine su 25, il 52,0%, e 6 degli altri 96 produttori alimentari, il 6,3%. Quasi sempre sta nella pagina del singolo prodotto, un clic dopo la home: 17 casi su 19. Negli altri 2 è nella pagina che elenca i vini.
| Scheda tecnica | Cantine, 25 | Altri alimentari, 96 |
|---|---|---|
| Da scaricare | 13 (52,0%) | 6 (6,3%) |
| In pagina, con i campi | 5 (20,0%) | 5 (5,2%) |
| Almeno una delle due | 16 (64,0%) | 10 (10,4%) |
La divisione fra cantine e altri alimentari l’abbiamo fatta dopo la lettura, quando abbiamo visto dove stavano le schede, con una regola scritta prima di contare: è una cantina il sito il cui prodotto principale è il vino, e le aziende che fanno olio e vino restano fra gli altri. Il file scaricabile ha la colonna, così la divisione si ricontrolla.
Fuori dal vino, le 6 schede da scaricare sono di tre produttori di olio, uno di tartufi, un’azienda di dolci e un caseificio. Dei 19 documenti quasi tutti sono PDF: in 3 casi la scheda è un’immagine o una scansione, in 1 è l’etichetta elettronica di un vino, una pagina web linkata come «Scheda tecnica».
Chi ha la scheda e non la mostra
In 3 siti la scheda tecnica esiste ma non si scarica: una pagina di schede protetta da password, un’area download che chiede il login, un link «Scheda tecnica» che apre un modulo per riceverla per mail. Non li abbiamo contati fra i sì, e nessun modulo è stato compilato.
In 4 siti il listino, i prezzi o la lista dei prodotti arrivano solo dopo un modulo o una registrazione. In 11 l’unico documento di prodotto è un catalogo o una brochure generali, e in 28 non c’è una pagina di singolo prodotto: i prodotti stanno tutti in una pagina o in una galleria, o non sono elencati affatto. Delle 27 pagine per professionisti o di documenti lette, una sola offre le schede da scaricare.
Motori e assistenti AI: il robots.txt è aperto, la pagina dice poco
121 siti alimentari su 121 lasciano entrare Googlebot, Bingbot e i quattro crawler con cui ChatGPT, Claude e Perplexity costruiscono le risposte di ricerca. Nessuno blocca nemmeno i crawler di addestramento, e nessuno usa il robots.txt gestito da Cloudflare, che per la sua documentazione chiude solo l’addestramento. La porta è aperta: quello che manca sta dentro la pagina.
| Cosa trovano motori e assistenti | Siti | Su 121 |
|---|---|---|
| robots.txt aperto a Google e Bing | 121 | 100% |
| robots.txt aperto ai crawler di ricerca AI | 121 | 100% |
| Home indicizzabile, senza noindex | 121 | 100% |
| Pagina servita in HTTPS | 120 | 99,2% |
| Title fatto solo del nome dell’azienda | 22 | 18,2% |
| Senza meta description | 43 | 35,5% |
| Senza dati strutturati su chi è l’azienda | 53 | 43,8% |
| Dati strutturati di prodotto nelle pagine lette | 9 | 7,4% |
| Sitemap dichiarata o presente | 113 | 93,4% |
Un title come «Home - Nome azienda» dice al motore e al compratore solo come si chiama l’azienda, e Google chiede esplicitamente di evitare «Home». Una home senza dati Organization lascia a Google il lavoro di capire chi è l’azienda e di distinguerla da un’omonima. Sono correzioni da un pomeriggio, e valgono per tutti e tre i lettori del sito.
Sugli assistenti la partita si misura con la citazione, perché il clic arriva di rado: il Pew Research Center ha osservato che chi vede un riassunto AI su Google clicca un risultato nell’8% delle visite, contro il 15% di chi non lo vede. Come si lavora su entrambi i fronti lo spieghiamo in farsi trovare su Google e ChatGPT.
La mail che l’assistente AI non vede: 11,6%
14 siti alimentari su 121 non hanno una mail leggibile da un assistente AI: 7 la offuscano, 7 non la scrivono nel codice. Con l’offuscamento di Cloudflare, per esempio, l’indirizzo nell’HTML diventa «[email protected]» e torna in chiaro solo con uno script nel browser, come spiega la documentazione di Cloudflare. Il caso di itria.io, e il controllo da fare sul proprio sito, sono nel laboratorio sulla mail che gli assistenti AI non vedono.
I crawler degli assistenti AI leggono l’HTML così come arriva: Vercel lo ha misurato su circa 1,3 miliardi di richieste in un mese, e nessuno dei principali crawler AI esegue il JavaScript delle pagine. Chi chiede a un assistente il contatto di quell’azienda trova il sito e non trova l’indirizzo.
Cosa abbiamo corretto prima di pubblicare
Una prima lettura, il 25 settembre, dava 2 schede tecniche e 5 informazioni per l’estero su 128. Controllando uno per uno i casi positivi abbiamo trovato due regole troppo larghe: una contava la parola «Wholesale» in un menu e un minimo d’ordine del carrello al dettaglio, l’altra classificava come alimentare un produttore di distributori automatici. Abbiamo riletto tutti i siti con le regole corrette.
| Misura | Prima lettura, 25 settembre | Seconda lettura, 26 settembre |
|---|---|---|
| Siti alimentari | 128, classificati per parole chiave | 123, classificati uno per uno |
| Scheda tecnica scaricabile | 2 | 1: l’altra era di un produttore di distributori automatici |
| Condizioni per l’estero | 5 | 1: gli altri erano la parola Wholesale in un menu e in una presentazione, un testo spam, un carrello al dettaglio |
| Home quasi vuota | 14, tutte attribuite al JavaScript | 14: 5 in JavaScript, 9 che non sono un sito |
Poi una terza lettura, la sera del 26 settembre. La seconda aveva guardato tre pagine per sito e contato 1 scheda tecnica su 123. Aprendo nel browser anche la pagina di un prodotto le schede da scaricare sono 19, e rileggendo i siti abbiamo trovato due errori nel conto dei siti alimentari: tutte le percentuali ora sono calcolate sui 121.
| Misura | Seconda lettura, 26 settembre pomeriggio | Terza lettura, 26 settembre sera |
|---|---|---|
| Siti alimentari | 123 | 121: due indirizzi portano alla stessa cantina, e un negozio online in manutenzione è passato fra gli indirizzi senza sito |
| Scheda tecnica da scaricare | 1, su tre pagine per sito | 19, aprendo anche la pagina di un prodotto. Già nelle tre pagine erano 3: la regola non riconosceva «factsheet» né una scheda in pagina web |
| Indirizzi senza un sito che funziona | 25 su 249 | 26 su 249 |
La verifica, e quanto ci si può fidare
Ogni "sì" di scheda tecnica e di condizioni per l’estero è stato letto uno per uno nel codice salvato, e ogni sito misurato è stato classificato uno per uno. Questa lettura caso per caso l’ha fatta un agente AI di Itria, sul codice salvato il giorno della misura, con le regole scritte prima. I casi positivi e gli indirizzi senza sito sono stati poi riaperti in un browser: la verifica ha confermato i casi positivi e ha tolto 7 indirizzi dal conteggio della vetrina, fra cui una pagina che rimanda al sito del marchio e due siti che a un browser rispondono. Il caso di confine è una FAQ per importatori che spiega da cosa dipende il minimo d’ordine senza indicarlo: l’abbiamo contata come no, e contandola il dato passa da 1 a 2 su 121.
Nella terza lettura ogni scheda è stata aperta e letta: i PDF con un programma che ne estrae il testo, le scansioni e le immagini guardate una per una, le schede in pagina lette nel codice della pagina aperta nel browser, etichetta e campi. In 1 sito i campi della scheda in pagina non erano nel codice: l’abbiamo contato come no.
robots.txt e noindex sono stati controllati su tutti i file, e lo strumento riconosce un blocco su un robots.txt di prova. Title: tutti i casi riletti uno per uno. Descrizione, dati strutturati e sitemap: 20 siti estratti a caso con un seme fisso, riletti nel codice, esito identico in 20 casi su 20. Con 20 casi il tasso di errore vero di queste tre misure può arrivare a circa il 15%, secondo la regola del tre.
Un limite di portata resta. Per la scheda abbiamo aperto un prodotto per sito, il primo nell’ordine della pagina prodotti: un sito che mette la scheda solo su alcuni prodotti può risultare senza, e una scheda dietro un accesso riservato non è contata. Le altre misure restano sulle tre pagine lette il 26 settembre pomeriggio.
Scaricare i dati, e come citarli
Il file ha una riga per ciascuno dei 249 indirizzi, con data, esito, settore e tutte le misure, comprese quelle della terza lettura sulla pagina del prodotto, senza nomi di aziende e in ordine rimescolato. I dati sono in licenza CC BY 4.0: si riusano liberamente citando Itria AI (itria.io) e il link a questa pagina.
| File | Cosa contiene | Link |
|---|---|---|
| Dati dello studioCSV, 249 righe, CC BY 4.0 | Data, esito, settore, le misure per il compratore e per motori e assistenti AI, le pagine lette, e per i siti alimentari la pagina del prodotto, la scheda da scaricare, in pagina o nascosta, e se è una cantina. |
Domande e risposte
Quanti siti di produttori alimentari offrono una scheda tecnica scaricabile?
Nello studio di Itria AI del 26 settembre 2026, 19 siti su 121, il 15,7%, fra la home e la pagina di un prodotto, e altri 7 la mostrano solo in pagina. Nelle cantine la offrono 13 su 25, negli altri produttori alimentari 6 su 96. Sono i siti di produttori alimentari della directory ICE per i compratori esteri.
Ogni scheda è stata aperta e letta, uno per uno. Il conto guarda il primo prodotto di ogni sito: un sito che mette la scheda solo su alcuni prodotti può risultare senza.
I produttori alimentari bloccano Google o gli assistenti AI nel robots.txt?
No: nello studio di Itria AI del 26 settembre 2026, 121 siti alimentari su 121 lasciano entrare Googlebot, Bingbot, OAI-SearchBot, PerplexityBot, Claude-SearchBot e Claude-User, e nessuno blocca nemmeno i crawler di addestramento.
La distanza sta nella pagina: nel 18,2% il title è solo il nome dell’azienda, il 35,5% non ha una meta description e il 43,8% non dichiara con i dati strutturati chi è l’azienda.
Serve un file llms.txt per comparire nelle risposte AI di Google?
Google scrive di no. Nella guida alle funzioni di ricerca generativa, aggiornata il 10 luglio 2026, spiega che non servono file speciali come llms.txt per comparire nella ricerca, comprese le funzioni AI, e che crearli non aiuta né danneggia la visibilità, perché la ricerca di Google li ignora.
Per questo lo studio di Itria AI misura quello che motori e assistenti dichiarano di usare: robots.txt, noindex, title, meta description e dati strutturati.
Perché un assistente AI non trova la mail di un’azienda sul suo sito?
Perché la mail è offuscata o non è scritta nell’HTML. Gli assistenti che leggono una pagina al volo non eseguono JavaScript e vedono solo l’HTML che il server consegna. Nello studio di Itria AI, 14 siti alimentari su 121, l’11,6%, non avevano una mail leggibile: 7 la offuscavano e 7 non la scrivevano nel codice.
Come è stato fatto lo studio di Itria AI sui siti dei produttori alimentari?
Sono stati letti tutti i 249 siti dichiarati nelle schede della directory ICE Find your Italian partner raccolte con ricerche per parole legate alla Puglia e per prodotto. Per ogni sito sono stati letti robots.txt, home, contatti e prodotti nell’HTML servito, il 26 settembre 2026, rispettando il robots.txt e senza compilare moduli. Per la scheda tecnica è stata aperta in un browser anche la pagina del primo prodotto.
Ogni sito è stato classificato uno per uno e ogni caso positivo di scheda tecnica e condizioni per l’estero è stato letto caso per caso. I dati, senza nomi, sono scaricabili in CC BY 4.0.
Note sulle fonti
- ICE, Find your Italian partner: la directory pubblica per le aziende e gli agenti esteri che cercano prodotti o partner italiani. È la cornice dello studio: i dati sui siti sono misure di Itria, e lo studio è indipendente dall’ICE.
- CBI, il centro per la promozione della produzione e del commercio sostenibili fra i paesi a reddito medio e basso e l’Europa, parte della Netherlands Enterprise Agency e finanziato dal ministero degli Esteri dei Paesi Bassi: 7 tips for finding buyers in the European processed fruit and vegetables market e 7 tips for doing business with European buyers of processed fruit and vegetables, entrambe aggiornate il 19 settembre 2023. Le frasi in inglese sono prese alla lettera.
- OpenAI, i crawler di OpenAI: «Sites that are opted out of OAI-SearchBot will not be shown in ChatGPT search answers». Per ChatGPT-User il robots.txt può non applicarsi, e per questo non è fra le misure.
- Anthropic, i crawler di Anthropic, aggiornata il 7 aprile 2026: disabilitare Claude-SearchBot o Claude-User può ridurre la visibilità del sito nelle ricerche degli utenti; ClaudeBot riguarda l’addestramento.
- Perplexity, i crawler di Perplexity: per comparire nei risultati raccomanda di permettere PerplexityBot nel robots.txt.
- Cloudflare, robots.txt gestito, aggiornata il 3 agosto 2026: blocca crawler di addestramento come GPTBot, ClaudeBot e Google-Extended; e offuscamento degli indirizzi mail.
- Vercel, The rise of the AI crawler: i principali crawler AI non eseguono JavaScript.
- Google Search Central: noindex, title, dati strutturati dell’organizzazione (aggiornata l’8 settembre 2026), sitemap e guida alle funzioni di ricerca generativa (aggiornata il 10 luglio 2026). La citazione su llms.txt è presa alla lettera.
- Pew Research Center, clic con e senza riassunto AI, 22 luglio 2025: 900 adulti statunitensi, 68.879 ricerche di marzo 2025, clic su un risultato nell’8% delle visite con riassunto e nel 15% senza.
- Le misure sono di Itria AI (itria.io), prese il 26 settembre 2026 fra le 13:34 e le 14:39 con uno strumento che legge l’HTML servito, rispetta il robots.txt e dichiara la propria identità; la pagina del prodotto è stata letta in un browser la sera e la notte dello stesso giorno. Tutte le fonti qui sopra sono state aperte e lette il 26 settembre 2026.
- Nessun nome di azienda è pubblicato, né in pagina né nel file. Nessuna richiesta è stata inviata alle aziende misurate.
Vedere il proprio sito come lo leggono i suoi tre lettori.
Le stesse misure si prendono sul vostro sito: cosa trova il compratore, cosa legge Google, cosa capisce un assistente AI. Scriveteci una riga su cosa vi pesa: il primo passo lo facciamo noi, anche se poi non lavoreremo insieme.