Il sito rispondeva «tutto a posto» a indirizzi che non esistono. E Google li metteva in prima posizione.
Fino al 25 settembre 2026 il sito di Itria rispondeva «tutto a posto» a indirizzi che non sono mai esistiti. Cinque di questi prendevano impression su Google in prima posizione.
Senza una pagina 404, Cloudflare Pages risponde a tutto. La documentazione di Cloudflare scrive che, se il progetto non ha un file 404.html in radice, Pages lo tratta come un’applicazione a pagina singola e manda ogni indirizzo alla radice. Su itria.io un indirizzo inesistente rispondeva con la home e il codice 200.
Cinque indirizzi mai creati erano in Search Console. Nei 28 giorni fino al 25 settembre 2026 hanno preso 7 impression e 1 click, tutti in posizione 1. Erano varianti storpiate di indirizzi veri, servite come copie della home.
Chi li ha generati non si vede dai dati. Sono indirizzi ricostruiti a memoria, e l’ipotesi più probabile è un assistente AI che cita una pagina senza copiarne il link. È un’inferenza, non una misura, e la scriviamo così.
Questo è un pezzo del laboratorio di Itria: cose misurate sul nostro sito, con i numeri veri, per capire come lo leggono motori e assistenti. Il servizio che nasce da qui è la presenza su motori e assistenti AI.
Cosa succede a un sito su Cloudflare Pages senza 404.html
Un sito statico su Cloudflare Pages senza un file 404.html in radice risponde a qualunque indirizzo con la pagina principale. La documentazione di Cloudflare lo spiega così: senza quel file, Pages presume che il progetto sia un’applicazione a pagina singola e fa corrispondere ogni percorso alla radice.
«If your project does not include a top-level 404.html file, Pages assumes that you are deploying a single-page application.» (Cloudflare, documentazione di Pages, «Serving Pages»)
Per un’applicazione a pagina singola è il comportamento giusto. Per un sito fatto di pagine vere è un difetto invisibile: chi apre un indirizzo sbagliato vede la home, senza nessun errore, e il server risponde 200, cioè «pagina trovata». Il 25 settembre 2026 lo abbiamo misurato sul nostro sito, nell’audit di igiene.
I cinque indirizzi fantasma
Nei 28 giorni fino al 25 settembre 2026, Search Console ha registrato cinque indirizzi di itria.io che non abbiamo mai creato. Tutti in posizione 1, tutti serviti come copia della home. Sommati fanno 7 impression e 1 click: pochi numeri, ma cinque pagine che per Google esistevano e per noi no.
| Indirizzo fantasma | Impression e click, 28 giorni | Pagina vera più vicina |
|---|---|---|
| /modello-scheda-prodotto-alimentare | 3 impression, 1 click, posizione 1 | /modello-scheda-tecnica-prodotto-alimentare |
| /modelo-scheda-tecnica-prodotto-alimentare | 1 impression, posizione 1 | /modello-scheda-tecnica-prodotto-alimentare |
| /esportare-alimenti-emirati | 1 impression, posizione 1 | /esportare-alimentari-emirati |
| /ai-act-gdpr | 1 impression, posizione 1 | /ai-act-e-gdpr |
| /richiesta-certificato-esportazione | 1 impression, posizione 1 | /richiesta-certificato-sanitario-esportazione |
Da dove vengono: un’inferenza, non una misura
Search Console dice che un indirizzo ha preso impression, non chi lo ha scritto. I cinque hanno la forma di un indirizzo ricostruito a memoria: una parola saltata, «alimenti» al posto di «alimentari», «modelo» al posto di «modello», un «e» mancante. È il tipo di errore di chi cita una pagina senza copiarne il link.
Un assistente AI che risponde citando una fonte a memoria produce esattamente questo tipo di indirizzo. Per questo pensiamo che l’origine più probabile sia quella. Ma i dati di Search Console non lo provano, e con 7 impression nessun dato lo proverebbe: resta un’ipotesi, e la teniamo come tale.
Cosa abbiamo fatto: una 404 vera e cinque redirect
La correzione ha due parti. Una pagina 404.html in radice, esclusa dall’indice, che porta a servizi, articoli e Diagnostico: da quel momento un indirizzo inesistente risponde 404. E un redirect permanente, codice 301, dai cinque indirizzi fantasma alla pagina vera più vicina, più una regola per tutta la famiglia «esportare-alimenti».
Misurato la sera del 25 settembre 2026: un indirizzo inventato risponde 404; /ai-act-gdpr, /modello-scheda-prodotto-alimentare ed /esportare-alimenti-cina rispondono 301 verso le pagine giuste. Chi arriva da un link sbagliato trova la pagina che cercava, e Google smette di contare copie della home.
Il controllo in cinque minuti, sul vostro sito
Il controllo si fa con un comando e una ricerca. Si chiede al sito un indirizzo che non esiste e si guarda il codice che risponde: deve essere 404, non 200. Poi, in Search Console, si scorre l’elenco delle pagine con impression cercando indirizzi che non si sono mai creati.
curl -s -o /dev/null -w "%{http_code}\n" https://ilvostrosito.it/indirizzo-che-non-esiste
Se il comando stampa 200, il sito risponde «pagina trovata» anche dove non c’è niente. Su Cloudflare Pages la cura è un file 404.html in radice; su altri servizi il nome cambia, il principio no. Gli indirizzi fantasma che hanno già impression si mandano con un 301 alla pagina vera più vicina.
Domande e risposte
Cosa succede a un sito su Cloudflare Pages senza il file 404.html?
Risponde a qualunque indirizzo con la pagina principale. La documentazione di Cloudflare scrive che, senza un 404.html in radice, Pages tratta il progetto come un’applicazione a pagina singola e fa corrispondere ogni percorso alla radice.
Su itria.io, fino al 25 settembre 2026, un indirizzo inesistente rispondeva con la home e il codice 200.
Perché un indirizzo che non esiste può prendere impression su Google?
Perché il server risponde 200 con una pagina vera, di solito la home, e Google la tratta come una pagina esistente. Su itria.io cinque indirizzi mai creati hanno preso 7 impression e 1 click in 28 giorni, tutti in posizione 1.
Da quando il sito ha una 404 vera e i redirect 301, gli indirizzi inventati rispondono 404 e quelli fantasma portano alla pagina giusta.
Gli indirizzi fantasma li generano gli assistenti AI?
Probabilmente, ma è un’inferenza. I cinque indirizzi di itria.io hanno la forma di link ricostruiti a memoria, con parole saltate o storpiate, che è il tipo di errore di chi cita una pagina senza copiarne il link.
Search Console dice che un indirizzo ha preso impression, non chi lo ha scritto: i dati non lo provano.
Come si controlla se il proprio sito risponde 200 alle pagine inesistenti?
Si chiede al sito un indirizzo che non esiste, per esempio con curl, e si guarda il codice di risposta: deve essere 404. Se è 200, il sito risponde pagina trovata anche dove non c’è niente.
Poi in Search Console si cercano, fra le pagine con impression, indirizzi che non si sono mai creati.
Come si correggono gli indirizzi fantasma?
Con una pagina 404 vera, che su Cloudflare Pages è un file 404.html in radice, e con un redirect permanente 301 da ogni indirizzo fantasma alla pagina vera più vicina.
Così chi arriva da un link sbagliato trova la pagina che cercava, e Google smette di contare copie della home.
Note sulle fonti
- Cloudflare, documentazione di Pages, «Serving Pages»: il comportamento senza 404.html in radice. La citazione fra virgolette è presa alla lettera.
- Search Console di itria.io, esportazione delle pagine sui 28 giorni fino al 25 settembre 2026: impression, click e posizione dei cinque indirizzi.
- Misure di Itria: audit di igiene del 25 settembre 2026 (risposta 200 con la home) e verifica della sera dello stesso giorno (404 sugli indirizzi inventati, 301 sui cinque fantasma).
- L’origine degli indirizzi fantasma è un’inferenza di Itria, non una misura: Search Console non registra chi ha scritto un link.
Vedere il proprio sito come lo leggono motori e assistenti.
Un indirizzo che risponde 200 dove non c’è niente, una mail che nel codice non c’è: sono difetti che non si vedono dal browser. Scriveteci una riga su cosa vi pesa: il primo passo lo facciamo noi, anche se poi non lavoreremo insieme.