
Prima di parlare di posizionamento, Google deve poter fare due cose: scansionare e indicizzare le tue pagine. Se salta uno di questi due passaggi, nessun contenuto — per quanto ottimo — potrà mai posizionarsi. È la lezione più concreta emersa al Search Central Live Deep Dive Europe 2026 di Barcellona, dove Google ha dedicato i primi due giorni proprio a scansione e indicizzazione. In questo approfondimento vediamo come applicare quei principi in pratica, con le differenze tra un sito eCommerce e un sito aziendale o di servizi.
Scansione: se Googlebot non entra, non esisti
La scansione è il momento in cui Googlebot scopre e scarica le tue pagine; se è ostacolata, il sito è invisibile a prescindere dalla qualità dei contenuti. I fattori che la fanno funzionare sono pochi e precisi:
- robots.txt pulito: blocca solo ciò che deve restare fuori, mai risorse CSS/JS necessarie al rendering o intere sezioni per errore.
- Server stabile e veloce: errori 5xx e lentezza riducono la frequenza di scansione. La velocità di risposta è parte del “crawl budget”.
- Link interni e sitemap XML: sono le strade con cui Google raggiunge le pagine. Una pagina senza link interni e assente dalla sitemap è un vicolo cieco.
- Nessuna catena di redirect: i reindirizzamenti a catena sprecano scansione e diluiscono i segnali.
Negli eCommerce il nemico numero uno della scansione è la navigazione a faccette. Filtri per colore, taglia, prezzo e ordinamento generano milioni di URL con parametri che bruciano crawl budget su pagine quasi identiche. La soluzione: decidere quali combinazioni devono essere indicizzabili e quali no, gestendole con canonical, regole sui parametri e link interni mirati. Nei siti aziendali o di servizi il problema è di solito opposto — pagine orfane: servizi importanti raggiungibili solo dal menu, senza link contestuali dagli articoli del blog.
Indicizzazione: essere scaricati non basta, bisogna essere capiti
L’indicizzazione è la fase in cui Google renderizza la pagina, ne interpreta il contenuto e decide se inserirla nell’indice. Qui si perdono molte pagine che pure venivano scansionate. I punti critici su cui Google ha insistito a Barcellona:
- Rendering e JavaScript: se il contenuto compare solo dopo l’esecuzione di JS pesante, Google potrebbe vedere una pagina vuota. Il contenuto critico deve essere nell’HTML o renderizzato in modo affidabile.
- Canonicalizzazione: quando più URL mostrano lo stesso contenuto, il canonical dice a Google quale versione indicizzare. Senza, il motore sceglie da solo — e spesso sceglie male.
- Duplicazione dei contenuti: pagine troppo simili competono tra loro. È il terreno della cannibalizzazione SEO, da prevenire con una pagina per ogni intento.
- Internazionalizzazione: per i siti multilingua, hreflang coerenti evitano che Google indicizzi la lingua sbagliata per il mercato giusto.
Nell’eCommerce l’indicizzazione si gioca sulle schede prodotto. Varianti (taglia/colore) che generano URL separati, descrizioni identiche fornite dal produttore e prodotti esauriti sono le tre cause più comuni di dispersione. La regola pratica: canonical dalle varianti al prodotto principale, descrizioni originali almeno sui prodotti di punta, e una strategia chiara per i prodotti fuori stock (mantenere la pagina, suggerire alternative, non lasciare un 404). Per la parte tecnica di supporto — immagini, sitemap e markup — resta valido il nostro approfondimento su WebP, sitemap e dati strutturati.
La diagnostica: Search Console è il tuo pannello di controllo
Ogni problema di scansione e indicizzazione lascia una traccia in Google Search Console, ed è lì che si verifica — non a intuito. I tre strumenti da usare:
- Report “Indicizzazione delle pagine”: mostra quante pagine sono indicizzate e, soprattutto, i motivi delle esclusioni (bloccata da robots, duplicata, scansionata ma non indicizzata, ecc.).
- Controllo URL: per una singola pagina, dice se è indicizzata, come Google la vede renderizzata e se ci sono problemi.
- Statistiche di scansione: rivelano quanto spesso Google passa e se incontra errori server che frenano il crawl budget.
Checklist pratica: eCommerce vs sito aziendale
Gli stessi principi si applicano in modo diverso a seconda del tipo di sito. Per un eCommerce la priorità è governare la scala: faccette, varianti, paginazione e prodotti esauriti. Per un sito aziendale o professionale la priorità è la copertura e i collegamenti: assicurarsi che ogni pagina di servizio sia indicizzata, linkata internamente e non duplicata da vecchi contenuti. In entrambi i casi il punto di partenza è lo stesso: la nostra checklist SEO tecnica, che raccoglie gli errori invisibili più frequenti.
Domande frequenti
Perché una pagina viene scansionata ma non indicizzata?
Succede quando Google scarica la pagina ma decide di non inserirla nell’indice, di solito perché la giudica duplicata, troppo sottile o di scarso valore rispetto a pagine simili già indicizzate. Lo stato “Scansionata ma attualmente non indicizzata” in Search Console segnala proprio questo.
Cos’è il crawl budget e quando è un problema?
È la quantità di risorse che Google dedica a scansionare un sito. Diventa un problema soprattutto sui siti grandi, come gli eCommerce con navigazione a faccette, dove migliaia di URL con parametri consumano scansione a scapito delle pagine che contano davvero.
Il JavaScript danneggia la SEO?
Non di per sé, ma se il contenuto importante è visibile solo dopo l’esecuzione di JavaScript pesante, Google potrebbe non vederlo o vederlo in ritardo. La regola è rendere disponibile il contenuto critico nell’HTML o garantirne un rendering affidabile.
Vuoi sapere cosa Google vede (e cosa no) del tuo sito?
In SeoMask analizziamo scansione e indicizzazione del tuo sito — eCommerce o aziendale — e sistemiamo ciò che tiene le tue pagine fuori dall’indice. Parti da qui:
- ✅ Checklist SEO tecnica per eCommerce
- 📰 Cosa ha detto Google a Barcellona
- 🔍 Richiedi la tua analisi SEO gratuita o contattaci
Scopri di più da SeoMask: SEO & Dev
Abbonati per ricevere gli ultimi articoli inviati alla tua e-mail.

