Un sito web può contenere decine, se non centinaia di pagine. Senza un chiaro riferimento, i motori di ricerca e i visitatori possono perdere contenuti utili. La pagina sitemap svolge questo ruolo di riferimento: elenca le vostre URL affinché nulla rimanga invisibile. Comprendere il suo funzionamento consente di agire su due fronti, il posizionamento naturale e l’esperienza di navigazione.
Ciò che Google si aspetta davvero dalla vostra sitemap nel 2025
Avrete forse sentito parlare dei tag priority e changefreq nei file sitemap XML. Google li ignora ampiamente da diversi anni. Il segnale che conta oggi è il tag lastmod, unico indicatore affidabile per dare priorità al crawl.
Quando questa data riflette l’ultima modifica reale di una pagina, i robot sanno quali URL visitare nuovamente con priorità. Se la data è errata o assente, il motore di ricerca perde tempo a esplorare pagine immutate.
Un’altra evoluzione notevole: da giugno 2023, Google ha chiuso il suo endpoint di ping per le sitemap. Non è più possibile “avvisare” Google di una nuova sitemap con una semplice chiamata HTTP. Rimangono due metodi attivi: inviare il file tramite la Search Console o dichiarare il suo percorso nel file robots.txt con la direttiva Sitemap:.
Molti webmaster pensano che la loro sitemap sia rotta perché non appare nella Search Console. In realtà, se il file è dichiarato solo in robots.txt, Google lo scopre ma non lo visualizza nel rapporto Sitemaps della console. Per monitorarne lo stato, è necessario inviarlo manualmente tramite l’interfaccia. È su la pagina sitemap di Skynet System che si può osservare un esempio concreto di struttura ben dichiarata.

Sitemap XML e sitemap HTML: due file, due pubblici
La confusione tra questi due formati si ripresenta spesso. La sitemap XML è un file tecnico, leggibile dai robot di indicizzazione. Contiene l’elenco delle URL con metadati (data di modifica, in particolare). I visitatori umani non lo consultano mai direttamente.
La sitemap HTML, invece, assume la forma di una pagina web classica. Mostra una mappa del sito organizzata per sezioni. Il suo pubblico sono i vostri visitatori.
Quando la mappa del sito HTML cambia le regole del gioco per l’utente
Un menu di navigazione ben progettato è sufficiente per un sito di cinque pagine. Superate alcune decine di pagine, alcuni contenuti diventano difficili da raggiungere: articoli vecchi, pagine di categorie profonde, schede prodotto poco messe in evidenza.
Una pagina sitemap HTML rende accessibile con un clic ciò che il menu nasconde in tre livelli. Ne beneficiano particolarmente i siti e-commerce, i blog voluminosi e i portali informativi dove le strutture sono profonde.
Quali URL includere in una sitemap per il posizionamento
Elencare tutte le URL senza selezione è un errore comune. I motori di ricerca dispongono di un budget di crawl limitato per ogni sito. Inviare centinaia di pagine inutili nella sitemap diluisce l’attenzione dei robot.
Ecco i criteri di selezione concreti:
- Conservare solo le URL canoniche: se due indirizzi puntano allo stesso contenuto, solo la versione canonica (quella dichiarata con il tag
rel="canonical") merita il suo posto nella sitemap - Escludere le pagine senza valore di indicizzazione: pagine di risultati di ricerca interna, pagine di filtri, pagine di accesso o di carrello
- Verificare che ogni URL restituisca un codice HTTP 200. Un’URL con errore 404 o in reindirizzamento 301 nella sitemap invia un cattivo segnale
- Compilare un tag lastmod solo quando il contenuto è realmente cambiato, non ad ogni generazione automatica del file
Una sitemap pulita contiene meno URL ma di migliore qualità. Meglio cinquanta pagine pertinenti che cinquecento pagine diluite.

Errori comuni che impediscono a Google di sfruttare la vostra sitemap
Alcuni problemi si ripresentano regolarmente negli audit tecnici e passano inosservati per mesi.
- La sitemap è generata ma mai inviata nella Search Console. Viene scoperta tramite robots.txt, senza alcun monitoraggio possibile da parte del webmaster
- Le date lastmod vengono aggiornate automaticamente ad ogni ricostruzione del sito, anche senza modifica del contenuto. Google finisce per ignorare questo segnale
- Il file supera il limite di dimensione o di numero di URL. Il formato XML consente un massimo per file. Oltre, è necessario creare un indice di sitemap che punti a più file
- URL bloccate da robots.txt figurano nella sitemap. Questo conflitto impedisce l’indicizzazione e genera avvisi nella Search Console
Controllate la coerenza tra la vostra sitemap, il vostro robots.txt e i vostri tag canonical almeno una volta ogni trimestre. Questi tre elementi devono raccontare la stessa storia ai motori di ricerca.
La trappola del rapporto Sitemaps nella Search Console
Il rapporto mostra il numero di URL scoperte e il numero di URL indicizzate. Un divario significativo tra i due non significa che la sitemap sia difettosa. Google può scegliere di non indicizzare alcune pagine per motivi di qualità o di contenuto duplicato. Questo divario è normale nella maggior parte dei siti, ma merita un’analisi pagina per pagina quando supera una proporzione significativa.
La pagina sitemap rimane un leva tecnica spesso sottoutilizzata. Non richiede né budget pubblicitari né competenze avanzate in sviluppo. Un file XML ben filtrato, date lastmod affidabili e una sottomissione nella Search Console sono sufficienti per orientare efficacemente il crawl di Google verso i vostri contenuti più utili.



