Quando un sito supera le venti pagine, trovare un’informazione precisa può a volte diventare un percorso ad ostacoli. La pagina sitemap, che sia in formato HTML o XML, offre una mappatura completa degli URL disponibili. Misurare la sua utilità implica distinguere ciò che apporta ai visitatori da ciò che apporta ai robot di indicizzazione, per poi verificare se i guadagni annunciati si traducono nei fatti.
Sitemap HTML e sitemap XML: cosa copre realmente ogni formato
I due formati condividono un nome, ma i loro destinatari e le loro funzioni divergono. Confrontare le loro caratteristiche permette di scegliere quale consultare o implementare in priorità.
| Critere | Sitemap HTML | Sitemap XML |
|---|---|---|
| Destinatario principale | Visitatore umano | Robot di motore di ricerca (Googlebot, Bingbot) |
| Formato | Pagina web classica con link cliccabili | File XML strutturato (tag <url>, <lastmod>) |
| Accesso abituale | Link nel piè di pagina o menu | Dichiarato nel file robots.txt o inviato tramite Search Console |
| Navigazione utente | Sì, navigazione diretta per clic | No, illeggibile senza strumento dedicato |
| Impatto SEO diretto | Indiretto (collegamenti interni, accessibilità) | Diretto (accelera il crawl e l’indicizzazione) |
| Conformità accessibilità (WCAG 2.4.5) | Riconosciuto come mezzo valido per offrire più percorsi di navigazione | Non pertinente |
Il sitemap XML rimane il file tecnico che Google consulta per scoprire nuovi URL o verificare le date di aggiornamento. Al contrario, il sitemap HTML si rivolge ai visitatori che cercano una panoramica del sito senza passare per il menu principale.
Per osservare un esempio concreto di pagina sitemap HTML, puoi visitare la pagina sitemap di Samh Web, che elenca i suoi contenuti in una struttura leggibile.
Accessibilità e navigazione: il sitemap HTML come requisito normativo

L’angolo dell’accessibilità è quello che la maggior parte degli articoli sui sitemap ignora, mentre condiziona la conformità legale di un sito in Europa.
Il criterio WCAG 2.4.5, intitolato “Multiple Ways”, richiede che un sito offra più di un modo per localizzare una pagina. Una barra di ricerca, un sommario, una mappa del sito: ciascuno di questi meccanismi conta. La pagina sitemap HTML è esplicitamente riconosciuta dai riferimenti WCAG come uno di questi mezzi validi.
Questa esigenza non è teorica. L’European Accessibility Act impone ai siti web di rispettare almeno il livello AA di WCAG 2.2. Un sitemap HTML ben strutturato, con link raggruppati sotto titoli gerarchici e un tag <nav> o una sezione chiaramente nominata, soddisfa questo obbligo.
Cosa cambia per gli utenti da tastiera e i lettori di schermo
Un menu a discesa a più livelli può diventare una trappola per un utente che naviga con la tastiera. Ogni sottomenù richiede combinazioni di tasti aggiuntive. Il sitemap HTML consente di aggirare questi menu complessi offrendo un elenco piatto di link.
I lettori di schermo sfruttano i landmarks e la navigazione per titoli per orientarsi. Una pagina sitemap correttamente contrassegnata diventa un punto di accesso rapido verso qualsiasi sezione del sito, senza dipendere dalla struttura del menu principale.
- Un sitemap HTML contrassegnato in
<nav>appare come un landmark identificabile dalle tecnologie assistive - I titoli gerarchici (H2, H3) consentono ai lettori di schermo di saltare direttamente a una categoria di contenuto
- L’elenco di link raggruppati riduce il numero di interazioni da tastiera necessarie per raggiungere una pagina profonda
Diagnosticare la copertura di un sito grazie al sitemap XML
Consultare il sitemap XML di un sito (spesso accessibile all’indirizzo /sitemap.xml) non serve solo ai robot. Per un webmaster o un SEO, questo file funziona come un inventario.
Confrontare il numero di URL del sitemap XML con il numero di pagine indicizzate in Google rivela scostamenti significativi. Se il sitemap dichiara diverse centinaia di pagine e l’indice Google ne trattiene solo una frazione, il problema si trova o nella qualità del contenuto, o in direttive di crawl contraddittorie (tag noindex, blocco nel file robots.txt).
Identificare le pagine orfane e i contenuti obsoleti
Una pagina assente dal sitemap XML ha meno probabilità di essere scoperta dai motori di ricerca, soprattutto se nessun link interno punta verso di essa. Queste sono le pagine orfane. Esaminare il sitemap consente di verificare che nessun URL strategico sia stato dimenticato.
Al contrario, un sitemap che fa riferimento a URL che restituiscono errori 404 o redirezioni invia un segnale negativo ai robot. Pulire regolarmente il sitemap XML dagli URL morti migliora l’efficacia del crawl.

- Verificare che ogni URL del sitemap restituisca un codice HTTP 200
- Assicurarsi che le pagine strategiche (pagine prodotto, articoli pilastri, pagine di servizio) siano presenti nel file
- Controllare il tag
<lastmod>per identificare i contenuti che non sono stati aggiornati da tempo
Sitemap e budget di crawl: un leva sottovalutata per i siti voluminosi
Su un piccolo sito di una decina di pagine, il sitemap XML ha solo un ruolo marginale. Google esplora l’intero contenuto tramite i link interni. La situazione cambia radicalmente per i siti che contano diverse migliaia di pagine.
I motori di ricerca assegnano un budget di crawl limitato a ciascun dominio. Il sitemap XML orienta questo budget verso le pagine prioritarie elencandole esplicitamente. Senza questo file, il robot può dedicare le sue risorse a esplorare pagine di scarso valore (pagine di filtri, duplicati di paginazione) a scapito dei contenuti strategici.
Il tag <priority> del sitemap XML consente di segnalare una gerarchia tra gli URL, anche se Google ha specificato che non la segue sistematicamente. Il tag <lastmod>, invece, attiva un recrawl più rapido quando riflette una data di modifica reale.
Un sito che aggiorna il suo sitemap XML a ogni pubblicazione e che rimuove gli URL obsoleti fornisce ai robot una mappa affidabile. Un sitemap aggiornato riduce lo spreco di crawl su pagine senza valore per il SEO.
La pagina sitemap, che sia HTML o XML, svolge quindi due funzioni distinte ma complementari. Il formato HTML risponde a un bisogno di navigazione umana e a obblighi di accessibilità misurabili, mentre il formato XML struttura la relazione tecnica tra un sito e i suoi motori di ricerca. Consultare entrambi fornisce una lettura completa della copertura e dell’architettura reale di un dominio.



