Lo stato della citabilità sul web
Ogni mese pubblichiamo che cosa trova Primafonte nei siti che analizza: quanti sono pronti per essere citati da un modello, quanti no e che cosa esattamente sbaglia più spesso.
Sono cifre aggregate di analisi reali. Non compare nessun sito preciso né il suo punteggio: ciò che si pubblica parla dell’insieme, non di qualcuno.
Campione
11 siti analizzati in settembre 2026, misurati con la metodologia 0.15.0 · soglie provvisorie.
Il campione di questo mese è ridotto: 11 siti. Le cifre sono analisi reali, senza alcuna stima, ma vanno lette per quello che sono — un piccolo conteggio — e non come lo stato del settore.
Le cifre sono raggruppate per versione di metodologia. I criteri sono cambiati nel tempo, quindi mescolare le versioni renderebbe il confronto fra mesi privo di significato.
Come si distribuiscono i punteggi?
I punteggi non si raggruppano per decine ma per ciò che significano: se un modello può usare quel sito come fonte, se lo trova ma non riesce a citarlo in modo affidabile, se funziona con angoli morti precisi, o se non ha ostacoli strutturali. La fascia pesa più del numero esatto.
- Pronto — nessun ostacolo strutturale
- 7 · 64%
- Citabile con lacune — funziona, con punti ciechi precisi
- 1 · 9%
- Parzialmente leggibile — ti trovano, ma non riescono a citarti in modo affidabile
- 2 · 18%
- Non citabile — i modelli non possono usare questo sito come fonte
- 1 · 9%
Che cosa viene bocciato di più
Percentuale di siti che non supera ciascuna verifica, calcolata solo su quelli che si sono potuti misurare. Ciò che resta senza esito è escluso, come nel punteggio.
- Coerenza della descrizione
- 100% · 10/10
- Recapiti leggibili
- 73% · 8/11
- Dati nel contenuto
- 70% · 7/10
- Titoli formulati come domanda
- 60% · 6/10
- Link a fonti esterne
- 55% · 6/11
- Firma dichiarata
- 55% · 6/11
- Profili esterni dichiarati con sameAs
- 55% · 6/11
- Elenchi e tabelle
- 36% · 4/11
- Negoziazione di contenuto per Markdown
- 36% · 4/11
- Data di pubblicazione e di revisione
- 36% · 4/11
Che cosa rispettano quasi tutti?
La maggior parte supera queste cinque, e vederle conta quanto vedere quelle bocciate: una verifica che passano tutti non distingue nessuno, e se una ci resta a lungo bisogna decidere se dà ancora qualcosa o se occupa soltanto un peso che starebbe meglio altrove.
- Coerenza del nome del marchio
- 100% · 10/10
- Stesso contenuto per i bot e per le persone
- 100% · 11/11
- Il crawler non viene bloccato
- 100% · 11/11
- Rapporto di rendering
- 100% · 11/11
- Contenuto principale senza JavaScript
- 100% · 11/11
Di quali altri mesi ci sono dati?
Ogni mese si pubblica separatamente, con la versione di metodologia con cui è stato misurato. Le versioni non si mescolano mai: i criteri sono cambiati più volte, e unire mesi misurati con regole diverse darebbe una serie che non significa nulla, per quanto ordinata sembri.
Da dove escono queste cifre?
I numeri di questa pagina escono da analisi reali fatte con il motore documentato nella metodologia. Le norme e gli studi su cui quelle verifiche si costruiscono sono questi, e chiunque può controllarli per conto proprio.
- GEO: Generative Engine Optimization
Lo studio che ha misurato l’effetto di citare le fonti, fornire dati e aggiungere citazioni: fino al 40 % di visibilità in più nelle risposte.
- schema.org
Il vocabolario rispetto al quale si validano i dati strutturati, da cui vengono due delle verifiche qui contate.
- RFC 9309
La norma del robots.txt, da cui vengono le tre verifiche sui crawler.
- llms.txt
La convenzione del file indice per agenti, ancora senza specifica chiusa.
Studio di calibrazione
Oltre alle analisi richieste dalle persone, abbiamo misurato un campione nostro per calibrare le soglie della metodologia. Queste cifre vengono da lì e si pubblicano a parte, perché i siti li abbiamo scelti noi e questo cambia ciò che il dato significa.
321 domini di Spagna, Regno Unito, Stati Uniti e resto d’Europa, fra marchi, servizi e aziende di medie dimensioni, misurati il 4 agosto 2026 con la metodologia 0.7.0 · soglie provvisorie. Le cifre riguardano i 226 che si sono potuti misurare per intero.
In 51 non si è riusciti a entrare: il loro firewall ha interrotto l’analisi. È il 18 % dei tentativi arrivati da qualche parte. Altri 41 non hanno risposto o non avevano contenuti da analizzare.
61
Punteggio medio del campione
Come si distribuiscono i punteggi del campione?
Il campione è stato composto a mano, settore per settore, quindi questa distribuzione descrive questo insieme di siti e nessun altro. Non è una fotografia del web: è quella dei siti che abbiamo scelto per calibrare, che è cosa piuttosto diversa e conviene non confondere.
- Pronto — nessun ostacolo strutturale
- 9 · 4%
- Citabile con lacune — funziona, con punti ciechi precisi
- 124 · 55%
- Parzialmente leggibile — ti trovano, ma non riescono a citarti in modo affidabile
- 80 · 35%
- Non citabile — i modelli non possono usare questo sito come fonte
- 13 · 6%
Che cosa viene bocciato di più
Percentuale di siti che non supera ciascuna verifica, fra quelli che si sono potuti misurare. Accanto, quanti siti rientrano in quella percentuale.
- Una posizione dichiarata verso i crawler che ti citano
- 97% · 215/222
- Negoziazione di contenuto per Markdown
- 96% · 217/226
- Risposte dirette dopo ogni titolo
- 95% · 194/204
- Domande frequenti strutturate
- 94% · 212/226
- Tipo di entità e di attività dichiarati
- 91% · 206/226
- Intestazioni Link di scoperta
- 85% · 192/226
- File llms.txt
- 82% · 182/222
- Paragrafi che reggono fuori dal loro contesto
- 66% · 149/226
Che cosa rispetta quasi tutto il campione?
Queste sono le verifiche che quasi nessuno fallisce. Fanno da contrappeso all’elenco qui sopra: pubblicare solo ciò che fallisce dipingerebbe un quadro più nero del reale, e una metodologia che mostra soltanto le cattive notizie somiglia troppo a un argomento di vendita.
- Il crawler non viene bloccato
- 100% · 226/226
- Tempo al primo byte
- 95% · 215/226
- I crawler che ti citano non sono bloccati
- 94% · 209/222
- robots.txt raggiungibile e leggibile
- 91% · 202/222
- Stesso contenuto per i bot e per le persone
- 88% · 172/195
- Coerenza del nome del marchio
- 85% · 160/188
- Pagina azienda o autore identificabile
- 80% · 181/226
- Catena di reindirizzamenti pulita
- 79% · 179/226
Il campione è stato composto a mano, settore per settore, quindi non è rappresentativo del web in generale: descrive questo insieme di siti e nessun altro. L’elenco dei domini è pubblicato nel repository del progetto, e nessun dominio compare qui con il suo punteggio.