Primafonte

Lo stato della citabilità sul web

Ogni mese pubblichiamo che cosa trova Primafonte nei siti che analizza: quanti sono pronti per essere citati da un modello, quanti no e che cosa esattamente sbaglia più spesso.

Sono cifre aggregate di analisi reali. Non compare nessun sito preciso né il suo punteggio: ciò che si pubblica parla dell’insieme, non di qualcuno.

Campione

11 siti analizzati in settembre 2026, misurati con la metodologia 0.15.0 · soglie provvisorie.

Il campione di questo mese è ridotto: 11 siti. Le cifre sono analisi reali, senza alcuna stima, ma vanno lette per quello che sono — un piccolo conteggio — e non come lo stato del settore.

Le cifre sono raggruppate per versione di metodologia. I criteri sono cambiati nel tempo, quindi mescolare le versioni renderebbe il confronto fra mesi privo di significato.

Come si distribuiscono i punteggi?

I punteggi non si raggruppano per decine ma per ciò che significano: se un modello può usare quel sito come fonte, se lo trova ma non riesce a citarlo in modo affidabile, se funziona con angoli morti precisi, o se non ha ostacoli strutturali. La fascia pesa più del numero esatto.

Pronto — nessun ostacolo strutturale
7 · 64%
Citabile con lacune — funziona, con punti ciechi precisi
1 · 9%
Parzialmente leggibile — ti trovano, ma non riescono a citarti in modo affidabile
2 · 18%
Non citabile — i modelli non possono usare questo sito come fonte
1 · 9%

Che cosa viene bocciato di più

Percentuale di siti che non supera ciascuna verifica, calcolata solo su quelli che si sono potuti misurare. Ciò che resta senza esito è escluso, come nel punteggio.

Coerenza della descrizione
100% · 10/10
Recapiti leggibili
73% · 8/11
Dati nel contenuto
70% · 7/10
Titoli formulati come domanda
60% · 6/10
Link a fonti esterne
55% · 6/11
Firma dichiarata
55% · 6/11
Profili esterni dichiarati con sameAs
55% · 6/11
Elenchi e tabelle
36% · 4/11
Negoziazione di contenuto per Markdown
36% · 4/11
Data di pubblicazione e di revisione
36% · 4/11

Che cosa rispettano quasi tutti?

La maggior parte supera queste cinque, e vederle conta quanto vedere quelle bocciate: una verifica che passano tutti non distingue nessuno, e se una ci resta a lungo bisogna decidere se dà ancora qualcosa o se occupa soltanto un peso che starebbe meglio altrove.

Coerenza del nome del marchio
100% · 10/10
Stesso contenuto per i bot e per le persone
100% · 11/11
Il crawler non viene bloccato
100% · 11/11
Rapporto di rendering
100% · 11/11
Contenuto principale senza JavaScript
100% · 11/11

Di quali altri mesi ci sono dati?

Ogni mese si pubblica separatamente, con la versione di metodologia con cui è stato misurato. Le versioni non si mescolano mai: i criteri sono cambiati più volte, e unire mesi misurati con regole diverse darebbe una serie che non significa nulla, per quanto ordinata sembri.

Da dove escono queste cifre?

I numeri di questa pagina escono da analisi reali fatte con il motore documentato nella metodologia. Le norme e gli studi su cui quelle verifiche si costruiscono sono questi, e chiunque può controllarli per conto proprio.

  • GEO: Generative Engine Optimization

    Lo studio che ha misurato l’effetto di citare le fonti, fornire dati e aggiungere citazioni: fino al 40 % di visibilità in più nelle risposte.

  • schema.org

    Il vocabolario rispetto al quale si validano i dati strutturati, da cui vengono due delle verifiche qui contate.

  • RFC 9309

    La norma del robots.txt, da cui vengono le tre verifiche sui crawler.

  • llms.txt

    La convenzione del file indice per agenti, ancora senza specifica chiusa.

Studio di calibrazione

Oltre alle analisi richieste dalle persone, abbiamo misurato un campione nostro per calibrare le soglie della metodologia. Queste cifre vengono da lì e si pubblicano a parte, perché i siti li abbiamo scelti noi e questo cambia ciò che il dato significa.

321 domini di Spagna, Regno Unito, Stati Uniti e resto d’Europa, fra marchi, servizi e aziende di medie dimensioni, misurati il 4 agosto 2026 con la metodologia 0.7.0 · soglie provvisorie. Le cifre riguardano i 226 che si sono potuti misurare per intero.

In 51 non si è riusciti a entrare: il loro firewall ha interrotto l’analisi. È il 18 % dei tentativi arrivati da qualche parte. Altri 41 non hanno risposto o non avevano contenuti da analizzare.

61

Punteggio medio del campione

Come si distribuiscono i punteggi del campione?

Il campione è stato composto a mano, settore per settore, quindi questa distribuzione descrive questo insieme di siti e nessun altro. Non è una fotografia del web: è quella dei siti che abbiamo scelto per calibrare, che è cosa piuttosto diversa e conviene non confondere.

Pronto — nessun ostacolo strutturale
9 · 4%
Citabile con lacune — funziona, con punti ciechi precisi
124 · 55%
Parzialmente leggibile — ti trovano, ma non riescono a citarti in modo affidabile
80 · 35%
Non citabile — i modelli non possono usare questo sito come fonte
13 · 6%

Che cosa viene bocciato di più

Percentuale di siti che non supera ciascuna verifica, fra quelli che si sono potuti misurare. Accanto, quanti siti rientrano in quella percentuale.

Una posizione dichiarata verso i crawler che ti citano
97% · 215/222
Negoziazione di contenuto per Markdown
96% · 217/226
Risposte dirette dopo ogni titolo
95% · 194/204
Domande frequenti strutturate
94% · 212/226
Tipo di entità e di attività dichiarati
91% · 206/226
Intestazioni Link di scoperta
85% · 192/226
File llms.txt
82% · 182/222
Paragrafi che reggono fuori dal loro contesto
66% · 149/226

Che cosa rispetta quasi tutto il campione?

Queste sono le verifiche che quasi nessuno fallisce. Fanno da contrappeso all’elenco qui sopra: pubblicare solo ciò che fallisce dipingerebbe un quadro più nero del reale, e una metodologia che mostra soltanto le cattive notizie somiglia troppo a un argomento di vendita.

Il crawler non viene bloccato
100% · 226/226
Tempo al primo byte
95% · 215/226
I crawler che ti citano non sono bloccati
94% · 209/222
robots.txt raggiungibile e leggibile
91% · 202/222
Stesso contenuto per i bot e per le persone
88% · 172/195
Coerenza del nome del marchio
85% · 160/188
Pagina azienda o autore identificabile
80% · 181/226
Catena di reindirizzamenti pulita
79% · 179/226

Il campione è stato composto a mano, settore per settore, quindi non è rappresentativo del web in generale: descrive questo insieme di siti e nessun altro. L’elenco dei domini è pubblicato nel repository del progetto, e nessun dominio compare qui con il suo punteggio.