L’état de la citabilité sur le web
Chaque mois, nous publions ce que Primafonte trouve sur les sites qu’il analyse : combien sont prêts à être cités par un modèle, combien ne le sont pas, et ce qui échoue exactement le plus souvent.
Ce sont des chiffres agrégés d’analyses réelles. Aucun site précis ni aucun score individuel n’y figure : ce qui est publié parle de l’ensemble, de personne en particulier.
Échantillon
11 sites analysés en septembre 2026, mesurés avec la méthodologie 0.15.0 · seuils provisoires.
L’échantillon de ce mois est court : 11 sites. Les chiffres sont des analyses réelles, sans aucune estimation, mais il faut les lire pour ce qu’ils sont — un petit décompte — et non comme l’état du secteur.
Les chiffres sont regroupés par version de méthodologie. Les critères ont changé au fil du temps : mélanger les versions ferait que la comparaison entre mois ne voudrait plus rien dire.
Comment se répartissent les scores ?
Les scores ne sont pas groupés par dizaines mais selon ce qu’ils signifient : si un modèle peut utiliser ce site comme source, s’il le trouve mais ne peut pas le citer de façon fiable, s’il fonctionne avec des angles morts précis, ou s’il n’a aucun blocage structurel. La tranche pèse davantage que le chiffre exact.
- Prêt — aucun blocage structurel
- 7 · 64%
- Citable avec des lacunes — cela fonctionne, avec des angles morts précis
- 1 · 9%
- Partiellement lisible — ils vous trouvent, mais ne peuvent pas vous citer de façon fiable
- 2 · 18%
- Non citable — les modèles ne peuvent pas utiliser ce site comme source
- 1 · 9%
Ce qui échoue le plus
Pourcentage de sites qui ne réussissent pas chaque vérification, calculé uniquement sur ceux qui ont pu être mesurés. Ce qui reste sans conclusion est exclu, comme dans le score.
- Cohérence de la description
- 100% · 10/10
- Coordonnées lisibles
- 73% · 8/11
- Données dans le contenu
- 70% · 7/10
- Titres formulés en question
- 60% · 6/10
- Profils externes déclarés avec sameAs
- 55% · 6/11
- Signature déclarée
- 55% · 6/11
- Liens vers des sources externes
- 55% · 6/11
- Négociation de contenu pour Markdown
- 36% · 4/11
- Listes et tableaux
- 36% · 4/11
- Date de publication et de révision
- 36% · 4/11
Que réussit presque tout le monde ?
La plupart réussissent ces cinq-là, et les voir importe autant que voir les échecs : une vérification que tout le monde réussit ne distingue personne, et si l’une y reste longtemps, il faut décider si elle apporte encore quelque chose ou si elle occupe seulement un poids qui servirait mieux ailleurs.
- Les robots qui vous citent ne sont pas bloqués
- 100% · 11/11
- Contenu principal sans JavaScript
- 100% · 11/11
- Hiérarchie des titres
- 100% · 11/11
- Le robot n’est pas bloqué
- 100% · 11/11
- Cohérence du nom de marque
- 100% · 10/10
Pour quels autres mois y a-t-il des données ?
Chaque mois est publié séparément, avec la version de méthodologie sous laquelle il a été mesuré. Les versions ne se mélangent jamais : les critères ont changé plusieurs fois, et réunir des mois mesurés selon des règles différentes donnerait une série qui ne veut rien dire, si soignée soit-elle.
D’où viennent ces chiffres ?
Les nombres de cette page proviennent d’analyses réelles menées par le moteur documenté dans la méthodologie. Les normes et études sur lesquelles ces vérifications reposent sont les suivantes, et chacun peut les contrôler de son côté.
- GEO: Generative Engine Optimization
L’étude qui a mesuré l’effet de citer ses sources, de fournir des données et d’ajouter des citations : jusqu’à 40 % de visibilité en plus dans les réponses.
- schema.org
Le vocabulaire au regard duquel les données structurées sont validées, dont proviennent deux des vérifications comptées ici.
- RFC 9309
La norme robots.txt, dont proviennent les trois vérifications de robots.
- llms.txt
La convention du fichier sommaire pour agents, encore sans spécification arrêtée.
Étude de calibration
En plus des analyses demandées par les visiteurs, nous avons mesuré un échantillon à nous pour calibrer les seuils de la méthodologie. Ces chiffres en proviennent et sont publiés à part, parce que c’est nous qui avons choisi les sites, et cela change ce que la donnée signifie.
321 domaines d’Espagne, du Royaume-Uni, des États-Unis et du reste de l’Europe, entre marques, services et entreprises de taille moyenne, mesurés le 4 août 2026 avec la méthodologie 0.7.0 · seuils provisoires. Les chiffres portent sur les 226 qui ont pu être mesurés en entier.
51 n’ont pas pu être ouverts : leur pare-feu a coupé l’analyse. C’est 18 % des tentatives qui ont abouti à quelque chose. 41 autres n’ont pas répondu ou n’avaient aucun contenu à analyser.
61
Score moyen de l’échantillon
Comment se répartissent les scores de l’échantillon ?
L’échantillon a été composé à la main, secteur par secteur : cette répartition décrit donc cet ensemble de sites et aucun autre. Ce n’est pas une photographie du web, mais celle des sites que nous avons choisis pour calibrer, ce qui est assez différent et vaut la peine de ne pas confondre.
- Prêt — aucun blocage structurel
- 9 · 4%
- Citable avec des lacunes — cela fonctionne, avec des angles morts précis
- 124 · 55%
- Partiellement lisible — ils vous trouvent, mais ne peuvent pas vous citer de façon fiable
- 80 · 35%
- Non citable — les modèles ne peuvent pas utiliser ce site comme source
- 13 · 6%
Ce qui échoue le plus
Pourcentage de sites qui ne réussissent pas chaque vérification, parmi ceux qui ont pu être mesurés. À côté, combien de sites entrent dans ce pourcentage.
- Une position déclarée envers les robots qui vous citent
- 97% · 215/222
- Négociation de contenu pour Markdown
- 96% · 217/226
- Réponses directes après chaque titre
- 95% · 194/204
- Questions fréquentes structurées
- 94% · 212/226
- Type d’entité et type d’activité déclarés
- 91% · 206/226
- En-têtes Link de découverte
- 85% · 192/226
- Fichier llms.txt
- 82% · 182/222
- Paragraphes qui tiennent hors de leur contexte
- 66% · 149/226
Que réussit presque tout l’échantillon ?
Voici les vérifications que presque personne n’échoue. Elles font contrepoids à la liste ci-dessus : ne publier que ce qui échoue peindrait un tableau plus sombre que la réalité, et une méthodologie qui ne montre que les mauvaises nouvelles ressemble trop à un argument de vente.
- Le robot n’est pas bloqué
- 100% · 226/226
- Temps jusqu’au premier octet
- 95% · 215/226
- Les robots qui vous citent ne sont pas bloqués
- 94% · 209/222
- robots.txt accessible et lisible
- 91% · 202/222
- Même contenu pour les robots et pour les humains
- 88% · 172/195
- Cohérence du nom de marque
- 85% · 160/188
- Page entreprise ou auteur identifiable
- 80% · 181/226
- Chaîne de redirections propre
- 79% · 179/226
L’échantillon a été composé à la main, secteur par secteur : il n’est donc pas représentatif du web en général et ne décrit que cet ensemble de sites. La liste des domaines est publiée dans le dépôt du projet, et aucun domaine n’apparaît ici avec son score.