Primafonte

Estado de la citabilidad en la web

Cada mes publicamos qué encuentra Primafonte en las webs que analiza: cuántas están listas para ser citadas por un modelo, cuántas no, y qué es exactamente lo que más falla.

Son cifras agregadas de escaneos reales. No aparece ninguna web concreta ni su puntuación: lo que se publica habla del conjunto, no de nadie.

Muestra

15 webs analizadas en septiembre de 2026, medidas con la metodología 0.15.0 · umbrales provisionales.

La muestra de este mes es corta: 15 webs. Las cifras son escaneos reales, no hay ninguna estimación, pero conviene leerlas como lo que son —un recuento pequeño— y no como el estado del sector.

Las cifras se agrupan por versión de metodología. Los criterios han cambiado a lo largo del tiempo, así que mezclar versiones haría que la comparación entre meses no significara nada.

¿Cómo se reparten las notas?

Las notas no se agrupan por decenas sino por lo que significan: si un modelo puede usar esa web como fuente, si la encuentra pero no la cita con fiabilidad, si funciona con puntos ciegos concretos, o si no tiene bloqueos estructurales. La franja pesa más que el número exacto, porque es la que dice si hay algo que arreglar.

Preparada — sin bloqueos estructurales
8 · 53%
Citable con lagunas — funcionas, con puntos ciegos concretos
2 · 13%
Parcialmente legible — te encuentran, pero no pueden citarte con fiabilidad
4 · 27%
No citable — los modelos no pueden usar esta web como fuente
1 · 7%

Lo que más se suspende

Porcentaje de webs que no aprueba cada comprobación, calculado solo sobre las que se pudieron medir. Lo no concluyente se excluye, igual que en la puntuación.

Coherencia de la descripción
92% · 11/12
Datos en el contenido
71% · 10/14
Encabezados en forma de pregunta
71% · 10/14
Perfiles externos declarados con sameAs
67% · 10/15
Autoría declarada
60% · 9/15
Enlaces a fuentes externas
60% · 9/15
Datos de contacto legibles
53% · 8/15
Listas y tablas
47% · 7/15
Negociación de contenido en Markdown
47% · 7/15
Respuestas directas tras cada encabezado
43% · 6/14

¿Qué cumple casi todo el mundo?

Estas cinco las aprueba la mayoría, y verlas importa tanto como ver las que fallan: una comprobación que pasa todo el mundo no distingue a nadie, y si alguna se queda ahí mucho tiempo hay que decidir si sigue aportando o si solo está ocupando peso que le vendría mejor a otra.

Los rastreadores que citan no están bloqueados
100% · 15/15
Coherencia del nombre de marca
100% · 12/12
El rastreador no recibe un bloqueo
100% · 15/15
Mismo contenido para el bot y para una persona
100% · 15/15
Contenido principal sin JavaScript
100% · 15/15

¿De qué otros meses hay datos?

Cada mes se publica por separado y con la versión de metodología con la que se midió. No se mezclan versiones: los criterios han cambiado varias veces, y juntar meses medidos con reglas distintas daría una serie que no significa nada aunque quede más bonita.

¿De dónde salen estas cifras?

Los números de esta página salen de escaneos reales hechos con el motor que está documentado en la metodología. Las normas y estudios sobre los que se construyen esas comprobaciones son estos, y cualquiera puede contrastarlos por su cuenta.

  • GEO: Generative Engine Optimization

    El estudio que midió el efecto de citar fuentes, aportar datos y añadir citas: hasta un 40 % más de visibilidad en las respuestas.

  • schema.org

    El vocabulario contra el que se validan los datos estructurados, del que salen dos de las comprobaciones que aquí se cuentan.

  • RFC 9309

    La norma del robots.txt, de la que salen las tres comprobaciones de rastreadores.

  • llms.txt

    La convención del fichero índice para agentes, todavía sin especificación cerrada.

Estudio de calibración

Además de los escaneos que pide la gente, hemos medido una muestra propia para calibrar los umbrales de la metodología. Estas cifras salen de ahí y se publican aparte, porque las webs las elegimos nosotros y eso cambia lo que el dato significa.

321 dominios de España, Reino Unido, Estados Unidos y el resto de Europa, entre marcas, servicios y empresa mediana, medidos el 4 de agosto de 2026 con la metodología 0.7.0 · umbrales provisionales. Las cifras se calculan sobre los 226 que se pudieron medir enteros.

A 51 no se pudo entrar: su cortafuegos cortó el análisis. Es el 18% de los intentos que llegaron a alguna parte. Otros 41 no respondieron o no tenían contenido que analizar.

61

Puntuación media de la muestra

¿Cómo se reparten las notas de la muestra?

La muestra se compuso a mano, sector a sector, así que esta distribución describe a este conjunto de webs y a ningún otro. No es una foto del estado de la web: es la foto de las webs que elegimos para calibrar, que es una cosa bastante distinta y conviene no confundirlas.

Preparada — sin bloqueos estructurales
9 · 4%
Citable con lagunas — funcionas, con puntos ciegos concretos
124 · 55%
Parcialmente legible — te encuentran, pero no pueden citarte con fiabilidad
80 · 35%
No citable — los modelos no pueden usar esta web como fuente
13 · 6%

Lo que más se suspende

Porcentaje de webs que no aprueba cada comprobación, sobre las que se pudieron medir. Al lado, cuántas webs entran en ese porcentaje.

Postura declarada ante los rastreadores que citan
97% · 215/222
Negociación de contenido en Markdown
96% · 217/226
Respuestas directas tras cada encabezado
95% · 194/204
Preguntas frecuentes estructuradas
94% · 212/226
Tipos de entidad y de negocio declarados
91% · 206/226
Cabeceras Link de descubrimiento
85% · 192/226
Fichero llms.txt
82% · 182/222
Párrafos que se sostienen fuera de contexto
66% · 149/226

¿Qué cumple casi toda la muestra?

Estas son las comprobaciones que casi nadie suspende. Sirven de contrapeso a la lista de arriba: si solo se publicara lo que falla, el retrato saldría más negro de lo que es, y una metodología que solo enseña lo malo se parece demasiado a un argumento de venta.

El rastreador no recibe un bloqueo
100% · 226/226
Tiempo hasta el primer byte
95% · 215/226
Los rastreadores que citan no están bloqueados
94% · 209/222
robots.txt accesible y parseable
91% · 202/222
Mismo contenido para el bot y para una persona
88% · 172/195
Coherencia del nombre de marca
85% · 160/188
Página identificable de empresa o autor
80% · 181/226
Cadena de redirecciones limpia
79% · 179/226

La muestra se compuso a mano, sector a sector, así que no es representativa de la web en general: describe a este conjunto de webs y a ningún otro. La lista de dominios está publicada en el repositorio del proyecto, y ningún dominio aparece aquí con su puntuación.