Estado de la citabilidad en la web
Cada mes publicamos qué encuentra Primafonte en las webs que analiza: cuántas están listas para ser citadas por un modelo, cuántas no, y qué es exactamente lo que más falla.
Son cifras agregadas de escaneos reales. No aparece ninguna web concreta ni su puntuación: lo que se publica habla del conjunto, no de nadie.
Muestra
15 webs analizadas en septiembre de 2026, medidas con la metodología 0.15.0 · umbrales provisionales.
La muestra de este mes es corta: 15 webs. Las cifras son escaneos reales, no hay ninguna estimación, pero conviene leerlas como lo que son —un recuento pequeño— y no como el estado del sector.
Las cifras se agrupan por versión de metodología. Los criterios han cambiado a lo largo del tiempo, así que mezclar versiones haría que la comparación entre meses no significara nada.
¿Cómo se reparten las notas?
Las notas no se agrupan por decenas sino por lo que significan: si un modelo puede usar esa web como fuente, si la encuentra pero no la cita con fiabilidad, si funciona con puntos ciegos concretos, o si no tiene bloqueos estructurales. La franja pesa más que el número exacto, porque es la que dice si hay algo que arreglar.
- Preparada — sin bloqueos estructurales
- 8 · 53%
- Citable con lagunas — funcionas, con puntos ciegos concretos
- 2 · 13%
- Parcialmente legible — te encuentran, pero no pueden citarte con fiabilidad
- 4 · 27%
- No citable — los modelos no pueden usar esta web como fuente
- 1 · 7%
Lo que más se suspende
Porcentaje de webs que no aprueba cada comprobación, calculado solo sobre las que se pudieron medir. Lo no concluyente se excluye, igual que en la puntuación.
- Coherencia de la descripción
- 92% · 11/12
- Encabezados en forma de pregunta
- 71% · 10/14
- Datos en el contenido
- 71% · 10/14
- Perfiles externos declarados con sameAs
- 67% · 10/15
- Enlaces a fuentes externas
- 60% · 9/15
- Autoría declarada
- 60% · 9/15
- Datos de contacto legibles
- 53% · 8/15
- Listas y tablas
- 47% · 7/15
- Negociación de contenido en Markdown
- 47% · 7/15
- Respuestas directas tras cada encabezado
- 43% · 6/14
¿Qué cumple casi todo el mundo?
Estas cinco las aprueba la mayoría, y verlas importa tanto como ver las que fallan: una comprobación que pasa todo el mundo no distingue a nadie, y si alguna se queda ahí mucho tiempo hay que decidir si sigue aportando o si solo está ocupando peso que le vendría mejor a otra.
- Contenido principal sin JavaScript
- 100% · 15/15
- Ratio de renderizado
- 100% · 15/15
- Mismo contenido para el bot y para una persona
- 100% · 15/15
- El rastreador no recibe un bloqueo
- 100% · 15/15
- Coherencia del nombre de marca
- 100% · 12/12
¿De qué otros meses hay datos?
Cada mes se publica por separado y con la versión de metodología con la que se midió. No se mezclan versiones: los criterios han cambiado varias veces, y juntar meses medidos con reglas distintas daría una serie que no significa nada aunque quede más bonita.
¿De dónde salen estas cifras?
Los números de esta página salen de escaneos reales hechos con el motor que está documentado en la metodología. Las normas y estudios sobre los que se construyen esas comprobaciones son estos, y cualquiera puede contrastarlos por su cuenta.
- GEO: Generative Engine Optimization
El estudio que midió el efecto de citar fuentes, aportar datos y añadir citas: hasta un 40 % más de visibilidad en las respuestas.
- schema.org
El vocabulario contra el que se validan los datos estructurados, del que salen dos de las comprobaciones que aquí se cuentan.
- RFC 9309
La norma del robots.txt, de la que salen las tres comprobaciones de rastreadores.
- llms.txt
La convención del fichero índice para agentes, todavía sin especificación cerrada.
Estudio de calibración
Además de los escaneos que pide la gente, hemos medido una muestra propia para calibrar los umbrales de la metodología. Estas cifras salen de ahí y se publican aparte, porque las webs las elegimos nosotros y eso cambia lo que el dato significa.
321 dominios de España, Reino Unido, Estados Unidos y el resto de Europa, entre marcas, servicios y empresa mediana, medidos el 4 de agosto de 2026 con la metodología 0.7.0 · umbrales provisionales. Las cifras se calculan sobre los 226 que se pudieron medir enteros.
A 51 no se pudo entrar: su cortafuegos cortó el análisis. Es el 18% de los intentos que llegaron a alguna parte. Otros 41 no respondieron o no tenían contenido que analizar.
61
Puntuación media de la muestra
¿Cómo se reparten las notas de la muestra?
La muestra se compuso a mano, sector a sector, así que esta distribución describe a este conjunto de webs y a ningún otro. No es una foto del estado de la web: es la foto de las webs que elegimos para calibrar, que es una cosa bastante distinta y conviene no confundirlas.
- Preparada — sin bloqueos estructurales
- 9 · 4%
- Citable con lagunas — funcionas, con puntos ciegos concretos
- 124 · 55%
- Parcialmente legible — te encuentran, pero no pueden citarte con fiabilidad
- 80 · 35%
- No citable — los modelos no pueden usar esta web como fuente
- 13 · 6%
Lo que más se suspende
Porcentaje de webs que no aprueba cada comprobación, sobre las que se pudieron medir. Al lado, cuántas webs entran en ese porcentaje.
- Postura declarada ante los rastreadores que citan
- 97% · 215/222
- Negociación de contenido en Markdown
- 96% · 217/226
- Respuestas directas tras cada encabezado
- 95% · 194/204
- Preguntas frecuentes estructuradas
- 94% · 212/226
- Tipos de entidad y de negocio declarados
- 91% · 206/226
- Cabeceras Link de descubrimiento
- 85% · 192/226
- Fichero llms.txt
- 82% · 182/222
- Párrafos que se sostienen fuera de contexto
- 66% · 149/226
¿Qué cumple casi toda la muestra?
Estas son las comprobaciones que casi nadie suspende. Sirven de contrapeso a la lista de arriba: si solo se publicara lo que falla, el retrato saldría más negro de lo que es, y una metodología que solo enseña lo malo se parece demasiado a un argumento de venta.
- El rastreador no recibe un bloqueo
- 100% · 226/226
- Tiempo hasta el primer byte
- 95% · 215/226
- Los rastreadores que citan no están bloqueados
- 94% · 209/222
- robots.txt accesible y parseable
- 91% · 202/222
- Mismo contenido para el bot y para una persona
- 88% · 172/195
- Coherencia del nombre de marca
- 85% · 160/188
- Página identificable de empresa o autor
- 80% · 181/226
- Cadena de redirecciones limpia
- 79% · 179/226
La muestra se compuso a mano, sector a sector, así que no es representativa de la web en general: describe a este conjunto de webs y a ningún otro. La lista de dominios está publicada en el repositorio del proyecto, y ningún dominio aparece aquí con su puntuación.