Cada versión dice qué se movió y por qué, casi siempre con la cifra que lo motivó delante. Las puntuaciones antiguas no se recalculan nunca: un informe describe cómo estaba esa web el día que se midió, con los criterios de aquel día, y por eso cada uno lleva impresa su versión.
0.15.0 · 2026-09-05
El motor distinguía mal dos cosas que no se parecen: no haber podido leer un fichero y haberlo leído y comprobado que no está. Un 404 es un hecho del que se deduce algo —si no hay robots.txt, no se bloquea a nadie— y ahí la comprobación debe decidir. Un 401, un 403 o un 429 dicen lo contrario: el fichero existe y no nos dejan verlo. Ese caso vivía junto al 404 por una comparación con doscientos que se comía la diferencia, y producía las dos mentiras a la vez. A una web protegida por un cortafuegos de aplicaciones se le decía que no tiene un robots.txt legible, que su sitemap no está declarado, que no publica un llms.txt y que no responde a la negociación de Markdown: cuatro afirmaciones sobre ficheros que existen y funcionan. Y al mismo tiempo se le aprobaba que su robots.txt no bloquea a ningún rastreador de respuesta, que es un aprobado sobre un fichero que nunca se llegó a leer. En la muestra de calibración le ocurre a cincuenta de doscientas noventa y nueve webs, una de cada seis. Desde esta versión esos tres códigos dejan sin concluir a las cinco comprobaciones que los sufrían, y quien informa del bloqueo sigue siendo la comprobación que existe para eso. Se corrige además el título de la cadena de redirecciones, que hablaba siempre de saltos: una web bloqueada leía «llegar a la home cuesta 0 saltos de redirección», el óptimo presentado como defecto. Las ramas que no van de saltos —el estado de la respuesta y el destino que acaba en http— llevan ahora su propio texto. Las puntuaciones anteriores no se recalculan.
0.14.0 · 2026-08-19
Dos comprobaciones dejan de castigar al chino, al japonés y al coreano por escribir más denso. La primera: los encabezados escritos como pregunta no se reconocían, porque esas lenguas cierran con «?», el signo de ancho completo, y solo se buscaba el de teclado latino. En nuestra propia página de metodología en chino daban cero de cuarenta y uno, con todos los encabezados de sección escritos como pregunta. La segunda: las franjas de longitud del título y de la descripción están calibradas sobre alfabeto latino, treinta a sesenta caracteres y ciento diez a ciento sesenta, y existen porque el buscador trunca por ancho. Un carácter chino ocupa el doble que una letra latina y dice bastante más: el título de esa misma página son veintidós caracteres y transmite lo mismo que los cincuenta del español, así que suspendía por decirlo en menos sitio. En esas escrituras las franjas pasan a la mitad. Fuera de ellas no cambia absolutamente nada, y la calibración sobre la muestra de 299 dominios europeos y americanos se ejecutó precisamente para comprobarlo. Las puntuaciones anteriores no se recalculan.
0.13.0 · 2026-08-18
Dos arreglos en la elección de la página interior, de la que dependen cinco comprobaciones a la vez. El primero: «www.ejemplo.com» y «ejemplo.com» son el mismo sitio, y el motor los trataba como orígenes distintos. En ruanyifeng.com, un blog técnico chino, los dieciocho enlaces a artículos de su propio índice apuntan a «http://www.ruanyifeng.com/blog/...»; escaneando el dominio sin «www» se descartaban los dieciocho, no quedaba ni un artículo entre los candidatos y las comprobaciones de contenido acababan midiendo una lista de titulares. El segundo: si la página elegida resulta ser un índice de sección, ahora se baja una sola vez a su primer artículo. Un salto y no varios, porque esa descarga es secuencial y sale del mismo presupuesto de tiempo que el resto del escaneo; si el salto no trae nada mejor, se conserva el índice, porque medir algo peor es preferible a no medir nada. La elección sigue siendo determinista: el mismo sitio da siempre la misma página, o la puntuación dejaría de ser reproducible. Queda sin resolver el caso de que la página elegida esté en otro idioma que el resto del sitio. Las puntuaciones anteriores no se recalculan.
0.12.0 · 2026-08-18
La comprobación de párrafos que se sostienen fuera de su contexto dejaba en suspenso a casi cualquier web en español. Detectaba si el párrafo depende del anterior buscando pronombres y deícticos, pero la lista incluía «la», «los» y «las», que son artículos y no deícticos, y los buscaba en cualquier posición de la primera frase en vez de al principio. Con eso, «Los umbrales se calibraron midiendo una muestra propia» salía marcado como dependiente. Un deíctico a mitad de frase suele tener su antecedente dentro de esa misma frase, así que está ligado; el que deja al párrafo colgando es el que abre. Ahora solo cuenta el arranque, y solo con las formas inequívocamente pronominales: «esto», «eso», «ello», «it», «lo anterior» y las anáforas explícitas. «Este» y «this» quedan fuera a propósito, porque valen igual de pronombre que de determinante y sin análisis morfológico no se distinguen: ante la duda no se penaliza, que es la regla declarada de esta capa. La corrección publicada ya describía este comportamiento; el código no lo hacía. Las puntuaciones anteriores no se recalculan, así que la cifra de esta comprobación en el estudio de calibración corresponde al criterio viejo.
0.11.0 · 2026-08-18
El motor cuenta palabras de verdad en chino, japonés y coreano. Esas lenguas no separan las palabras con espacios, y el motor las contaba partiendo por espacios: sobre cinco artículos reales de un blog técnico chino, de 1.579 párrafos pasaban el filtro de veinte palabras exactamente 2. Contándolos bien, 560. Eso dejaba a cualquier web china, japonesa o coreana sin nada que medir en los párrafos que se sostienen fuera de contexto y en los datos del contenido, y con las respuestas directas suspensas aunque respondieran al encabezado a la perfección. La cabecera del propio módulo declaraba que el sesgo de idioma va siempre en la misma dirección, ante la duda no se penaliza, y ahí iba justo en la contraria. Se cuenta con el segmentador de palabras del sistema, que segmenta esas lenguas de verdad, en lugar de con una constante de conversión inventada. Fuera de esas escrituras el conteo es idéntico al anterior, carácter por carácter: la puntuación de una web en español, inglés, alemán, francés, italiano o portugués no se mueve ni un punto, y hay un test que lo comprueba contra todo el texto publicado del sitio. Las puntuaciones anteriores no se recalculan.
0.10.0 · 2026-08-06
Cinco comprobaciones nuevas y un cambio en qué página se mide. Dos de las cinco salen de lo único que está medido con rigor en esta materia: el estudio original sobre optimización para motores generativos encontró que citar fuentes, aportar datos y añadir citas textuales puede subir la visibilidad en las respuestas hasta un 40 %. De ahí vienen los enlaces a fuentes externas, que cuenta a cuántos dominios ajenos enlaza el contenido, y los datos en el contenido, que mira qué proporción de los párrafos aporta una cifra concreta. Las otras tres salen de recomendaciones publicadas: listas y tablas, que son fragmentos que vienen troceados de fábrica; la fecha de publicación y revisión declarada en datos estructurados; y la autoría, que pesa poco a propósito porque su evidencia es de casos observados y no de medición. Además cambia la elección de la página interior que se mide: un artículo pasa por delante de una página institucional. Salió de comprobar que en Xataka se estaba midiendo la página del equipo, hecha de biografías, donde las comprobaciones de contenido daban cero sobre sesenta y nueve párrafos. No era que Xataka escribiera mal, era que le mirábamos la página equivocada. Las comprobaciones que puntúan pasan de 28 a 33. Las puntuaciones anteriores no se recalculan.
0.9.0 · 2026-08-06
La coherencia de la descripción deja de comparar la de quien publica la web con la de la web. Una Organization describe al editor por definición de schema.org, y en una empresa con varias líneas de negocio no tiene por qué parecerse a la página: compararlas obligaba a poner una descripción falsa en una de las dos, o la empresa descrita como si fuera el producto, o al revés. Ahora se compara con la descripción de la entidad que dice qué ofrece la web —SoftwareApplication, Product, Service, Article y sus afines— y solo se recurre a la del editor cuando no hay ninguna, que es el caso de la web de una empresa sin producto, donde la descripción de la empresa sí es la de la página. El arreglo no es una amnistía: una descripción de producto que contradice a la página sigue suspendiendo, y también dos metadescripciones divergentes entre sí, que era el caso que la comprobación ya cazaba bien. Las puntuaciones anteriores no se recalculan.
0.8.0 · 2026-08-05
Entra una comprobación nueva: si los encabezados están escritos como preguntas. Ya se comprobaba que debajo de cada encabezado hubiera una respuesta de 40 a 80 palabras que se sostuviera sola, pero no que el encabezado se pareciera a lo que alguien teclea. La unidad que un sistema de recuperación prefiere es el par completo —pregunta reconocible arriba, respuesta autocontenida debajo— y de ese par solo se medía la mitad. Se mide en la misma página interior que las respuestas directas, porque medirlas en páginas distintas describiría dos sitios y ningún par. Cuenta como pregunta la que lleva signo de interrogación y también la que empieza por un interrogativo acentuado, porque en español la tilde es justo lo que separa el interrogativo del relativo: cómo funciona pregunta, como director no. Los umbrales son de partida y se revisarán con la muestra de calibración. Las comprobaciones que puntúan pasan de 27 a 28. Las puntuaciones anteriores no se recalculan.
0.7.0 · 2026-08-04
Los encabezados del pie de página, la navegación y las barras laterales dejan de contarse como contenido. Medir una muestra de webs reales enseñó que el 43 % de los encabezados vivía dentro de <footer> o <nav> —en HubSpot el 81 %, en Mailchimp el 53 %—, y todos entraban en el recuento. Un <h2>Servicios</h2> de pie no lleva un párrafo debajo porque no debe llevarlo, así que su presencia hacía suspender las respuestas directas a cualquier web con un pie normal: la comprobación la aprobaba el 5 %, y la causa no era cómo escribe la gente sino cómo contábamos nosotros. Afecta a las respuestas directas, la jerarquía de encabezados y la detección de preguntas frecuentes, y las tres ganan precisión. El H1 de la cabecera se sigue contando: muchas webs lo colocan ahí. Las puntuaciones anteriores no se recalculan.
0.6.0 · 2026-08-04
Primera versión calibrada contra una muestra grande: 299 webs de España, Reino Unido, Estados Unidos y el resto de Europa, entre marcas, servicios y empresa mediana. Tres cambios salen de esos datos. Las dos comprobaciones de datos estructurados se fusionan en una: la de validez aprobaba al 95 % de quienes llegaban a ella y no se aplicaba al 26 % restante, porque el JSON-LD casi nunca se escribe a mano y lo que genera un plugin rara vez está roto; ahora una sola comprobación distingue no tenerlos, tenerlos rotos y tenerlos bien, con el mismo peso. Los párrafos que se sostienen fuera de contexto pasan a medirse en una página interior, como ya se hacía con las respuestas directas: en la portada no había tres párrafos de veinte palabras en 78 de las 215 webs medidas enteras, y sin ninguna página legible con contenido la comprobación ahora suspende en lugar de callarse. Y el sello descargable baja de 80 a 70 puntos: a 80 lo alcanzaban 6 de 215 webs, un sello que casi nadie puede poner en su web no circula. Las comprobaciones puntuables pasan de 28 a 27. Las puntuaciones anteriores no se recalculan.
0.5.0 · 2026-08-04
Dos comprobaciones dejan de declararse incapaces cuando en realidad pueden decidir. No tener un bloque de preguntas frecuentes marcado como FAQPage pasa a SUSPENDER en lugar de quedar sin aplicar: es lo que más citan los modelos generativos, así que quien no lo tiene está peor preparado para que lo citen que quien sí, y repartir su peso entre las demás afirmaba lo contrario. Tener las preguntas a la vista sin marcarlas cumple a medias, porque eso se arregla en diez minutos y escribirlas de cero no. Y un sitio sin sitemap accesible pasa a suspender la comprobación de frescura en lugar de quedar sin concluir, incluido el caso del servidor que responde 200 con la portada en HTML ante /sitemap.xml, que es lo que hacen los frameworks de página única. Solo se mantiene el no concluyente cuando de verdad no se sabe qué hay: un fallo de red, o un servidor que existe y no deja mirar. En una muestra de 24 webs estas dos no puntuaban en el 67 % y el 42 % de los casos. El sufijo de borrador sale del identificador de versión y pasa al texto, traducido a cada idioma. Las puntuaciones anteriores no se recalculan.
0.4.0 · 2026-08-04
Las respuestas directas se miden en una página interior de contenido, no en la portada. Una calibración sobre 24 webs reales encontró que las suspendían las 24, incluidas Stripe y Cloudflare: la portada de una web comercial es un escaparate y los párrafos que siguen a sus encabezados tienen entre cinco y diecisiete palabras, porque están escritos para que alguien los lea de un vistazo y no para que alguien los cite. Una comprobación que suspenden todos no distingue a nadie por muy cierta que sea. Ahora se elige una página interior a partir del sitemap o de los enlaces de la portada —siempre la misma para un mismo sitio, para que la nota sea reproducible— y se mide ahí; si el sitio no tiene ninguna página interior legible se vuelve a la portada, y el informe indica en cuál se ha medido. Las puntuaciones anteriores no se recalculan.
0.3.0 · 2026-08-03
Las comprobaciones que dependen del robots.txt dejan de declararse incapaces cuando el fichero no existe. Que una web no tenga robots.txt no es desconocimiento, es un hecho del que se deducen cosas: si no hay fichero no se bloquea a nadie, así que la comprobación de bloqueo APRUEBA, y la de reglas declaradas SUSPENDE porque no hay ninguna. Antes las dos quedaban sin concluir junto con la informativa de entrenamiento, y esas tres empujaban solas a cualquier web sin robots.txt hacia el umbral de informe parcial, dejándola fuera de las estadísticas. Solo se mantiene el no concluyente cuando el fichero no se puede descargar, que ahí sí no se sabe qué hay. Las puntuaciones anteriores no se recalculan.
0.2.0 · 2026-08-03
Se separan los rastreadores de IA en dos familias. Bloquear a los de entrenamiento (GPTBot, ClaudeBot, CCBot, Google-Extended, Bytespider) deja de penalizar: es una decisión legítima sobre el uso de tu obra y no impide que un modelo te cite. Solo penaliza bloquear a los de respuesta (OAI-SearchBot, ChatGPT-User, Claude-SearchBot, Claude-User, PerplexityBot, Perplexity-User), que son los que van a buscar la página al responder. Antes se contaban juntos, y eso suspendía como fallo crítico a quien aplicaba la política más defendible que existe hoy. Las puntuaciones anteriores no se recalculan.
0.1.0 · 2026-08-02
Primera versión pública de la metodología. Los umbrales son provisionales y se congelarán en la versión 1.0, tras calibrarlos contra una muestra de 200 webs. Hasta entonces las puntuaciones pueden variar entre escaneos.