Cada versão diz o que se moveu e por quê, quase sempre com o número que motivou aquilo na frente. As pontuações antigas nunca são recalculadas: um relatório descreve como aquele site estava no dia em que foi medido, com os critérios daquele dia, e por isso cada um leva a sua versão impressa.
0.15.0 · 2026-09-05
O motor confundia duas coisas que não se parecem: não ter conseguido ler um arquivo e tê-lo lido e constatado que não existe. Um 404 é um fato do qual se deduz algo —se não há robots.txt, ninguém está bloqueado— e aí a verificação deve decidir. Um 401, um 403 ou um 429 dizem o contrário: o arquivo existe e não nos deixam vê-lo. Esse caso ficava junto do 404 por causa de uma comparação com duzentos que engolia a diferença, e produzia as duas mentiras ao mesmo tempo. A um site protegido por um firewall de aplicação dizia-se que não tem um robots.txt legível, que seu sitemap não está declarado, que não publica um llms.txt e que não responde à negociação Markdown: quatro afirmações sobre arquivos que existem e funcionam. E ao mesmo tempo aprovava-se que seu robots.txt não bloqueia nenhum rastreador de resposta, uma aprovação sobre um arquivo que nunca foi lido. Na amostra de calibração isso acontece com cinquenta de duzentos e noventa e nove sites, um em cada seis. A partir desta versão esses três códigos deixam sem conclusão as cinco verificações afetadas, e quem informa o bloqueio continua sendo a verificação que existe para isso. Corrige-se também o título da cadeia de redirecionamentos, que falava sempre de saltos: um site bloqueado lia «chegar à página inicial exige 0 redirecionamentos», o ótimo apresentado como defeito. Os ramos que não são sobre saltos —o status da resposta e um destino que termina em http— passam a ter texto próprio. As pontuações anteriores não são recalculadas.
0.14.0 · 2026-08-19
Duas verificações deixam de penalizar o chinês, o japonês e o coreano por escreverem mais denso. A primeira: os títulos escritos como pergunta não eram reconhecidos, porque essas línguas fecham com «?», o sinal de largura total, e só se procurava o do teclado latino. Na nossa própria página de metodologia em chinês davam zero de quarenta e um, com todos os títulos de seção escritos como pergunta. A segunda: as faixas de comprimento do título e da descrição estão calibradas no alfabeto latino, trinta a sessenta caracteres e cento e dez a cento e sessenta, e existem porque os buscadores cortam pela largura. Um caractere chinês ocupa o dobro de uma letra latina e diz bastante mais: o título dessa mesma página tem vinte e dois caracteres e transmite o mesmo que cinquenta em espanhol, então reprovava por dizer aquilo em menos espaço. Nessas escritas as faixas passam à metade. Fora delas não muda absolutamente nada, e a calibração sobre a amostra de 299 domínios europeus e americanos foi executada justamente para conferir isso. As pontuações anteriores não são recalculadas.
0.13.0 · 2026-08-18
Duas correções na escolha da página interna, da qual dependem cinco verificações ao mesmo tempo. A primeira: «www.exemplo.com» e «exemplo.com» são o mesmo site, e o motor os tratava como origens distintas. Em ruanyifeng.com, um blog técnico chinês, os dezoito links para artigos do próprio índice apontam para «http://www.ruanyifeng.com/blog/...»; ao analisar o domínio sem «www», os dezoito eram descartados, não sobrava nenhum artigo entre os candidatos e as verificações de conteúdo acabavam medindo uma lista de manchetes. A segunda: se a página escolhida for um índice de seção, o motor agora desce uma única vez até o primeiro artigo dela. Um salto e não vários, porque esse download é sequencial e sai do mesmo orçamento de tempo do resto da análise; se o salto não trouxer nada melhor, o índice é mantido, porque medir algo pior é melhor do que não medir nada. A escolha continua determinística: o mesmo site dá sempre a mesma página, senão a pontuação deixaria de ser reproduzível. Segue sem solução o caso em que a página escolhida está num idioma diferente do resto do site. As pontuações anteriores não são recalculadas.
0.12.0 · 2026-08-18
A verificação dos parágrafos que se sustentam fora do contexto reprovava quase todo site em espanhol. Ela detectava a dependência do parágrafo anterior procurando pronomes e dêiticos, mas a lista incluía «la», «los» e «las», que são artigos e não dêiticos, e os procurava em qualquer posição da primeira frase em vez do começo dela. Com isso, «Los umbrales se calibraron midiendo una muestra propia» saía marcado como dependente. Um dêitico no meio da frase costuma ter o antecedente dentro dessa mesma frase, então está preso; o que deixa um parágrafo no ar é o que abre. Agora só conta a abertura, e só as formas inequivocamente pronominais: «esto», «eso», «ello», «it», «lo anterior» e as anáforas explícitas. «Este» e «this» ficam de fora de propósito, porque valem tanto como pronome quanto como determinante e não dá para separar sem análise morfológica: na dúvida, não se penaliza, que é a regra declarada desta camada. A correção publicada já descrevia esse comportamento; o código não. As pontuações anteriores não são recalculadas, então o número desta verificação no estudo de calibração segue o critério antigo.
0.11.0 · 2026-08-18
O motor agora conta palavras direito em chinês, japonês e coreano. Essas línguas não separam as palavras com espaços, e o motor contava quebrando nos espaços: em cinco artigos reais de um blog técnico chinês, de 1.579 parágrafos passavam o filtro de vinte palavras exatamente 2. Contando direito, 560. Isso deixava qualquer site chinês, japonês ou coreano sem nada para medir, nem nos parágrafos que se sustentam fora do contexto nem nos dados no conteúdo, e reprovava as respostas diretas mesmo quando elas respondiam ao título perfeitamente. O cabeçalho do próprio módulo dizia que o viés de idioma vai sempre na mesma direção, sem penalizar na dúvida; ali ia exatamente na contrária. A contagem agora usa o segmentador de palavras do sistema, que segmenta essas línguas de verdade, em vez de uma constante de conversão inventada. Fora dessas escritas a contagem é idêntica à anterior, caractere por caractere: a pontuação de um site em espanhol, inglês, alemão, francês, italiano ou português não muda um ponto, e um teste confere isso contra todo o texto publicado do site. As pontuações anteriores não são recalculadas.
0.10.0 · 2026-08-06
Cinco verificações novas e uma mudança na página que é medida. Duas das cinco vêm da única coisa medida com rigor nesta área: o estudo original sobre otimização para motores generativos constatou que citar fontes, fornecer dados e acrescentar citações pode aumentar a visibilidade nas respostas em até 40 %. Daí os links para fontes externas, que contam para quantos domínios de fora o conteúdo aponta, e os dados no conteúdo, que olham que fração dos parágrafos traz um número concreto. As outras três vêm de recomendações publicadas: listas e tabelas, que são fragmentos que já chegam fatiados; a data de publicação e revisão declarada nos dados estruturados; e a autoria, que pesa pouco de propósito porque a evidência dela vem de casos observados e não de medição. A escolha da página interna também muda: um artigo passa a ter prioridade sobre uma página institucional. Isso saiu de descobrir que na Xataka estávamos medindo a página do time, feita de biografias, onde as verificações de conteúdo davam zero em sessenta e nove parágrafos. A Xataka não escrevia mal; nós é que olhávamos a página errada. As verificações que pontuam vão de 28 para 33. As pontuações anteriores não são recalculadas.
0.9.0 · 2026-08-06
A verificação de consistência da descrição deixa de comparar a descrição do editor com a da página. Uma Organization descreve o editor, por definição do schema.org, e numa empresa com várias linhas de negócio ela não tem por que se parecer com a página: comparar as duas forçava uma descrição falsa numa delas — ou a empresa descrita como se fosse o produto, ou o contrário. Agora a comparação é com a descrição da entidade que diz o que o site oferece — SoftwareApplication, Product, Service, Article e afins — e só recorre à do editor quando não existe nenhuma: o caso de um site institucional sem produto, onde a descrição da empresa é mesmo a da página. A correção não é anistia: uma descrição de produto que contradiz a página continua reprovando, assim como duas meta descriptions que divergem entre si, que era o caso que a verificação já pegava bem. As pontuações anteriores não são recalculadas.
0.8.0 · 2026-08-05
Uma verificação nova: se os títulos estão escritos como pergunta. Já se conferia que cada título fosse seguido de uma resposta autônoma de 40 a 80 palavras, mas não que o título em si parecesse algo que uma pessoa digitaria. A unidade que esses sistemas de recuperação preferem é o par completo — uma pergunta reconhecível em cima, uma resposta que se sustenta sozinha embaixo — e só metade desse par estava sendo medida. É medido na mesma página interna das respostas diretas, porque medir em páginas diferentes descreveria dois lugares e par nenhum. Um título conta como pergunta se traz ponto de interrogação, e também se abre com um interrogativo acentuado, porque em espanhol é justamente o acento que separa o interrogativo do relativo. Os limiares são um ponto de partida e serão revistos contra a amostra de calibração. As verificações que pontuam vão de 27 para 28. As pontuações anteriores não são recalculadas.
0.7.0 · 2026-08-04
Títulos dentro do rodapé, da navegação e das barras laterais deixam de contar como conteúdo. Medir uma amostra de sites reais mostrou que 43 % dos títulos ficavam dentro de <footer> ou <nav> — 81 % na HubSpot, 53 % na Mailchimp — e todos eles eram contados. Um <h2>Serviços</h2> num rodapé não tem parágrafo embaixo porque não deve ter, então a presença dele reprovava na verificação de respostas diretas qualquer site com rodapé normal: só 5 % passavam, e a causa não era como as pessoas escrevem e sim como nós contávamos. Afeta as respostas diretas, a hierarquia de títulos e a detecção de FAQ, e as três ganham precisão. O H1 do cabeçalho continua contando: muitos sites colocam ele ali. As pontuações anteriores não são recalculadas.
0.6.0 · 2026-08-04
Primeira versão calibrada contra uma amostra grande: 299 sites da Espanha, Reino Unido, Estados Unidos e resto da Europa, entre marcas, serviços e empresas de médio porte. Desses dados saem três mudanças. As duas verificações de dados estruturados viram uma só: a de validade era aprovada por 95 % dos que chegavam a ela e não se aplicava aos outros 26 %, porque JSON-LD quase nunca é escrito à mão e o que um plugin gera raramente está quebrado; agora uma única verificação separa não ter, ter quebrado e ter certo, com o mesmo peso. Os parágrafos que se sustentam sozinhos passam a ser medidos numa página interna, como as respostas diretas já eram: a página inicial não tinha três parágrafos de vinte palavras em 78 dos 215 sites medidos por inteiro, e sem uma página legível com conteúdo a verificação agora reprova em vez de se calar. E o selo para download cai de 80 para 70 pontos: em 80 ele era alcançado por 6 de 215 sites, e um selo que quase ninguém consegue exibir não circula. As verificações que pontuam vão de 28 para 27. As pontuações anteriores não são recalculadas.
0.5.0 · 2026-08-04
Duas verificações deixam de se declarar incapazes de decidir onde na verdade conseguem. Não ter um bloco de perguntas e respostas marcado como FAQPage agora REPROVA em vez de não se aplicar: é o que os modelos generativos mais citam, então um site sem isso está pior preparado para ser citado do que um site com isso, e redistribuir o peso dele nas outras afirmava o contrário. Ter as perguntas na tela sem marcar vale parcial, porque isso se resolve em dez minutos e escrever do zero não. E um site sem sitemap acessível agora reprova na verificação de atualidade em vez de voltar sem conclusão — inclusive o caso de um servidor que responde /sitemap.xml com 200 e a página inicial em HTML, que é o que os frameworks de página única fazem. «Sem conclusão» fica só onde é de fato desconhecido: uma falha de rede, ou um servidor que existe e não deixa a gente olhar. Numa amostra de 24 sites, essas duas não pontuavam em 67 % e 42 % dos casos. O sufixo «rascunho» sai do identificador de versão e vai para o texto, traduzido por idioma. As pontuações anteriores não são recalculadas.
0.4.0 · 2026-08-04
As respostas diretas passam a ser medidas numa página interna de conteúdo, não na página inicial. Uma calibração em 24 sites reais mostrou que os 24 reprovavam, Stripe e Cloudflare inclusive: a página inicial de um site comercial é uma vitrine, e os parágrafos depois dos títulos dela têm de cinco a dezessete palavras, porque são escritos para serem captados de relance e não para serem citados. Uma verificação que todo mundo reprova não distingue ninguém, por mais verdadeira que seja. Agora escolhe-se uma página interna a partir do sitemap ou dos links da página inicial — sempre a mesma para um dado site, para a pontuação seguir reproduzível — e mede-se lá; se o site não tiver página interna legível, usa-se a página inicial, e o relatório informa qual foi medida. As pontuações anteriores não são recalculadas.
0.3.0 · 2026-08-03
As verificações que dependem do robots.txt deixam de se declarar incapazes de decidir quando o arquivo não existe. Um site não ter robots.txt não é desconhecimento, é um fato com consequências: se não há arquivo, ninguém está bloqueado, então a verificação de bloqueio agora APROVA e a de regras declaradas REPROVA, porque não há nenhuma. Antes as duas ficavam sem conclusão junto com a verificação informativa de treinamento, e essas três sozinhas empurravam qualquer site sem robots.txt para o limiar do relatório parcial, deixando ele fora das estatísticas. «Sem conclusão» fica só quando o arquivo não pode ser baixado, onde de fato não sabemos. As pontuações anteriores não são recalculadas.
0.2.0 · 2026-08-03
Os rastreadores de IA passam a ser divididos em duas famílias. Bloquear os de treinamento (GPTBot, ClaudeBot, CCBot, Google-Extended, Bytespider) deixa de custar pontos: é uma decisão legítima sobre como o seu trabalho é usado e não impede um modelo de citar você. Só o bloqueio dos rastreadores de resposta (OAI-SearchBot, ChatGPT-User, Claude-SearchBot, Claude-User, PerplexityBot, Perplexity-User) é penalizado, já que são eles que buscam a página enquanto respondem. Antes eram contados juntos, o que reprovava como erro crítico a política mais defensável que existe hoje. As pontuações anteriores não são recalculadas.
0.1.0 · 2026-08-02
Primeira versão pública da metodologia. Os limiares são provisórios e serão congelados na versão 1.0, depois da calibração contra uma amostra de 200 sites. Até lá, as pontuações podem variar entre uma análise e outra.