Auditoria do crawl budget
Os motores de busca atribuem uma quantidade finita de rastreio a cada site. Num catálogo ou num site com navegação facetada, esse orçamento é habitualmente gasto em URLs quase duplicados enquanto as páginas que lhe interessam esperam. Esta skill descobre para onde vai o orçamento e recupera-o.
Use quando um site grande tem páginas que ficam semanas sem ser indexadas, ou quando os ficheiros de log mostram os crawlers a gastar o tempo em parâmetros, filtros e paginação em vez das páginas que interessam.
O ficheiro da competência
O que precisa primeiro
- Logs de acesso do servidor de pelo menos 14 dias, ou as estatísticas de rastreio da Search Console
- Um inventário completo de URLs (sitemap ou exportação de crawl)
- robots.txt
Método
- 01 Extraia dos logs os acessos de rastreio por padrão de URL, agrupando por segmento de caminho e por parâmetro de query, e não por URL individual.
- 02 Ordene os padrões pela quota do total de acessos de rastreio. Tudo acima de 5% que não seja uma página que quer posicionar é uma fuga.
- 03 Para cada fuga, decida o instrumento correcto: Disallow no robots.txt para URLs que nunca devem ser obtidos, canonical para duplicados que têm de continuar acessíveis, noindex para páginas que têm de ser rastreadas mas não listadas, e regras de parâmetros só onde os três primeiros não servem.
- 04 Procure armadilhas de rastreio: calendários infinitos, IDs de sessão nos URLs, ordenações que geram combinações sem limite.
- 05 Compare a frequência de rastreio com as datas de última modificação. As páginas que mudam muitas vezes mas são rastreadas raramente precisam de melhor ligação interna, não de uma directiva.
- 06 Volte a medir passados 14 dias e confirme que a quota recuperada foi parar às páginas que pretendia.
O que isto produz
Uma tabela ordenada de fugas de rastreio com a directiva concreta a aplicar a cada uma, mais uma comparação antes/depois da quota de rastreio gasta nas páginas que geram receita.
Onde isto corre mal
- Bloquear no robots.txt um URL que já recebe links - mantém a sua equity mas deixa de a poder transmitir
- Usar noindex em páginas cujo rastreio também bloqueou, pelo que o noindex nunca é visto
- Tratar o crawl budget como um problema num site de 200 páginas, onde quase nunca é
Use esta skill na sua própria IA
O ficheiro é markdown simples, com o nome e o gatilho no frontmatter. Quando um assistente consegue carregar skills sozinho, é esse frontmatter que lê para decidir que esta se aplica.
Mais em SEO técnico
Análise de lacunas de indexação
Use quando o número de páginas que publica e o número que o Google indexa não coincidem, e preci...
Triagem de Core Web Vitals
Use quando os dados de campo mostram falhas de LCP, INP ou CLS e precisa de saber que correcção...
Verificação de renderização JavaScript
Use quando um site renderiza conteúdo no lado do cliente e precisa de confirmar que os motores d...
Limpeza de cadeias de redireccionamento
Use depois de uma migração, de uma mudança de domínio, ou sempre que um crawl reportar redirecci...