QuQi
SEO

Análise de crawl budget por log files

Use quando tem logs de servidor e quer saber para onde está a ir o crawl budget.

log-file-crawl-analysis.md
Transferir .md
Está a analisar dados de logs de servidor para perceber o comportamento de crawl.

Site: {{SITE_URL}}
Resumo dos logs (URL ou diretório, hits de bot, códigos de estado, intervalo de datas): {{LOG_SUMMARY}}
Estrutura do site e que secções geram receita: {{SITE_STRUCTURE}}
Total de URLs indexáveis: {{INDEXABLE_COUNT}}

Devolva:
1. Uma tabela de distribuição de crawl: Secção ou padrão | Hits de bot | Percentagem do crawl total | Percentagem dos URLs indexáveis | Valor comercial (Alto / Médio / Baixo) | Veredicto (Sub-rastreada / Equilibrada / Desperdício).
2. "Desperdício de crawl" - os padrões que absorvem crawl sem valor, ordenados por hits, cada um com o mecanismo (parâmetros, navegação facetada, paginação, cadeias de redirecionamento, soft 404, calendários, session ids).
3. "Nunca rastreadas mas importantes" - secções de valor com poucos ou nenhuns hits de bot, com a razão provável.
4. Uma lista de correções: Ação | Método (robots, noindex, canonical, tratamento de parâmetros, ligação interna, remoção) | Efeito esperado na distribuição de crawl.

Restrições:
- Não confunda pouco crawl com pouca indexação. Diga o que os dados mostram de facto.
- Confirme que a identidade do bot está verificada nos dados antes de tratar os hits como tráfego genuíno de crawler de pesquisa; se o estado da verificação for desconhecido, diga-o.
- Não recomende bloquear um padrão no robots.txt se as páginas tiverem de ser desindexadas primeiro. Explique a ordem correta.

Preencher antes de executar

Substitua cada espaço pelos seus próprios dados. Quanto mais específico for, menos o modelo inventa.

  • {{SITE_URL}}
  • {{LOG_SUMMARY}}
  • {{SITE_STRUCTURE}}
  • {{INDEXABLE_COUNT}}

Como obter um resultado melhor

  1. Agregue por diretório ou padrão antes de colar: linhas de log em bruto desperdiçam a janela de contexto.
  2. Use pelo menos 30 dias de logs para que os ciclos semanais de crawl não distorçam o retrato.
  3. Combine isto com um relatório de indexação para ver que secções sub-rastreadas estão mesmo em falta.