QuQi

Auditoría del presupuesto de rastreo

Los motores de búsqueda asignan una cantidad finita de rastreo a cada sitio. En un catálogo o en un sitio con navegación facetada, ese presupuesto se gasta habitualmente en URL casi duplicadas mientras las páginas que le interesan esperan. Esta habilidad localiza adónde va el presupuesto y lo recupera.

Consigue el archivo de la habilidad Deja que lo lleven los agentes
CATEGORÍA
SEO técnico
FORMATO
crawl-budget-audit.md
PASOS
6
PRECIO
Gratis, sin cuenta
CUÁNDO USAR ESTO

Úsela cuando un sitio grande tiene páginas que siguen sin indexarse durante semanas, o cuando los archivos de log muestran que los rastreadores dedican su tiempo a parámetros, filtros y paginación en lugar de a las páginas que importan.

El archivo de la habilidad

crawl-budget-audit.md
---
name: crawl-budget-audit
description: Úsela cuando un sitio grande tiene páginas que siguen sin indexarse durante semanas, o cuando los archivos de log muestran que los rastreadores dedican su tiempo a parámetros, filtros y paginación en lugar de a las páginas que importan.
---

# Auditoría del presupuesto de rastreo

Los motores de búsqueda asignan una cantidad finita de rastreo a cada sitio. En un catálogo o en un sitio con navegación facetada, ese presupuesto se gasta habitualmente en URL casi duplicadas mientras las páginas que le interesan esperan. Esta habilidad localiza adónde va el presupuesto y lo recupera.

## Qué necesitas antes

- Logs de acceso del servidor de al menos 14 días, o las estadísticas de rastreo de Search Console
- Un inventario completo de URL (sitemap o exportación de un rastreo)
- robots.txt

## Método

1. Extraiga los accesos de rastreo por patrón de URL a partir de los logs, agrupando por segmento de ruta y parámetro de consulta en lugar de por URL individual.
2. Ordene los patrones por porcentaje del total de accesos de rastreo. Todo lo que supere el 5% y no sea una página que quiera posicionar es una fuga.
3. Para cada fuga, decida el instrumento correcto: Disallow en robots.txt para las URL que nunca deben solicitarse, canonical para los duplicados que deben seguir siendo accesibles, noindex para las páginas que deben rastrearse pero no listarse, y reglas de parámetros solo donde los tres primeros no encajen.
4. Busque trampas de rastreo: calendarios infinitos, IDs de sesión en las URL, ordenaciones que generan combinaciones ilimitadas.
5. Compare la frecuencia de rastreo con las fechas de última modificación. Las páginas que cambian a menudo pero se rastrean poco necesitan mejor enlazado interno, no una directiva.
6. Vuelva a medir a los 14 días y confirme que el porcentaje recuperado ha ido a parar a las páginas que usted pretendía.

## Qué produce esto

Una tabla ordenada de fugas de rastreo con la directiva concreta que aplicar a cada una, más el porcentaje de rastreo dedicado a las páginas que generan ingresos antes y después.

## Dónde falla esto

- Bloquear en robots.txt una URL que ya recibe enlaces: conserva su valor pero ya no puede transmitirlo
- Usar noindex en páginas cuyo rastreo también ha bloqueado, de modo que el noindex nunca se ve
- Tratar el presupuesto de rastreo como un problema en un sitio de 200 páginas, donde casi nunca lo es

---

De la biblioteca de habilidades de QuQi - https://www.quqi.io/es/skills/crawl-budget-audit
Descarga gratis · sin cuenta, sin correo

Qué necesitas antes

  • Logs de acceso del servidor de al menos 14 días, o las estadísticas de rastreo de Search Console
  • Un inventario completo de URL (sitemap o exportación de un rastreo)
  • robots.txt

Método

  1. 01 Extraiga los accesos de rastreo por patrón de URL a partir de los logs, agrupando por segmento de ruta y parámetro de consulta en lugar de por URL individual.
  2. 02 Ordene los patrones por porcentaje del total de accesos de rastreo. Todo lo que supere el 5% y no sea una página que quiera posicionar es una fuga.
  3. 03 Para cada fuga, decida el instrumento correcto: Disallow en robots.txt para las URL que nunca deben solicitarse, canonical para los duplicados que deben seguir siendo accesibles, noindex para las páginas que deben rastrearse pero no listarse, y reglas de parámetros solo donde los tres primeros no encajen.
  4. 04 Busque trampas de rastreo: calendarios infinitos, IDs de sesión en las URL, ordenaciones que generan combinaciones ilimitadas.
  5. 05 Compare la frecuencia de rastreo con las fechas de última modificación. Las páginas que cambian a menudo pero se rastrean poco necesitan mejor enlazado interno, no una directiva.
  6. 06 Vuelva a medir a los 14 días y confirme que el porcentaje recuperado ha ido a parar a las páginas que usted pretendía.

Qué produce esto

Una tabla ordenada de fugas de rastreo con la directiva concreta que aplicar a cada una, más el porcentaje de rastreo dedicado a las páginas que generan ingresos antes y después.

Dónde falla esto

  • Bloquear en robots.txt una URL que ya recibe enlaces: conserva su valor pero ya no puede transmitirlo
  • Usar noindex en páginas cuyo rastreo también ha bloqueado, de modo que el noindex nunca se ve
  • Tratar el presupuesto de rastreo como un problema en un sitio de 200 páginas, donde casi nunca lo es

Más en SEO técnico