Iniciar sesión Empezar gratis

Auditoría del presupuesto de rastreo

Los motores de búsqueda asignan una cantidad finita de rastreo a cada sitio. En un catálogo o en un sitio con navegación facetada, ese presupuesto se gasta habitualmente en URL casi duplicadas mientras las páginas que le interesan esperan. Esta habilidad localiza adónde va el presupuesto y lo recupera.

CATEGORÍA
SEO técnico
FORMATO
crawl-budget-audit.md
PASOS
6
PRECIO
Gratis, sin cuenta
CUÁNDO USAR ESTO

Úsela cuando un sitio grande tiene páginas que siguen sin indexarse durante semanas, o cuando los archivos de log muestran que los rastreadores dedican su tiempo a parámetros, filtros y paginación en lugar de a las páginas que importan.

El archivo de la habilidad

crawl-budget-audit.md
---
name: crawl-budget-audit
description: Úsela cuando un sitio grande tiene páginas que siguen sin indexarse durante semanas, o cuando los archivos de log muestran que los rastreadores dedican su tiempo a parámetros, filtros y paginación en lugar de a las páginas que importan.
---

# Auditoría del presupuesto de rastreo

Los motores de búsqueda asignan una cantidad finita de rastreo a cada sitio. En un catálogo o en un sitio con navegación facetada, ese presupuesto se gasta habitualmente en URL casi duplicadas mientras las páginas que le interesan esperan. Esta habilidad localiza adónde va el presupuesto y lo recupera.

## Qué necesitas antes

- Logs de acceso del servidor de al menos 14 días, o las estadísticas de rastreo de Search Console
- Un inventario completo de URL (sitemap o exportación de un rastreo)
- robots.txt

## Método

1. Extraiga los accesos de rastreo por patrón de URL a partir de los logs, agrupando por segmento de ruta y parámetro de consulta en lugar de por URL individual.
2. Ordene los patrones por porcentaje del total de accesos de rastreo. Todo lo que supere el 5% y no sea una página que quiera posicionar es una fuga.
3. Para cada fuga, decida el instrumento correcto: Disallow en robots.txt para las URL que nunca deben solicitarse, canonical para los duplicados que deben seguir siendo accesibles, noindex para las páginas que deben rastrearse pero no listarse, y reglas de parámetros solo donde los tres primeros no encajen.
4. Busque trampas de rastreo: calendarios infinitos, IDs de sesión en las URL, ordenaciones que generan combinaciones ilimitadas.
5. Compare la frecuencia de rastreo con las fechas de última modificación. Las páginas que cambian a menudo pero se rastrean poco necesitan mejor enlazado interno, no una directiva.
6. Vuelva a medir a los 14 días y confirme que el porcentaje recuperado ha ido a parar a las páginas que usted pretendía.

## Qué produce esto

Una tabla ordenada de fugas de rastreo con la directiva concreta que aplicar a cada una, más el porcentaje de rastreo dedicado a las páginas que generan ingresos antes y después.

## Dónde falla esto

- Bloquear en robots.txt una URL que ya recibe enlaces: conserva su valor pero ya no puede transmitirlo
- Usar noindex en páginas cuyo rastreo también ha bloqueado, de modo que el noindex nunca se ve
- Tratar el presupuesto de rastreo como un problema en un sitio de 200 páginas, donde casi nunca lo es

---

De la biblioteca de habilidades de QuQi - https://www.quqi.io/es/skills/crawl-budget-audit
Descarga gratis · sin cuenta, sin correo

Qué necesitas antes

  • Logs de acceso del servidor de al menos 14 días, o las estadísticas de rastreo de Search Console
  • Un inventario completo de URL (sitemap o exportación de un rastreo)
  • robots.txt

Método

  1. 01 Extraiga los accesos de rastreo por patrón de URL a partir de los logs, agrupando por segmento de ruta y parámetro de consulta en lugar de por URL individual.
  2. 02 Ordene los patrones por porcentaje del total de accesos de rastreo. Todo lo que supere el 5% y no sea una página que quiera posicionar es una fuga.
  3. 03 Para cada fuga, decida el instrumento correcto: Disallow en robots.txt para las URL que nunca deben solicitarse, canonical para los duplicados que deben seguir siendo accesibles, noindex para las páginas que deben rastrearse pero no listarse, y reglas de parámetros solo donde los tres primeros no encajen.
  4. 04 Busque trampas de rastreo: calendarios infinitos, IDs de sesión en las URL, ordenaciones que generan combinaciones ilimitadas.
  5. 05 Compare la frecuencia de rastreo con las fechas de última modificación. Las páginas que cambian a menudo pero se rastrean poco necesitan mejor enlazado interno, no una directiva.
  6. 06 Vuelva a medir a los 14 días y confirme que el porcentaje recuperado ha ido a parar a las páginas que usted pretendía.

Qué produce esto

Una tabla ordenada de fugas de rastreo con la directiva concreta que aplicar a cada una, más el porcentaje de rastreo dedicado a las páginas que generan ingresos antes y después.

Dónde falla esto

  • Bloquear en robots.txt una URL que ya recibe enlaces: conserva su valor pero ya no puede transmitirlo
  • Usar noindex en páginas cuyo rastreo también ha bloqueado, de modo que el noindex nunca se ve
  • Tratar el presupuesto de rastreo como un problema en un sitio de 200 páginas, donde casi nunca lo es

Usa esta skill en tu propia IA

El archivo es markdown simple, con el nombre y el disparador en su frontmatter. Cuando un asistente sabe cargar skills por su cuenta, es ese frontmatter lo que lee para decidir que esta le aplica.

Claude Code Guárdala como ~/.claude/skills/crawl-budget-audit/SKILL.md y Claude la carga solo cuando lo que haces coincide con el disparador. Ponla en .claude/skills dentro de un proyecto si la debe tener todo el equipo.
Claude Sube el archivo en la sección de skills de tus ajustes. Una vez ahí se aplica solo en cualquier conversación donde encaje el disparador, sin que tengas que acordarte.
ChatGPT No hay un formato de skills donde instalarla, así que pega el contenido del archivo en las instrucciones de un Proyecto o de un GPT personalizado. Así se aplica a todos los chats de ese proyecto y no solo a aquel donde lo pegaste.
Cualquier otro Pega el markdown en el chat antes de tu pregunta. Funciona en cualquier asistente, solo hay que volver a pegarlo cada vez.

Más en SEO técnico