Inicio seo-tecnico Indexación y Rastreo SEO

Indexación y Rastreo SEO

← Volver a seo-tecnico

La indexación es el proceso por el que Google almacena las páginas de tu sitio en su índice para poder mostrarlas en los resultados de búsqueda. El rastreo es el paso previo: Googlebot (el robot de Google) visita tu sitio siguiendo links para descubrir las páginas.

Si Google no puede rastrear tus páginas, no las indexa. Si no las indexa, no rankean. Parece obvio, pero los problemas de indexación son responsables de una fracción enorme del potencial SEO perdido en sitios chilenos — especialmente en sitios WordPress con configuraciones por defecto.

Cómo funciona el proceso de rastreo e indexación

El proceso tiene cuatro etapas:

  1. Descubrimiento: Google descubre URLs a través de links desde páginas ya indexadas, sitemaps XML enviados en Search Console, y URLs enviadas manualmente
  2. Rastreo: Googlebot visita la URL, descarga el HTML y ejecuta el JavaScript (el rendering puede ser diferido)
  3. Procesamiento: Google analiza el contenido, los links y los señales técnicos de la página
  4. Indexación: si la página cumple los criterios de calidad, Google la añade a su índice y la considera para el ranking

Importante: pasar por todas las etapas no garantiza rankear. Hay páginas indexadas que no rankean para ninguna keyword. Pero no estar indexado garantiza no rankear.

Cómo verificar el estado de indexación de tu sitio

Google Search Console — Informe de cobertura

La fuente de datos más importante. Search Console clasifica todas las URLs de tu sitio en cuatro estados:

Búsqueda site: en Google

Escribir site:tudominio.cl en Google muestra una estimación de las páginas indexadas. No es exacta, pero sirve para detectar si hay grandes discrepancias entre las páginas de tu sitio y lo que Google ha indexado.

Robots.txt: qué es y qué errores evitar

El archivo robots.txt (ubicado en tudominio.cl/robots.txt) le indica a los robots de búsqueda qué partes del sitio pueden o no pueden rastrear. Es una directiva de rastreo — no de indexación. Un malentendido común: bloquear una URL en robots.txt no impide que Google la indexe si otros sitios enlazan a ella.

Los errores más comunes de robots.txt en sitios chilenos:

Sitemap XML: cómo guiar a Google correctamente

El sitemap XML es un archivo que lista todas las URLs que quieres que Google indexe. No garantiza la indexación, pero acelera el descubrimiento y ayuda a Google a entender la estructura del sitio.

Un sitemap bien configurado en WordPress:

Crawl budget: qué es y cuándo importa

El crawl budget es la cantidad de páginas que Googlebot rastrea de tu sitio en un período determinado. Para sitios pequeños (menos de 1.000 páginas) el crawl budget rara vez es un problema — Google rastreará todo. Para sitios grandes (tiendas online con miles de variantes de producto, directorios con miles de páginas), el crawl budget es crítico.

Señales de problema de crawl budget:

Noindex: cuándo usarlo y cuándo no

La etiqueta <meta name="robots" content="noindex"> le indica a Google que no indexe esa página. Úsala para:

No uses noindex para páginas que quieres rankear. Parece obvio, pero es un error que se ve frecuentemente en sitios WordPress donde el noindex estaba activado en el modo desarrollo y nunca se desactivó al lanzar.

En ALTASEO auditamos el estado completo de indexación de tu sitio y corregimos los problemas de rastreo que están limitando tu visibilidad en Google Chile. Solicita tu auditoría de indexación gratuita.

¿Listo para implementar esta estrategia?

Consulta gratuita sin compromiso. Analizamos tu caso específico y diseñamos el plan.

Consulta gratuita Ver seo-tecnico