Indexación
¿Qué es una indexación web?
La indexación web es aquello que ocurre cuando Google procesa y valida una página web para luego incluirla en sus listados de resultados.
Por eso desde el momento en que preparas algo en tu web ,lo primero que quieres que suceda es que Google la indexe. Hasta que eso no ocurra no aparecerás en el buscador, por lo que resultará muy difícil que alguien pueda llegar a esa dirección.
Este es un proceso automatizado que para poder cumplir con su función, Google recurre a un bot rastreador que se encarga de ello. Su nombre es Googlebot. ¡Y vaya que hace bien su trabajo! Gran parte de tu buena experiencia de usuario en Internet es gracias a la diligencia de ese famoso robot cibernético.
Razones para indexar una página web en Google
Existen un sinfín de motivos para indexar una página en Google. La primera de ellas sin duda es para obtener posicionamiento. Después de todo, tu URL será invisible ante los ojos curiosos de los usuarios de Google si no pasa antes por este proceso.
Se suele decir que «9 de cada 10 visitas vienen de Google», y conviene precisarlo porque mezcla dos cosas distintas: ese ~90% es la cuota de Google entre buscadores, no la proporción de visitas que recibe una web. Hay tráfico directo, de redes, de correo y de enlaces de otros sitios, y el reparto cambia muchísimo de un negocio a otro. La cifra que importa es la tuya: míralo en tu propia analítica antes de dar por hecho el 90%.
El común denominador a la hora de hacer una web es esperar recibir tantas visitas como sean posibles. Ni hablar del caso de las ecommerce cuya viabilidad está directamente relacionada con la cantidad de personas que visiten el portal.
Conviene desmontar aquí una creencia extendida: indexar no protege tu contenido de que te lo copien. No otorga ningún derecho, no funciona como registro y Google no garantiza que vaya a considerar original a quien indexó primero. Suele acertar, pero es una decisión de sus algoritmos, no un escudo legal. La protección de tus textos viene de la propiedad intelectual, no del buscador.
¿Cómo funciona la indexación en Google?
- Rastreo o crawling: esta es la fase donde Googlebot hace su trabajo. Este bot a final de cuentas es un rastreador como el que suelen tener todos los buscadores. Se encarga de detectar las nuevas páginas que vean la luz y que tengan relación con otras webs que ya conoce.
- En caso de que se trate de una URL cuyo origen es totalmente desconocido Googlebot deberá esperar su sitemap para poder actuar. Ese es el mecanismo mediante el cual los gestores de las nuevas webs le indicarán a Google que también quieren ser indexados
- Indexación: tras el rastreo, Google analiza el contenido y decide si lo guarda o no. Y aquí está lo que más sorprende: rastrear no es indexar. Google visita muchas más páginas de las que acaba incluyendo, y descarta las que le parecen duplicadas, vacías o sin motivo suficiente para ocupar sitio. Si en Search Console te aparece «Rastreada: actualmente sin indexar» o «Descubierta: actualmente sin indexar», eso es exactamente lo que ha pasado: te ha visto y ha decidido que no.
- Publicación y posicionamiento: esta etapa final es consecuencia de la anterior. Una vez las nuevas páginas se publiquen, aparecerán en las SERPs de Google por orden de calidad. Todo esto gracias a la acción de una serie de algoritmos que determinan la conveniencia de mostrar unos resultados u otros.
¿Cómo indexar una página en Google?
Para indexar una web lo primero que tienes que hacer es darle la instrucción a Googlebot de que haga su trabajo. El proceso para lograrlo es el siguiente:
- Lo primero será darte de alta en Google Search Console . Mediante esta herramienta podrás conocer el status de las indexaciones de tus páginas. También te muestra posibles fallas que puedas estar cometiendo y que afecten el proceso. Así que esta es la base de todo. ¡No ignores este paso!
- Configura el sitemap de tu web. Se trata de un mapa general que explica las relaciones entre todas las páginas bajo el mismo dominio. De esa forma, el bot de Google podrá entablar un orden jerárquico a la hora de indexar tus páginas.
- Revisa tu archivo robots.txt, y con cuidado, porque aquí está la confusión que más páginas deja fuera de Google por error. El
robots.txtno dice qué indexar: dice por dónde puede pasar el rastreador. Son cosas distintas y la diferencia tiene consecuencias serias:- Bloquear una URL en
robots.txtno impide que se indexe. Google lo documenta expresamente: si otras páginas la enlazan, puede acabar apareciendo igualmente en los resultados, aunque sin poder mostrar su contenido. - Para impedir de verdad la indexación se usa la etiqueta
noindex, y tiene un requisito que se pasa por alto constantemente: la página tiene que ser rastreable. Si la bloqueas además en elrobots.txt, el rastreador nunca llegará a leer esenoindexy por tanto no se aplicará. - Dicho de otro modo, y es la trampa clásica: bloquear una página para desindexarla consigue justo lo contrario, impedir que la orden de desindexar se ejecute.
- Bloquear una URL en
- Actualiza constantemente tu web con nuevo contenido para mantener activo a Googlebot. ¡No permitas que este robot rastreador se olvide de ti!
Ahora lo sabes todo sobre la indexación de una página web. ¡Recuerda que este es un proceso fundamental para tu estrategia SEO! Sigue los pasos que te indicamos recientemente para que Google pueda procesar cada una de tus URLs sin excepción.

