seojuice

Cómo funciona el indexado de Google (y cómo comprobar si una página está indexada)

Vadim Kravcenko
Vadim Kravcenko
· Updated · 9 min read

Resumen (TL;DR): Indexar significa que Google ha analizado una página y la ha guardado en su índice, de modo que la página puede aparecer en los resultados de búsqueda. Pero eso no significa que la página esté posicionada. Comprueba una URL concreta con la herramienta Inspección de URL de Google Search Console, identifica la exclusión o el estado canónico que se reporta y corrige la causa; no repitas de forma mecánica “Solicitar indexación”.

Estado Qué ha hecho Google ¿Puede aparecer la página en búsqueda?
Detectado Google sabe que la URL existe, pero no la ha descargado. No
Rastreado Google descargó la página, pero no la ha almacenado en el índice. No
Indexado Google procesó y guardó la página. Es elegible, pero aún necesita posicionar para una consulta.
Posicionado o servido Google eligió la página indexada para una búsqueda en particular. Sí, para esa consulta.
Las cuatro etapas del proceso de indexación de Google: rastreo, renderizado, indexación y entrega.

¿Qué significa indexar?

Indexar es la etapa en la que Google analiza una página web y almacena información sobre ella en el índice de Google. Piensa en el índice como el catálogo de una biblioteca para páginas web. Si tu página no está en ese catálogo, Google no puede seleccionarla como resultado de búsqueda “normal”.

Una página indexada, por lo tanto, es elegible para aparecer en Google. No está garantizado que aparezca, y desde luego tampoco está garantizado que aparezca en la primera página.

Esta diferencia evita una cantidad sorprendente de trabajo desperdiciado. Un fundador busca un artículo recién publicado, no lo encuentra y asume que Google no lo ha indexado. La página podría estar indexada perfectamente bien, pero posicionar demasiado bajo para esa consulta. Reescribir robots.txt no soluciona un problema de posicionamiento (y puede crear un problema de indexación si se hace con descuido).

La documentación de Google sobre cómo funciona la búsqueda separa el proceso en rastreo, indexación y entrega. También deja explícita una limitación incómoda:

“Google no garantiza que rastree, indexe o muestre tu página, incluso si tu página sigue las Google Search Essentials.”

Esa es la regla central. Un sitemap válido, una configuración técnica limpia y una prueba en vivo exitosa hacen que una página sea accesible para Google; eso no crea ningún “derecho” a la indexación. Google sigue decidiendo si la página merece espacio en su índice y si merece aparecer para una búsqueda.

Las tres “puertas” entre publicar y posicionar

1. Rastreo: Google obtiene la página

Googlebot descubre URLs nuevas y actualizadas volviendo a visitar páginas conocidas, siguiendo enlaces y leyendo sitemaps. Después descarga recursos como texto, imágenes y video.

Google también renderiza páginas y ejecuta JavaScript con una versión reciente de Chrome. El contenido dependiente de JavaScript no queda automáticamente “a ciegas”, pero el renderizado introduce otro paso de procesamiento. Los errores del servidor, fallos de red y las restricciones de robots.txt pueden impedir que Google descargue lo que un navegador parece mostrar normalmente.

Una URL puede detectarse sin que se rastree. Google puede conocerla desde un sitemap o un enlace interno, pero sin haber descargado la página en sí. Search Console puede reportar ese estado como Detectado, actualmente no indexado.

2. Indexación: Google procesa y almacena la página

Tras el rastreo, Google analiza el texto de la página, el elemento de título, los atributos alt de las imágenes, las imágenes y el video. También puede identificar señales como el idioma y la usabilidad.

Aquí es donde la gestión de duplicados se vuelve importante. Google agrupa páginas similares y elige una versión canónica: la URL representativa que considera elegible para aparecer en los resultados. El canónico declarado es una señal, no una orden. Search Console puede mostrar que Google seleccionó otra URL si tus redirecciones, enlaces internos, sitemap o el contenido envían señales en conflicto.

Por eso, indexar es más que descargar HTML. La pregunta práctica es si Google almacenó esta URL, la consolidó en otra URL o decidió no indexarla. Hay poco valor en debatir “cómo entiende Google la página” hasta que sepas cuál de esas tres cosas ocurrió.

Google afirma que “La indexación no está garantizada; no todas las páginas que Google procesa se indexarán”. En su documentación, se señalan como posibles razones la baja calidad del contenido, directivas noindex y diseños del sitio que dificultan el procesamiento.

3. Entrega: Google elige un resultado para una consulta

Cuando alguien busca, Google selecciona resultados desde el índice. La relevancia, la ubicación, el idioma y el dispositivo se encuentran entre los factores que pueden influir en lo que finalmente se entrega.

La indexación mete una página en el grupo de candidatos. El posicionamiento determina si supera a los otros candidatos para una consulta real. Ahrefs encontró que el 96,55% de las páginas en su estudio de aproximadamente 14.000 millones de páginas no recibieron tráfico desde Google. Eso es una estadística de tráfico, no de indexación, pero ilustra el hueco: estar indexado es el “suelo”, no el resultado.

Yo mismo lo he diagnosticado mal tratándolo como “fallo de indexación” por falta de visibilidad, simplemente porque una página no apareció para la búsqueda exacta que yo decidí ejecutar. La corrección es poco glamorosa. Inspecciona la URL primero. No infieras su estado de indexación a partir de una sola keyword.

Cómo comprobar si una página está indexada

Usa la Inspección de URL para la respuesta fiable

Abre Google Search Console, elige la propiedad correcta y pega la URL completa en el campo de Inspección de URL. Verifica el protocolo exacto, el nombre de host, la ruta y la versión con o sin barra final que quieres que Google indexe.

Esa precisión no fue un ejercicio teórico durante la migración de SEOJuice de seojuice.io a seojuice.com en enero de 2026. La URL del dominio antiguo y la URL del dominio nuevo representaban registros separados, con su propio rastreo e información canónica. Inspeccionar “la página más o menos correcta” no es suficiente en una migración (me pillé haciendo exactamente eso más de una vez).

La documentación de Inspección de URL de Google indica que la herramienta informa datos directamente del índice de Google. Entre sus resultados principales se incluyen:

  • La URL está en Google: la URL está indexada.
  • La URL no está en Google: la URL no está indexada.
  • La URL está en Google, pero tiene problemas: la URL está indexada, pero Google detectó avisos.

Amplía los detalles en lugar de quedarte en el titular. Revisa el último rastreo, el permiso de rastreo, el permiso de indexación, el canónico declarado por el usuario y el canónico seleccionado por Google. Si Google eligió otro canónico, es posible que la URL inspeccionada no aparezca aunque su contenido esté representado bajo otra dirección.

Hay dos advertencias importantes. Primero, el informe refleja la última versión indexada, no necesariamente la página que está publicada ahora mismo en tu servidor. Segundo, “La URL está en Google” no garantiza que vaya a aparecer para una consulta concreta, porque la Inspección de URL no evalúa todas las condiciones de entrega.

Probar URL en vivo realiza una captación fresca por parte de Googlebot. Puede decirte si Google puede acceder a la página actual, pero Google aclara que la prueba no actualiza el índice. Si la prueba en vivo sale bien, significa que ahora es rastreable, no que ahora esté indexada. Pequeña diferencia. Gran consecuencia para depurar.

Usa site: como comprobación rápida, no como auditoría de índice

Puedes buscar en Google site:example.com/page-url. Si la URL aparece, es una señal inicial útil. Si no aparece, no concluyas de inmediato que la página está excluida.

Google indica que el operador site: “no necesariamente devuelve todas las URLs que están indexadas bajo el prefijo especificado en la consulta”. Su recomendación propia es usar la Inspección de URL cuando una URL específica no aparece.

Aun así, uso site: porque tarda cinco segundos (a veces esos cinco segundos son todo lo que necesito). No lo usaría para una auditoría de migración, un informe de indexación para un cliente, ni una decisión de eliminar contenido.

Cómo interpretar los dos estados confusos de “actualmente no indexado”

Detectado, actualmente no indexado

Esto significa que Google encontró la URL, pero no la rastreó. La documentación de indexación de páginas de Google dice que normalmente quería rastrear la página, pero esperaba que hacerlo pudiera saturar el sitio, así que reprogramó el rastreo.

La palabra clave aquí es detectado. Google conoce la dirección, quizá a través de un sitemap o un enlace, pero no ha descargado la página actual. Reescribir el artículo puede mejorar su valor con el tiempo, pero no resuelve la fase inmediata de captación porque Google todavía no ha visto esa modificación.

Empieza revisando el descubrimiento interno, la inclusión en el sitemap, la fiabilidad del servidor y patrones de URLs que solo añaden basura. Por lo que Lida y yo vemos en sitios más pequeños que ejecutan SEOJuice, un descubrimiento interno débil es una primera investigación mucho más productiva que teorías de “presupuesto de rastreo”: existe un artículo huérfano en un sitemap, pero ninguna página relevante lo trata como lo bastante importante como para enlazar. Ese patrón se observa; no es un diagnóstico universal.

No te vayas directamente a “presupuesto de rastreo” en un sitio con apenas unos cientos de páginas. Google dice que la gestión activa del presupuesto de rastreo es principalmente relevante para sitios muy grandes, incluidos los que tienen alrededor de un millón o más de páginas únicas o más de 10.000 páginas que cambian a diario. Nuestra guía sobre optimización del presupuesto de rastreo explica cuándo ese diagnóstico tiene sentido y cuándo es una distracción.

Rastreado, actualmente no indexado

Este estado significa que Google descargó la página, pero no la indexó. Google afirma que la página puede o no indexarse más tarde y que no hay necesidad de volver a enviarla para rastreo.

El acceso funcionó. Google recibió la página. La siguiente inspección debería centrarse en el valor diferenciado, la duplicación, la selección canónica y cómo encaja la página en el resto del sitio.

John Mueller, defensor de la Búsqueda de Google, ha vinculado directamente la calidad del sitio con cuánto indexa Google. Según se reportó en Search Engine Journal, Mueller dijo: “Si nuestros sistemas se preocupan seriamente por la calidad del sitio web, reducirán la cantidad de páginas en el índice”. Al hablar de los dos estados de “actualmente no indexado”, añadió que los sistemas de Google, en efecto, están diciendo que conocen la URL y que, “cuando estemos satisfechos, haremos otra revisión”.

Esto no significa que cada página excluida haya recibido un “cero” secreto de calidad. Search Console no ofrece ese nivel de diagnóstico (ojalá lo hiciera). Significa que, solo con accesibilidad técnica, puede no solucionarse un patrón de páginas con contenido escaso, repetitivo o débilmente conectadas.

“Detectado” significa que aún no se ha captado. “Rastreado” significa que se captó pero no se almacenó, al menos por ahora. “Actualmente” importa: ninguno de los dos estados tiene por qué ser permanente.

Por qué una página no está indexada y qué cambiar

Causa o estado Qué está pasando Primera acción
Excluida por noindex Google encontró una directiva robots meta o X-Robots-Tag que le indica no indexar la página. Elimina la directiva si fue accidental, prueba la URL en vivo y luego solicita la indexación.
Bloqueada por robots.txt Se impide a Google rastrear la ruta. Permite la ruta si Google debería captarla.
URL alternativa o duplicada Se está tratando otra URL como canónica. Revisa canónicos, redirecciones, enlaces internos, sitemaps y duplicación de contenido.
Rastreada, actualmente no indexada Google captó la página pero no la almacenó. Mejora el valor diferenciado, consolida solapamientos y añade enlaces internos relevantes.
Detectada, actualmente no indexada Google conoce la URL, pero no la ha captado. Mejora el descubrimiento, confirma la inclusión en el sitemap y revisa la accesibilidad del rastreo.
Soft 404 La URL devuelve una respuesta correcta, pero se parece a la respuesta de una página inexistente. Devuelve un 404 o 410 real, o añade contenido sustancial a la página.
Nueva URL Es posible que Google todavía no haya rastreado la página. Enlázala, envíala en un sitemap, solicita indexación una vez y espera.

No confundas robots.txt con noindex

Robots.txt controla el rastreo. Una directiva noindex controla la indexación. Están relacionadas, pero no son intercambiables.

Si robots.txt impide que Google capte una página, Google puede no ver una directiva noindex dentro de esa página. Google también explica que una URL bloqueada aún puede indexarse sin su contenido si se descubre a través de enlaces. Si una página debe mantenerse fuera del índice, usa el método de noindex documentado por Google mientras permites que Google rastree y lea la directiva.

SEOJuice tiene un generador de robots.txt para crear la sintaxis. Revisa cada regla contra las rutas que realmente quieres rastrear; un “disallow” demasiado amplio puede afectar a miles de páginas (esa cuenta se pone fea rápido).

Problemas de canónicos y redirecciones

“Página alternativa con etiqueta canónica correcta” suele ser una exclusión esperada, no un error. Si las versiones para impresión, filtradas, con parámetros de seguimiento, HTTP y HTTPS terminan resolviendo a una única URL preferida, no necesitas indexar todas las variaciones. Un número menor de exclusiones no significa automáticamente un sitio más sano.

Si la URL excluida debería ser canónica, haz consistentes sus señales. Usa un canónico auto-referenciado adecuado, apunta enlaces internos y entradas del sitemap a la URL preferida y asegúrate de que la página sea sustancialmente diferente. Si una URL antigua fue reemplazada de forma permanente, redirígela en lugar de mantener versiones en competencia. Nuestra guía sobre 301 vs 302 en redirecciones cubre la elección de la redirección.

Páginas huérfanas y descubrimiento interno débil

Google descubre URLs a través de enlaces y también de sitemaps. Un sitemap indica que existe una URL; los enlaces internos contextuales también muestran cómo se relaciona con el resto del sitio y le dan a Google otra ruta para llegar a ella.

Añade enlaces desde páginas relevantes que ya estén indexadas. No lo compensas poniendo cada URL en un footer gigante. La cantidad de enlaces internos sin contexto temático suele ser solo ruido. Una estructura deliberada es más útil, como explicamos en nuestra guía sobre silos de contenido para SEO.

En un sitio pequeño, investigaría primero el “orfandado” antes de pensar en capacidad del servidor. Abrir manualmente cada artículo funciona una vez; no funciona cuando el sitio sigue creciendo. El buscador de enlaces internos de SEOJuice ayuda a identificar oportunidades de enlazado interno y está disponible en el plan gratuito sin tarjeta de crédito. Llamado a la acción “suave”, pero también es la herramienta que construimos porque este trabajo es dolorosamente repetitivo.

Secuencia práctica de diagnóstico de indexación

  1. Inspecciona la URL exacta. Registra su estado de índice, el último rastreo, el canónico declarado y el canónico seleccionado por Google.
  2. Ejecuta Probar URL en vivo. Confirma que Googlebot puede captar la página ahora mismo. Recuerda que esto no actualiza el índice.
  3. Verifica la indexabilidad. Elimina directivas noindex accidentales, permite el rastreo necesario y confirma el canónico preferido.
  4. Revisa el descubrimiento. Incluye la URL en un sitemap XML y enlázala desde páginas relevantes que ya estén indexadas.
  5. Comprueba duplicación y valor. Si Google rastreó pero no indexó, compara esa página con tus otras URLs. Consolida casi-duplicados o haz la página materialmente más útil.
  6. Solicita indexación una sola vez. Inserta la URL en la cola de rastreo de Google. Envíos repetidos no arreglan contenido débil, canónicos en conflicto ni rastreo bloqueado.
  7. Vuelve a revisar el estado. Diagnostica lo que Search Console informe después, en lugar de tratar cada retraso como si fuera el mismo fallo.

No impongas un plazo universal de 24 horas. Search Engine Land informó la guía de John Mueller, Abogado de Búsqueda de Google, sobre que la indexación de contenido nuevo o actualizado puede tardar desde “varias horas hasta varias semanas”. Mueller también advirtió que forzar la indexación no significa que la página vaya a mostrarse de forma destacada en la Búsqueda.

Confío más en la secuencia anterior que en cualquier cuenta atrás de indexación “precisa”. El historial del sitio, el descubrimiento interno, el acceso técnico, la duplicación, la calidad del contenido y la programación de Google varían. Si alguien promete un promedio exacto sin un dataset transparente, yo me pondría en guardia (o al menos preguntaría qué incluía su muestra).

Preguntas frecuentes

¿Qué significa “indexada” en Google?

Indexada significa que Google ha procesado una página y la ha guardado en el índice de Google, haciéndola elegible para aparecer en resultados de búsqueda. Eso no significa que la página tenga buen posicionamiento para una keyword específica. La “entrega” es la etapa posterior en la que Google elige páginas indexadas para una consulta.

¿Cuánto tarda Google en indexar una página nueva?

John Mueller dijo que la indexación de contenido nuevo o actualizado puede tardar desde varias horas hasta varias semanas. No hay un calendario garantizado. Un sitemap, enlaces internos útiles e Inspección de URL pueden mejorar el descubrimiento o poner la URL en una cola de rastreo, pero ninguno obliga a Google a indexarla.

¿Por qué mi página aparece como “Rastreada, actualmente no indexada”?

Google descargó la página, pero no la almacenó en el índice. Revisa si el contenido es diferenciado y útil, si Google eligió otro canónico y si páginas internas relevantes enlazan hacia ella. Google indica que la URL podría indexarse más tarde y que no necesita enviarse repetidamente para rastreo.

¿Cómo consigo que Google indexe mi página más rápido?

Envía un sitemap XML, añade enlaces internos relevantes desde páginas conocidas, verifica que la URL sea rastreable e indexable, y usa una vez la opción “Solicitar indexación” de la Inspección de URL. Estos pasos mejoran el descubrimiento y la accesibilidad, pero Google no promete un plazo de indexación.

¿Cuál es la diferencia entre rastrear e indexar?

Rastrear significa que Googlebot descargó la página. Indexar significa que Google procesó y almacenó la página para que pueda convertirse en un resultado de búsqueda. Una página rastreada no se indexa automáticamente, y una página indexada no se posiciona automáticamente.

¿robots.txt evita que una página se indexe?

No de forma fiable. robots.txt bloquea el rastreo, no la indexación. A veces, Google puede indexar una URL bloqueada sin comprender su contenido si los enlaces revelan esa URL. Para mantener fuera del índice una página rastreable, usa una directiva noindex que Googlebot tenga permiso de capturar y leer.

SEOJuice
Stay visible everywhere
Get discovered across Google and AI platforms with research-based optimizations.
Works with any CMS
Automated Internal Links
On-Page SEO Optimizations
Get Started Free

no credit card required

More articles

No related articles found.