Indexabilidad

Diagnóstico de Indexabilidad

Introduce una dirección y te decimos si Google puede indexarla y, si no puede, exactamente qué lo impide, con la prueba delante.

La página se descarga como Googlebot (Smartphone), sin enviar preferencia de idioma. Al sitio de destino llegan unas pocas peticiones: robots.txt, la página en sí y, en sitios multilingües, una comprobación de idioma.

Introduce una dirección y te mostramos si Google puede indexar esta página y, si no puede, exactamente qué lo bloquea.

¿Qué es el Diagnóstico de Indexabilidad?

Esta herramienta responde a una sola pregunta: ¿puede Google indexar esta dirección? Descarga la página como Googlebot y recorre las comprobaciones en el orden que aplica Google, se detiene en el primer bloqueo real y nombra el motivo con su prueba exacta. El orden importa: si robots.txt bloquea el rastreo, Google nunca lee la etiqueta noindex que hay dentro, y entonces el consejo correcto cambia por completo. Lo que no bloquea la indexación pero reduce tus posibilidades (falta de título, contenido escaso, sitemap sin declarar) queda en una clase de avisos aparte.

Diagnóstico de Indexabilidad

Cómo usarla

  1. 1Introduce la dirección completa de la página que esperas ver indexada.
  2. 2Lee la tarjeta de veredicto: en una frase dice si hay bloqueo o no.
  3. 3Si lo hay, copia la prueba y corrige justo esa línea o etiqueta.
  4. 4Deja las filas ámbar de la lista para después; no son bloqueos.

Cómo interpretar los resultados

Indexable
Sin acciónNo hay bloqueo técnico; la página puede indexarse.
Canonical propio
Configuración correctaLa página se declara canónica a sí misma, sin confusión de duplicados.
Canonical ajeno · redirección
¿Es intencionado?La página funciona, pero la que se indexa es otra dirección. Bien si era lo previsto.
noindex · robots · error
Arregla primeroGoogle no indexa esta dirección en absoluto. Nada más sirve hasta quitar el bloqueo.
Avisos
Puede esperarTítulo, contenido escaso o sitemap: puntos que bajan tus posibilidades sin bloquear nada.

Cuándo usarla

Justo Después de Publicar

Comprueba en cuanto la página esté en línea. Un noindex heredado de la plantilla o un canonical mal puesto se detectan aquí, no semanas después.

Cuando Una Página Se Cae

Si Search Console dice "no indexada", aquí ves el motivo con su prueba y corriges esa línea exacta en lugar de adivinar.

Después de una Migración

El noindex olvidado del entorno de pruebas y los canonical apuntando a direcciones viejas son fallos clásicos. Diagnostica una por una tus páginas con más tráfico.

Errores frecuentes

Usar robots.txt Para Desindexar

robots.txt bloquea el rastreo, no la indexación. Una página que ya está en el índice puede quedarse ahí detrás del bloqueo. La herramienta correcta es noindex, y solo funciona si la página es rastreable.

Fijar el Canonical en la Plantilla

Una plantilla que clava el canonical en un único valor hace que todas las subpáginas apunten a la portada. Las páginas funcionan y no dan error, pero ninguna se indexa.

El noindex de Pruebas

Un noindex para todo el sitio añadido en el entorno de pruebas es el ajuste que más se olvida al lanzar. Diagnostica siempre la portada y algunas páginas internas tras publicar.

Preguntas frecuentes

Dice indexable, pero mi página no está en Google. ¿Por qué?

Esta herramienta mide bloqueos técnicos, no el criterio de Google. Una página técnicamente abierta puede quedar fuera por ser de poco valor, duplicada o simplemente nueva. Usa el Comprobador de Índice de Google para ver si está en el índice, y Search Console para saber si fue rastreada.

¿Qué hago si la página tiene bloqueo en robots.txt y noindex a la vez?

Decide qué quieres. Para que se indexe, quita las dos cosas. Para mantenerla fuera del índice, QUITA el bloqueo de robots y deja el noindex. Suena al revés, pero Google necesita descargar la página para ver el noindex; mientras exista el bloqueo no lee la etiqueta y la dirección puede indexarse por enlaces.

El canonical apunta a otra página. ¿Es un error?

No si es intencionado. Apuntar duplicados y variantes con parámetros a una dirección principal es justo para lo que sirve el canonical. Pero cuando un contenido original declara a otro como canonical, esa página no se indexará nunca, y es uno de los errores de configuración más frecuentes.

¿Ve las etiquetas generadas con JavaScript?

No. Lee el HTML que envía el servidor y no ejecuta JavaScript como lo haría un navegador. Google sí lo ejecuta, pero con retraso. Si escribes el canonical o las etiquetas robots con JavaScript, ponerlas también en el HTML del servidor es siempre lo más seguro.

¿Por qué descarga como Googlebot?

Porque algunos sitios responden distinto a los bots: otra cabecera X-Robots-Tag, otro canonical, a veces otro código de estado. Un resultado medido con identidad de navegador normal puede no reflejar lo que ve Google. Para comparar ambas identidades usa el Simulador de Googlebot.