Corregir «Rastreada, no indexada»: revertir el rechazo de Google
Este estado no es un fallo técnico; es un veredicto de calidad. Googlebot analizó su página y decidió que no merecía indexarse. Este es el protocolo para cambiar esa decisión.
Entender el veredicto: por qué Google rechazó su página
En Google Search Console, el estado «Rastreada, no indexada» es distinto de «Descubierta, no indexada». La diferencia es crítica:
- Descubierta: Google sabe que la URL existe, pero no tuvo tiempo de visitarla.
- Rastreada: Google visitó, renderizó el contenido y eligió excluirla de los resultados de búsqueda.
Piénselo como el portero de un club. «Descubierta» significa que está en la cola. «Rastreada, no indexada» significa que llegó a la puerta, el portero le miró y le negó la entrada. Suele ocurrir porque el contenido queda por debajo del umbral de calidad de Google, es duplicado o no cubre una intención de búsqueda única.
Matriz de diagnóstico: identificar la causa raíz
Antes de corregir el problema, debe identificar qué no le gustó a Googlebot. Use esta matriz para clasificar las URL afectadas.
| Categoría sospechosa | Síntomas típicos | Comprobación diagnóstica | Protocolo de acción |
|---|---|---|---|
| Calidad del contenido (pobre) | Variantes de producto, etiquetas vacías, páginas programáticas. | Compruebe si el recuento de palabras únicas es < 300. Compárelo con los competidores que posicionan. | Ampliar o podar. Añada valor único o aplique noindex. |
| Casi duplicado | URL con parámetros (`?sort=`, `?ref=`) o versiones para imprimir. | Compruebe la etiqueta rel="canonical". ¿Apunta a una URL autorreferenciada? |
Consolidar. Corrija las etiquetas canónicas para que apunten a la versión principal. |
| Problemas de renderizado | Páginas en blanco, aplicaciones pesadas en JS (React/Vue). | Use GSC «Probar URL publicada» > «Ver página probada» > «Captura». ¿Se ve el contenido? | Corregir el renderizado. Implemente renderizado en el servidor (SSR). |
| URL de feeds y sistema | URL que terminan en `/feed/`, `/rss/`, `/json/`. | Revise el código fuente. Suelen estar autogeneradas por el CMS (WordPress). | Bloquear. Prohíba vía robots.txt o añada X-Robots-Tag noindex. |
Paso 1: auditoría de «contenido pobre»
Es el desencadenante más habitual. Si gestiona una tienda con miles de fichas que usan la descripción del fabricante, Google no ve valor en indexar otra copia. Para corregirlo, debe demostrar valor único.
Plan de acción:
El objetivo es alinearse con los estándares de calidad de Google. Consulte la guía oficial sobre contenido útil para entender qué valoran sus algoritmos.
- Añada datos únicos: incluya opiniones de usuarios, tablas de especificaciones propias o consejos de uso exclusivos.
- Enlazado interno: asegúrese de que la página no sea «huérfana». Enlácela desde categorías de alta autoridad.
- Enriquecimiento multimedia: añada imágenes o vídeo únicos. Google favorece claramente las páginas con medios ricos.
Paso 2: comprobar la duplicación técnica
A veces el contenido es bueno, pero la estructura de URL confunde a Google. Si `example.com/product?color=red` y `example.com/product` muestran el mismo contenido, Google indexará una y marcará la otra como «Rastreada, no indexada».
Asegúrese de que las etiquetas <link rel="canonical"> apunten a la versión principal de la página. Si la página es realmente un duplicado y no tiene valor SEO (como una versión «imprimir» de un artículo), use una etiqueta `noindex` o rediríjala.
Para profundizar en los factores técnicos, revise nuestra guía de factores de indexabilidad.
Paso 3: la confusión del Soft 404
En ocasiones, las páginas marcadas como «Rastreada, no indexada» son en realidad Soft 404 disfrazados. Ocurre si una página existe (estado 200 OK) pero contiene muy poco contenido, como «No se han encontrado productos en esta categoría». Google la rastrea, ve que está vacía y se niega a indexarla. En ese caso, o añade productos o devuelve un 404.
Paso 4: forzar la revalidación
Cuando haya mejorado la calidad de la página, use una comprobación masiva automática del estado de indexación actual para asegurarse de que su solicitud de reindexación tiene éxito y de que la respuesta de la API refleja la actualización.
Use el servicio de indexación SpeedyIndex para enviar una señal prioritaria. Esto obliga a Googlebot a revisitar la URL, procesar los cambios y reconsiderar la página para la indexación. Es especialmente eficaz si ha actualizado miles de páginas y no puede enviarlas una a una por GSC.
Consejo profesional: no use nuestro servicio de indexación hasta después de haber mejorado la página. Forzar a Google a volver a rastrear una página de baja calidad dará el mismo estado «Rastreada, no indexada».
Preguntas frecuentes (guía de solución de problemas)
¿«Rastreada, no indexada» perjudica el SEO global de mi sitio?
Sí, de forma indirecta. Un volumen alto de páginas de baja calidad y no indexadas diluye la «puntuación de calidad» global del sitio. Señala a Google que una gran parte del sitio no aporta valor, lo que puede afectar negativamente al presupuesto de rastreo y al potencial de posicionamiento de las páginas buenas.
¿Cuánto tarda la recuperación de este estado?
La recuperación no es instantánea. Tras mejorar el contenido y solicitar un nuevo rastreo (o usar nuestra herramienta de indexación), Google suele tardar de 1 a 3 semanas en reprocesar la URL. Solicitar la indexación sin cambios de contenido suele fallar.
¿Debo poner noindex a estas páginas en lugar de corregirlas?
Es una estrategia válida llamada poda de contenido. Si las páginas (p. ej., productos archivados, etiquetas antiguas) no cubren una intención de búsqueda y no se pueden mejorar, aplicar una etiqueta meta noindex es mejor que dejarlas en el limbo. Libera presupuesto de rastreo para las páginas que generan ingresos.
¿Por qué mis URL de feed RSS aparecen como «Rastreada, no indexada»?
Los CMS como WordPress generan feeds RSS (p. ej., /feed/) de forma automática. Googlebot los rastrea pero decide correctamente no indexarlos porque son datos XML, no contenido para el usuario. Puede ignorarlos o bloquearlos con robots.txt.
¿Este estado se debe a problemas de renderizado JavaScript?
Es una causa frecuente. Si su contenido depende del renderizado en el cliente (CSR), Googlebot puede ver una página vacía. Use la función «Probar URL publicada» de Search Console para revisar la captura. Si está en blanco, implemente renderizado dinámico.
¿Cuál es la diferencia entre «Rastreada» y «Descubierta»?
Descubierta significa que a Google le faltaron recursos (problema de presupuesto de rastreo) y aún no ha visitado. Rastreada significa que Google visitó, analizó la calidad y la rechazó (problema de calidad). «Rastreada» es un problema más difícil de corregir.
¿El enlazado interno ayuda a corregir este error?
Sí. Google usa los enlaces internos como indicador de importancia. Si una página está «huérfana» (sin enlaces internos), Google asume que no es importante. Añadir enlaces desde páginas de alta autoridad señala que el contenido es valioso.