Abres Google Search Console, entras en el informe de indexación y ves una lista de páginas marcadas como “No indexadas”. Algunas aparecen como rastreadas pero no indexadas, otras como descubiertas, otras bloqueadas por robots.txt, otras con redirección, otras como duplicadas o con una canonical distinta… Oh my web!! What in the Googleverse is going on?
Y ahí empieza la duda: ¿hay un problema grave en la web?, ¿Google está ignorando tus contenidos?, ¿hay que pedir indexación una por una?, ¿es culpa del sitemap?, ¿del plugin SEO?, ¿del robots.txt?, ¿de la calidad del contenido?
Índice del artículo web:
La respuesta rápida es esta: no todas las páginas no indexadas son un problema. Pero algunas sí pueden estar frenando tu SEO, sobre todo si afectan a páginas importantes: servicios, categorías, productos, artículos trabajados, páginas locales o URLs que deberían traer tráfico orgánico.
La clave no es obsesionarse con indexarlo todo. La clave es saber qué páginas deberían estar en Google, cuáles no aportan nada y qué motivo real está usando Search Console para dejarlas fuera. Vamos a ver como podemos gstionar a estos maldito duendecillos del seo.
Qué significa que una página no esté indexada
Una página no indexada es una URL que Google conoce, ha encontrado o ha intentado procesar, pero que no está dentro del índice de Google para aparecer como resultado orgánico normal.
Esto no siempre significa que Google no haya visto la página. A veces Google la ha rastreado y ha decidido no indexarla. Otras veces solo la ha descubierto, pero todavía no la ha rastreado. También puede pasar que la página esté bloqueada, tenga una etiqueta noindex, redirija a otra URL o sea una copia de otra página más importante.
Por eso, antes de tocar nada, conviene separar tres conceptos:
- Descubrimiento: Google sabe que la URL existe porque la ha visto en un enlace, sitemap, redirección, feed o estructura interna.
- Rastreo: Googlebot entra en la URL y descarga la página o intenta hacerlo.
- Indexación: Google procesa la página y decide guardarla en su índice como una URL apta para aparecer en resultados.
Una URL puede estar descubierta y no rastreada. Puede estar rastreada y no indexada. Puede estar indexada, pero no posicionar. Son problemas distintos y se arreglan de forma distinta.
Primera revisión: no empieces pidiendo indexación como un loco
Uno de los errores más habituales es abrir Search Console, ver muchas páginas no indexadas y empezar a pedir indexación manual de URLs una por una.
Eso puede servir para casos puntuales, pero no arregla el problema de fondo. Si una página no se indexa porque es débil, duplicada, está mal enlazada, tiene una canonical incorrecta, está bloqueada o no aporta suficiente valor, pedir indexación solo hará que Google vuelva a mirarla y llegue a la misma conclusión.
Pedir indexación no convierte una página floja en una página digna de estar en Google.
Antes de validar o solicitar indexación, revisa esto:
- ¿La URL debería estar indexada de verdad?
- ¿Tiene contenido propio y útil?
- ¿Está enlazada desde alguna zona importante de la web?
- ¿Aparece en el sitemap correcto?
- ¿Devuelve código 200?
- ¿Tiene noindex?
- ¿Está bloqueada por robots.txt?
- ¿Tiene una canonical hacia otra URL?
- ¿Google está eligiendo otra canonical?
- ¿Es una URL duplicada, filtrada, paginada, con parámetros o de poco valor?
Si no respondes a estas preguntas, puedes perder mucho tiempo arreglando síntomas y no el problema real.
Cómo revisar una URL concreta en Search Console
El informe de indexación sirve para ver patrones generales, pero para diagnosticar una página concreta debes usar la herramienta de Inspección de URL.
Ahí puedes comprobar:
- Si la URL está indexada o no.
- Cuándo fue rastreada por última vez.
- Qué canonical ha declarado la página.
- Qué canonical ha elegido Google.
- Si está permitida por robots.txt.
- Si se detecta una etiqueta noindex.
- Si Google puede acceder correctamente a la página.
- Si la página está en el sitemap.
- Si hay problemas de rastreo o renderizado.
Esta revisión individual es importante porque el informe general agrupa motivos, pero cada URL puede tener matices. No es lo mismo una ficha de producto sin contenido que una página de servicio importante con una canonical mal puesta.
Cómo priorizar las páginas no indexadas
No conviene tratar todas las URLs igual. En muchas webs, Search Console muestra cientos o miles de páginas no indexadas que no deberían preocupar demasiado: filtros, parámetros, resultados internos, páginas antiguas, feeds, paginaciones, etiquetas, adjuntos, URLs con redirección o variaciones duplicadas.
Antes de arreglar, clasifica.
| Tipo de URL | Prioridad | Qué hacer |
|---|---|---|
| Página de servicio importante | Alta | Debe revisarse a fondo: contenido, indexabilidad, enlaces internos, canonical, sitemap y calidad. |
| Categoría de tienda online | Alta | Revisar si aporta tráfico potencial, si tiene contenido suficiente y si está bien enlazada. |
| Producto relevante | Media/alta | Depende de stock, demanda, margen, contenido y canibalización con categorías. |
| Artículo trabajado | Media/alta | Mejorar contenido, enlazado interno, intención de búsqueda y frescura. |
| Filtros, parámetros o búsquedas internas | Baja | Normalmente no deben indexarse. Controlar rastreo, canonicals o noindex según el caso. |
| URLs con redirección | Baja si son correctas | No tienen que indexarse. Revisar solo si hay cadenas, bucles o URLs importantes redirigiendo por error. |
| Páginas duplicadas o variantes | Variable | Revisar canonical, contenido y señales internas. |
La pregunta no es “¿cómo indexo todo esto?”. La pregunta buena es: ¿qué URLs merecen estar en Google y qué URLs solo están haciendo ruido?
Motivos habituales de páginas no indexadas en Google Search Console
Search Console puede mostrar distintos motivos dentro del informe de indexación. Algunos son errores reales. Otros son estados normales. Otros son señales de que Google ha visto la página, pero no la considera suficientemente importante o diferenciada.
Vamos a revisar los más habituales y qué hacer en cada caso.
Rastreada: actualmente sin indexar
Este es uno de los avisos que más preocupa. Significa que Google ha entrado en la URL, la ha rastreado, ha visto lo que había y ha decidido no meterla en el índice.
No suele ser un simple problema técnico. Muchas veces es una decisión de calidad, valor, duplicidad, poca autoridad interna o baja utilidad real.
Causas habituales
- Contenido demasiado fino o superficial.
- Página muy parecida a otras URLs de la misma web.
- Texto genérico sin valor diferencial.
- Páginas locales creadas en masa cambiando solo el nombre de la ciudad.
- Fichas de producto pobres, sin descripción propia.
- Artículos antiguos, desactualizados o sin intención clara.
- Poca autoridad interna: casi ningún enlace apunta a esa URL.
- Problemas de renderizado: Google no ve el contenido principal.
- Contenido generado de forma automática sin revisión real.
Cómo solucionarlo
La solución no es pedir indexación veinte veces. La solución es mejorar la página o decidir que no merece estar indexada.
- Revisa si la página responde a una intención de búsqueda real.
- Añade contenido propio, útil y específico.
- Elimina bloques genéricos que podrían estar en cualquier web.
- Mejora títulos, H1, H2 y estructura del contenido.
- Añade enlaces internos desde páginas fuertes.
- Comprueba que la URL devuelve código 200.
- Verifica que no tiene noindex ni canonical hacia otra URL.
- Revisa el HTML renderizado en la inspección de URL.
- Fusiona páginas débiles si compiten entre sí.
- Noindexes o elimina URLs que no deberían aparecer en Google.
Si Google ya ha rastreado la página y no la ha indexado, el mensaje suele ser claro: no basta con que la URL exista. Tiene que merecer un hueco en el índice.
Descubierta: actualmente sin indexar
Este estado significa que Google conoce la URL, pero todavía no la ha rastreado. Puede haberla encontrado en un sitemap, en un enlace interno, en una redirección, en un feed o desde otra página.
En webs pequeñas puede ser algo temporal. En webs grandes, tiendas online o sitios con muchas URLs de baja calidad, puede ser una señal de que Google no está priorizando el rastreo de esas páginas.
Causas habituales
- La página es nueva y Google todavía no ha llegado a ella.
- Está muy profunda dentro de la arquitectura.
- Tiene pocos enlaces internos.
- El servidor responde lento o con errores intermitentes.
- Hay demasiadas URLs poco útiles compitiendo por rastreo.
- El sitemap incluye muchas URLs que no son prioritarias.
- La web genera filtros, parámetros o paginaciones en exceso.
- Google no ve suficiente valor en priorizar esa URL.
Cómo solucionarlo
- Asegúrate de que la página está enlazada desde una zona importante.
- Inclúyela en el sitemap solo si realmente debe indexarse.
- Reduce URLs basura en sitemaps.
- Mejora la velocidad y estabilidad del servidor.
- Evita que filtros y parámetros generen miles de URLs rastreables.
- Refuerza la página con enlaces internos contextuales.
- Solicita indexación solo si la página ya está bien preparada.
- Revisa si forma parte de un conjunto de páginas demasiado parecidas.
En muchos casos, pasar de “descubierta” a “rastreada” depende menos del botón de indexación y más de la arquitectura, el enlazado interno y la calidad global del sitio.
Bloqueada por robots.txt
Este motivo aparece cuando Google no puede rastrear una URL porque una regla del archivo robots.txt se lo impide.
Esto puede ser correcto o puede ser un error serio. Bloquear URLs privadas, internas, carritos, búsquedas o parámetros puede tener sentido. Bloquear páginas importantes por accidente puede dejar fuera del rastreo zonas enteras de la web.
Causas habituales
- Una regla
Disallowdemasiado amplia. - Un robots.txt de pruebas subido a producción.
- Bloqueo accidental de carpetas importantes.
- Bloqueo de recursos CSS o JS necesarios para renderizar.
- Plugins SEO o de seguridad generando reglas sin revisar.
- Bloqueo de parámetros que en realidad contienen contenido útil.
Cómo solucionarlo
- Revisa el archivo
/robots.txt. - Comprueba si la regla que bloquea la URL es intencionada.
- No uses robots.txt para desindexar páginas que ya están en Google.
- Si quieres que una página salga del índice, deja que Google pueda rastrearla y usa
noindex. - Desbloquea CSS y JS importantes para que Google pueda renderizar bien la página.
- Prueba la URL con la inspección de URL.
- Después de corregir, espera a que Google vuelva a rastrear.
Cuidado con robots.txt. Una línea mal puesta puede impedir que Google rastree partes importantes de la web. Antes de tocarlo, conviene saber exactamente qué se está bloqueando.
Excluida por una etiqueta noindex
Este motivo aparece cuando la página incluye una instrucción que le dice a Google que no la indexe.
Puede estar en una metaetiqueta del HTML, en una cabecera HTTP o configurada desde un plugin SEO como Rank Math, Yoast, All in One SEO u otro sistema.
Causas habituales
- La página se dejó en noindex durante el desarrollo.
- Una plantilla de WordPress aplica noindex a un tipo de contenido.
- El plugin SEO tiene marcada la opción de no indexar.
- Se ha aplicado noindex a categorías, etiquetas, productos o páginas por error.
- Una cabecera HTTP envía
X-Robots-Tag: noindex.
Cómo solucionarlo
- Inspecciona la URL en Search Console.
- Revisa el código fuente buscando
noindex. - Comprueba los ajustes del plugin SEO.
- Revisa si el noindex viene de una cabecera HTTP.
- Quita el noindex solo si la página debe estar en Google.
- Confirma que la URL aparece en el sitemap si es importante.
- Solicita indexación después de corregir.
Este caso suele ser más sencillo que otros: si la página merece indexarse y el único problema es el noindex, se corrige la instrucción y se deja que Google vuelva a procesarla.
Página con redirección
Este estado indica que la URL redirige a otra página. Por tanto, la URL original no se indexa. Lo normal es que, si todo está bien, Google indexe la URL final.
No siempre es un problema. De hecho, después de una migración, un cambio de URL o una reestructuración, es normal ver muchas URLs en este estado.
Causas habituales
- Redirecciones 301 tras cambiar URLs.
- Redirección de HTTP a HTTPS.
- Redirección de www a sin www, o al revés.
- Normalización con o sin barra final.
- URLs antiguas que apuntan a nuevas versiones.
- Productos o contenidos retirados que redirigen a una alternativa.
Cuándo no pasa nada
No hay que hacer nada si la redirección es correcta, apunta a una URL final útil y no hay cadenas largas ni bucles.
Cuándo sí hay que actuar
- Si una página importante redirige por error.
- Si hay cadenas de redirecciones.
- Si hay bucles.
- Si el sitemap incluye URLs que redirigen.
- Si los enlaces internos apuntan a URLs antiguas en vez de a la URL final.
- Si la redirección apunta a una página irrelevante.
Cómo solucionarlo
- Comprueba la URL final.
- Actualiza enlaces internos para que apunten directamente a la URL definitiva.
- Elimina del sitemap las URLs con redirección.
- Reduce cadenas a una sola redirección.
- Corrige redirecciones accidentales.
- Usa 410 o 404 cuando la página no tenga reemplazo y no deba existir.
Página alternativa con etiqueta canonical correcta
Este motivo suele asustar menos, porque muchas veces es correcto. Significa que la URL tiene una canonical hacia otra página y Google ha respetado esa indicación.
Por ejemplo, una URL con parámetros puede apuntar como canonical a la versión limpia. Una variante de producto puede apuntar a la página principal. Una versión duplicada puede indicar cuál es la URL que debe indexarse.
Cuándo es correcto
- URLs con parámetros de seguimiento.
- Variantes de filtro o ordenación.
- Versiones duplicadas de una página.
- URLs alternativas que deben consolidarse en una principal.
- Versiones imprimibles o técnicas.
Cuándo puede ser un problema
- Si una página importante canonicaliza a otra por error.
- Si varias páginas de servicio apuntan todas a una misma URL.
- Si una categoría importante apunta como canonical a otra categoría distinta.
- Si el CMS genera canonicals incorrectas.
- Si la canonical apunta a una URL con noindex, redirección o error.
Cómo solucionarlo
- Comprueba la canonical declarada en el código.
- Verifica la canonical elegida por Google en Search Console.
- Asegúrate de que cada página importante se canonicaliza a sí misma.
- Evita canonicals cruzadas o contradictorias.
- Revisa plugins SEO, plantillas y reglas automáticas.
- Actualiza sitemaps para incluir solo URLs canónicas importantes.
La canonical no es una tirita para arreglar cualquier cosa. Sirve para consolidar duplicados, pero si se usa mal puede sacar del índice páginas que sí deberían competir.
Duplicada: Google ha elegido otra canonical
Este caso es más delicado. Significa que tú has indicado una canonical, o esperabas que una URL fuese la principal, pero Google ha elegido otra distinta.
Cuando Google no respeta tu canonical, suele haber señales contradictorias.
Causas habituales
- Enlaces internos apuntando más a la URL secundaria que a la principal.
- Sitemap incluyendo una versión que no debería ser la principal.
- Contenido muy parecido entre varias páginas.
- Canonicals mal configuradas.
- Redirecciones confusas.
- Hreflang contradictorio.
- Una URL alternativa con más autoridad o más enlaces.
Cómo solucionarlo
- Revisa la canonical declarada y la canonical elegida por Google.
- Haz que los enlaces internos apunten a la URL que quieres posicionar.
- Incluye en el sitemap solo la versión principal.
- Mejora el contenido de la URL que quieres que sea canónica.
- Reduce duplicidad entre páginas parecidas.
- Corrige redirecciones, canonicals y enlaces contradictorios.
- Si Google ha elegido una URL mejor, valora aceptarla y reforzar esa.
En SEO no gana siempre la URL que tú prefieres. Gana la que Google interpreta como más clara, más fuerte y más coherente con las señales del sitio.
Duplicada sin canonical seleccionada por el usuario
Este motivo aparece cuando Google detecta contenido duplicado o muy parecido y no encuentra una canonical clara definida por la web.
En ese caso, Google decide por su cuenta qué URL puede representar mejor ese contenido, o directamente deja varias fuera.
Causas habituales
- URLs con y sin barra final.
- Versiones HTTP y HTTPS accesibles.
- Versiones con www y sin www mal consolidadas.
- Parámetros que generan contenido duplicado.
- Categorías, etiquetas o archivos con contenido muy parecido.
- Productos con descripciones repetidas.
- Páginas locales casi idénticas cambiando solo la ciudad.
Cómo solucionarlo
- Define canonicals claras.
- Unifica versiones del dominio.
- Corrige enlaces internos para apuntar siempre a la versión preferida.
- Evita que filtros o parámetros generen duplicados indexables.
- Diferencia contenidos que sí deben tener URL propia.
- Fusiona o noindexes páginas sin valor suficiente.
- Elimina del sitemap las versiones duplicadas.
No encontrada 404
Una URL 404 no existe. Google la ha intentado rastrear y el servidor responde que no hay página.
Esto puede ser correcto. Si has eliminado una página que ya no tiene sentido y no hay sustituta, el 404 no es un drama. El problema aparece cuando la URL tenía tráfico, enlaces, autoridad o debería seguir existiendo.
Causas habituales
- URLs antiguas eliminadas.
- Cambios de slug sin redirección.
- Productos borrados.
- Errores en enlaces internos.
- URLs mal escritas en el sitemap.
- Enlaces externos apuntando a páginas eliminadas.
Cómo solucionarlo
- Si la página tiene reemplazo, crea una redirección 301 a la alternativa más cercana.
- Si no tiene reemplazo, deja el 404 o usa 410 si la eliminación es definitiva.
- Corrige enlaces internos rotos.
- Elimina URLs 404 del sitemap.
- Revisa si la URL tenía backlinks antes de dejarla morir.
- No redirijas todo a la home sin criterio.
No todo 404 necesita redirección. Redirigir páginas eliminadas a cualquier sitio puede empeorar la calidad del sitio y confundir a Google.
Error de servidor 5xx
Los errores 5xx indican que Google intentó acceder a la página, pero el servidor falló. Puede ser un error 500, 502, 503, 504 u otro problema de disponibilidad.
Si ocurre de forma puntual, puede no tener mayor recorrido. Si se repite, puede afectar al rastreo, a la indexación y a la confianza técnica del sitio.
Causas habituales
- Servidor saturado.
- Hosting insuficiente.
- Errores de PHP.
- Plugins conflictivos.
- Problemas de base de datos.
- Timeouts.
- Firewall o reglas de seguridad bloqueando a Googlebot.
- Mantenimiento mal configurado.
Cómo solucionarlo
- Revisa logs del servidor.
- Comprueba si los errores coinciden con picos de tráfico o rastreo.
- Optimiza hosting, caché y base de datos.
- Desactiva o corrige plugins problemáticos.
- Revisa reglas de firewall.
- Asegúrate de que Googlebot no está bloqueado.
- Comprueba la respuesta con herramientas externas y con Search Console.
Error de redirección
Este motivo aparece cuando Google encuentra un problema siguiendo redirecciones. Puede haber una cadena demasiado larga, un bucle, una URL final inaccesible o una configuración incoherente.
Causas habituales
- Redirección A → B → C → D.
- Bucle A → B → A.
- Redirecciones entre HTTP/HTTPS mal configuradas.
- Conflictos entre WordPress, servidor, CDN y plugin de redirecciones.
- Redirecciones móviles antiguas.
- Reglas masivas mal aplicadas.
Cómo solucionarlo
- Comprueba la cadena completa de redirección.
- Reduce a una sola redirección directa.
- Corrige bucles.
- Unifica reglas entre servidor, WordPress, CDN y plugins.
- Actualiza enlaces internos para apuntar a la URL final.
- Elimina del sitemap URLs que redirigen.
Soft 404
Un soft 404 ocurre cuando una página devuelve código 200, pero para Google se comporta como si no existiera o no aportara contenido real.
Esto puede pasar con páginas vacías, resultados sin productos, fichas sin información, categorías sin contenido o URLs que muestran un mensaje tipo “no encontrado” pero siguen respondiendo como página válida.
Causas habituales
- Páginas con muy poco contenido.
- Categorías vacías.
- Productos sin stock y sin alternativa.
- Resultados internos sin resultados.
- Páginas eliminadas que siguen devolviendo 200.
- Plantillas que muestran contenido genérico sin valor.
Cómo solucionarlo
- Si la página debe existir, añade contenido útil y específico.
- Si no debe existir, devuelve 404 o 410.
- Si hay alternativa clara, redirige a la página más relevante.
- No mantengas categorías vacías indexables.
- Evita páginas de resultados internos indexables sin contenido real.
- Revisa fichas de producto sin información.
URL enviada marcada como noindex
Este caso aparece cuando una URL incluida en el sitemap tiene una etiqueta noindex.
La contradicción es clara: por un lado le estás diciendo a Google “esta URL es importante, aquí la tienes en el sitemap”; por otro lado, dentro de la página le dices “no la indexes”.
Cómo solucionarlo
- Si la página debe indexarse, quita el noindex y mantenla en el sitemap.
- Si la página no debe indexarse, mantenla en noindex y elimínala del sitemap.
- Revisa ajustes del plugin SEO.
- Regenera el sitemap después de corregir.
- Comprueba la URL con la inspección de Search Console.
URL enviada bloqueada por robots.txt
Es otro caso de señal contradictoria. La URL aparece en el sitemap, pero robots.txt impide que Google la rastree.
Si una URL está en el sitemap, debería ser una URL importante, accesible, canónica y con código 200. Si está bloqueada, algo no está bien configurado.
Cómo solucionarlo
- Decide si la URL debe indexarse.
- Si debe indexarse, desbloquéala en robots.txt.
- Si no debe indexarse, elimínala del sitemap.
- No uses el sitemap como almacén de todas las URLs existentes.
- Incluye solo páginas que quieres que Google rastree e indexe.
URL enviada con problema de rastreo
Este motivo indica que Google ha tenido algún problema al intentar rastrear una URL enviada en el sitemap, pero el problema no encaja claramente en otros estados.
Causas habituales
- Errores temporales del servidor.
- Timeouts.
- DNS inestable.
- Bloqueos de seguridad.
- Respuestas inconsistentes.
- Problemas de renderizado.
Cómo solucionarlo
- Inspecciona la URL.
- Comprueba el código de respuesta.
- Revisa logs del servidor.
- Comprueba si Googlebot está bloqueado.
- Revisa tiempos de carga.
- Valida que la URL sea accesible sin sesión, cookies ni bloqueo.
Indexada, aunque bloqueada por robots.txt
A veces una URL bloqueada por robots.txt puede aparecer indexada si Google la descubre por enlaces externos o internos, aunque no pueda rastrear su contenido.
El resultado suele ser una URL indexada con poca información o sin fragmento útil.
Cómo solucionarlo
- Si quieres desindexarla, permite el rastreo y aplica noindex.
- Cuando desaparezca del índice, puedes volver a bloquear si tiene sentido.
- Si la página sí debe posicionar, desbloquéala y mejora su contenido.
- Revisa enlaces internos y externos que apuntan a esa URL.
Esto es importante: robots.txt bloquea el rastreo, pero no siempre garantiza que una URL no aparezca en Google si hay señales externas suficientes.
Página indexada sin contenido
Este estado aparece cuando Google tiene la URL en el índice, pero no ha podido procesar correctamente el contenido principal.
Puede deberse a bloqueos, JavaScript, renderizado, errores técnicos o contenido inaccesible.
Causas habituales
- Contenido principal cargado por JavaScript que Google no ve bien.
- Recursos bloqueados.
- Errores de renderizado.
- Contenido detrás de login.
- Problemas de plantilla.
- Respuesta HTML demasiado pobre antes de cargar scripts.
Cómo solucionarlo
- Usa la inspección de URL y revisa la página rastreada.
- Comprueba el HTML que recibe Google.
- Evita depender solo de JavaScript para mostrar contenido importante.
- Desbloquea recursos necesarios.
- Revisa caché, CDN y optimizadores de JS/CSS.
- Asegúrate de que el contenido principal está visible para Googlebot.
Sitemap: qué debe incluir y qué no
El sitemap no debería ser un vertedero de URLs. Debería ser una lista limpia de páginas que quieres que Google conozca, rastree e indexe.
Un buen sitemap debería incluir:
- URLs importantes.
- Páginas con código 200.
- URLs canónicas.
- Páginas indexables.
- Contenido actualizado y útil.
Y debería evitar:
- URLs con noindex.
- URLs bloqueadas por robots.txt.
- URLs con redirección.
- 404.
- Parámetros sin valor.
- Páginas duplicadas.
- Resultados de búsqueda interna.
- Filtros sin intención SEO.
Un sitemap limpio no garantiza indexación, pero ayuda a Google a entender qué URLs son importantes. Un sitemap lleno de basura hace justo lo contrario.
El problema de las webs con demasiadas páginas débiles
Muchas veces el problema de indexación no está en una URL concreta, sino en el conjunto de la web.
Google puede ver un sitio con demasiadas páginas parecidas, contenidos finos, categorías vacías, etiquetas sin valor, filtros rastreables, artículos antiguos, productos pobres o páginas locales clonadas. Y cuando eso pasa, cada URL nueva lo tiene más difícil.
Este problema suele verse en:
- Tiendas online con miles de productos pobres.
- Blogs con artículos antiguos sin actualizar.
- Directorios generados en masa.
- Páginas locales casi duplicadas.
- Webs con muchas etiquetas indexables.
- Categorías vacías o sin texto útil.
- Contenidos generados sin revisión humana real.
En estos casos, arreglar una URL aislada no siempre basta. Hay que hacer limpieza, consolidar, mejorar y priorizar.
Qué hacer si tienes muchas páginas en “rastreada, actualmente sin indexar”
Si el problema afecta a muchas URLs, no lo trates como una incidencia individual. Haz una auditoría por grupos.
- Exporta las URLs desde Search Console. No trabajes solo con los ejemplos visibles si el problema es grande.
- Agrupa por tipo de página. Servicios, productos, categorías, posts, etiquetas, filtros, páginas locales, autores, etc.
- Comprueba si deberían indexarse. Muchas quizá no deberían estar en Google.
- Revisa contenido y duplicidad. Detecta patrones débiles.
- Comprueba enlaces internos. Una página sin enlaces internos suele parecer poco importante.
- Revisa canonicals y sitemaps. Busca señales contradictorias.
- Decide acción. Mejorar, fusionar, redirigir, noindexar, eliminar o dejar como está.
Qué hacer si tienes muchas páginas en “descubierta, actualmente sin indexar”
Cuando Google descubre muchas URLs pero no las rastrea, suele haber un problema de prioridad, rastreo o confianza.
Trabaja estos puntos:
- Mejora el enlazado interno hacia las páginas importantes.
- Reduce URLs de baja calidad en sitemaps.
- Controla filtros y parámetros.
- Revisa velocidad del servidor.
- Publica menos páginas, pero más completas.
- Evita generar muchas URLs nuevas sin valor real.
- Haz que las páginas importantes estén a pocos clics de la home o de hubs fuertes.
Google no tiene la obligación de rastrear rápido todo lo que publicas. Cuanto más limpia y clara sea la arquitectura, más fácil se lo pones.
Cómo mejorar una página para que Google quiera indexarla
Si una página es importante y Google no la indexa, revisa su valor real. No desde tu punto de vista, sino desde el punto de vista del usuario y del buscador.
Una página con más opciones de indexarse suele tener:
- Una intención de búsqueda clara.
- Un H1 coherente.
- Contenido suficiente y útil.
- Información propia, no genérica.
- Bloques bien estructurados.
- Enlaces internos relevantes.
- Una canonical correcta.
- Código 200.
- Buena experiencia móvil.
- Carga razonable.
- Autoridad interna dentro del sitio.
En una página de servicio, por ejemplo, no basta con decir “ofrecemos diseño web”. Conviene explicar para quién es el servicio, qué problemas resuelve, qué incluye, cómo se trabaja, qué dudas suele tener el cliente, qué errores debe evitar y qué pasos puede dar.
Cuándo no merece la pena indexar una página
No todas las URLs merecen pelea. Hay páginas que es mejor dejar fuera del índice.
Por ejemplo:
- Páginas de agradecimiento.
- Carritos y checkout.
- Resultados de búsqueda interna.
- Filtros sin demanda SEO.
- Parámetros de ordenación.
- Páginas de login.
- Etiquetas sin contenido propio.
- Archivos de autor sin valor.
- Contenido duplicado.
- Páginas legales que no quieres posicionar, aunque puedan estar accesibles.
En SEO técnico, a veces la mejora no viene de indexar más, sino de indexar mejor.
Checklist rápido para diagnosticar una página no indexada
| Comprobación | Qué mirar |
|---|---|
| Código de estado | Debe devolver 200 si quieres indexarla. |
| Robots.txt | No debe bloquear la URL ni recursos importantes. |
| Noindex | No debe tener meta robots ni cabecera HTTP noindex. |
| Canonical | Debe apuntar a sí misma si es la versión principal. |
| Sitemap | Debe aparecer si es una URL importante. |
| Enlazado interno | Debe recibir enlaces desde páginas relevantes. |
| Contenido | Debe ser útil, propio y suficiente. |
| Duplicidad | No debe competir con otra URL casi igual. |
| Renderizado | Google debe ver el contenido principal. |
| Velocidad y servidor | No debe fallar ni responder lento de forma recurrente. |
Checklist para limpiar el informe de indexación en Search Console
- Entra en Indexación > Páginas.
- Ordena los motivos por volumen. Mira qué estados agrupan más URLs.
- Exporta ejemplos. No trabajes solo con intuición.
- Agrupa por tipo de URL. Productos, posts, categorías, etiquetas, filtros, servicios, etc.
- Marca qué debe indexarse y qué no. Esta decisión es la base.
- Corrige errores técnicos. Robots, noindex, canonicals, 404, redirecciones, servidor.
- Mejora páginas importantes. Contenido, estructura, enlaces internos y utilidad.
- Limpia el sitemap. Solo URLs canónicas, indexables y relevantes.
- Refuerza enlaces internos. Especialmente desde home, categorías, servicios y artículos fuertes.
- Valida cuando tenga sentido. No valides sin haber corregido de verdad.
Cuándo usar “Validar corrección” en Search Console
El botón de validar corrección tiene sentido cuando has arreglado un problema de verdad y quieres que Google compruebe si ya no existe.
Pero no conviene usarlo como si fuese un botón mágico. Si no has corregido todas las URLs afectadas por ese motivo, la validación puede fallar.
Úsalo cuando:
- Has eliminado un noindex accidental.
- Has corregido robots.txt.
- Has arreglado errores 5xx.
- Has limpiado sitemaps.
- Has corregido redirecciones.
- Has solucionado canonicals incorrectas.
No lo uses como sustituto de una mejora real de contenido. Si el problema es calidad, enlazado interno o duplicidad, primero arregla eso.
Cuánto tarda Google en indexar después de corregir
No hay un plazo fijo. Puede tardar horas, días o semanas. Depende de la autoridad del sitio, la importancia de la URL, la frecuencia de rastreo, el enlazado interno, el sitemap y el tipo de problema.
Una página importante enlazada desde la home puede revisarse antes que una URL profunda sin enlaces internos. Una web limpia y estable suele tener menos problemas que una web llena de URLs duplicadas, lentas o poco útiles.
Después de corregir:
- Comprueba que la URL está accesible.
- Inspecciona la URL en Search Console.
- Solicita indexación si es una página importante.
- Refuerza el enlazado interno.
- Actualiza el sitemap.
- Espera a que Google procese los cambios.
La indexación no se fuerza: se facilita. Tu trabajo es quitar bloqueos, ordenar señales y dar a Google una razón clara para guardar esa página en su índice.
Errores frecuentes al intentar arreglar páginas no indexadas
- Pedir indexación sin mejorar la página. Si el problema es calidad, no sirve.
- Meter todas las URLs en el sitemap. El sitemap debe ser selectivo.
- Bloquear con robots.txt páginas que quieres desindexar. Para desindexar, Google tiene que poder rastrear y ver el noindex.
- Redirigir todo a la home. Solo se debe redirigir cuando hay una alternativa relevante.
- Usar canonicals sin revisar señales internas. Google puede elegir otra canonical si el sitio le manda señales contradictorias.
- Crear muchas páginas parecidas. Más URLs no significan más SEO si no aportan valor propio.
- Ignorar el enlazado interno. Una página sin enlaces internos parece poco importante.
- No revisar el renderizado. Puede que tú veas la página bien y Google no vea el contenido principal.
Cómo podemos ayudarte con problemas de indexación
Los problemas de indexación rara vez se arreglan mirando un único aviso. Hay que cruzar Search Console, sitemap, robots.txt, canonicals, arquitectura, contenido, enlaces internos, códigos de estado y calidad real de las páginas.
En ideaWeb podemos revisar qué está pasando en tu web y separar lo importante de lo que solo hace ruido. No se trata de indexar por indexar, sino de conseguir que las páginas que importan estén accesibles, bien planteadas y con señales suficientes para Google.
¿Tienes páginas importantes sin indexar?
Podemos revisar Search Console, detectar el motivo real y preparar un plan de corrección para que tu web deje de perder oportunidades por errores técnicos, contenido débil o señales contradictorias.
Preguntas frecuentes sobre páginas no indexadas en Search Console
¿Es malo tener páginas no indexadas?
No siempre. Es normal que una web tenga URLs no indexadas: duplicados, filtros, redirecciones, páginas con noindex o URLs sin valor SEO. El problema aparece cuando no se indexan páginas importantes que deberían captar tráfico.
¿Por qué Google rastrea una página y no la indexa?
Puede deberse a contenido débil, duplicidad, falta de valor, poco enlazado interno, problemas de renderizado, baja autoridad de la página o señales contradictorias como canonicals y sitemaps mal configurados.
¿Pedir indexación en Search Console soluciona el problema?
Solo en algunos casos. Si la página está bien hecha y Google todavía no la ha revisado, puede ayudar. Si el problema es técnico, de calidad o de duplicidad, primero hay que corregir la causa.
¿Qué diferencia hay entre rastreada y descubierta actualmente sin indexar?
En “rastreada”, Google ya ha entrado en la página y ha decidido no indexarla. En “descubierta”, Google conoce la URL pero todavía no la ha rastreado. En ambos casos conviene revisar importancia, enlaces internos, sitemap, contenido y calidad.
¿Todas las páginas deben estar en el sitemap?
No. El sitemap debería incluir URLs importantes, canónicas, indexables y con código 200. No debería incluir páginas con noindex, redirecciones, errores 404, filtros sin valor o duplicados.
¿Qué hago con las páginas duplicadas?
Depende del caso. Puedes diferenciarlas, fusionarlas, redirigirlas, aplicar canonical o dejarlas fuera del índice. Lo importante es que Google reciba señales claras sobre cuál es la versión principal.
¿Robots.txt sirve para desindexar páginas?
No es la mejor forma. Robots.txt bloquea el rastreo, pero si Google ya conoce la URL puede seguir mostrándola sin contenido. Para desindexar, normalmente conviene permitir el rastreo y usar noindex hasta que salga del índice.
¿Cuánto tarda Google en indexar una página corregida?
No hay un plazo exacto. Puede tardar desde horas hasta semanas. Depende de la importancia de la URL, el enlazado interno, el sitemap, la frecuencia de rastreo y la confianza general del sitio.
¿Una página indexada ya está posicionando?
No necesariamente. Indexar significa que Google puede guardar la página en su índice. Posicionar depende de la intención de búsqueda, la competencia, la calidad del contenido, la autoridad, la experiencia de usuario y muchos otros factores.
¿Cuándo conviene hacer una auditoría de indexación?
Conviene hacerla cuando páginas importantes no se indexan, cuando hay caídas bruscas de URLs indexadas, cuando una tienda online genera muchas URLs inútiles, después de una migración o cuando Search Console muestra muchos motivos distintos de exclusión.



