Blog Técnico

Por qué Google no indexa tu página: 12 causas y cómo distinguirlas

Los tres requisitos tecnicos que Google pública, la frase que dice que cumplirlos no garantiza nada, y las cinco causas reales.

Alexander González 12 de agosto de 2026 · actualizado el 14 de agosto de 2026 2.748 palabras

Casi todo el mundo llega a este problema por el mismo camino: publica, espera, busca su URL en Google y no aparece. A partir de ahí empieza a probar cosas. Reenvía el sitemap, pide indexación otra vez, cambia el texto. Ese orden es el que hace que un problema de diez minutos dure semanas, porque el informe de páginas de Search Console ya dice cuál de las doce causas es, con nombre y apellidos, y casi nadie lo abre antes de empezar a tocar.

¿Por qué Google no indexa mi página?

Porque cumplir los requisitos técnicos no da derecho a entrar: Google decide qué guarda. En un sitio nuevo lo normal es que entre una parte y tarde semanas; en uno de autoridad media suele ser una directiva heredada o una canónica mal puesta; en uno consolidado, contenido que el propio sistema considera prescindible.

Respuesta rápida

FamiliaCuántas causasCómo se reconoce
Se lo pediste tú4Estados "Excluida por noindex", "Bloqueada por robots.txt"
No puede leerla4Errores de servidor, contenido vacío al renderizar
Entró y decidió que no3"Rastreada: actualmente sin indexar", duplicados
Todavía no toca1"Descubierta: actualmente sin indexar"

Antes de nada: mira el motivo

En Search Console, sección Indexación y luego Páginas. La tabla de abajo lista los motivos por los que hay URL sin indexar, con el recuento de cada uno.

Ese recuento es la parte que más ahorra. Cien URL con el mismo motivo no son cien problemas: son uno con cien síntomas. Ordenar por volumen antes de tocar nada convierte una tarde de pruebas en una decisión.

Y una advertencia que evita el error más caro de todos: un defecto encontrado una vez se barre en todo el sitio. En una auditoría propia, ninguno de los defectos era un caso aislado. Cada uno apareció primero en una página y después, al contar, en decenas.

Familia 1: se lo pediste tú sin saberlo

1. Etiqueta noindex heredada de un entorno de pruebas

La causa número uno y la de peor relación entre tamaño y daño. Una línea que nadie quitó al pasar a producción puede mantener un sitio entero fuera del índice durante meses sin producir ningún error visible. La página carga, se ve bien y no aparece.

Se comprueba buscando noindex en el HTML de la página publicada. Estado en Search Console: "Excluida por la etiqueta noindex".

2. noindex en la cabecera HTTP, no en el HTML

La versión difícil de la anterior. La directiva puede llegar en una cabecera X-Robots-Tag del servidor, y entonces no aparece al mirar el código fuente. Es el caso que más tiempo consume porque quien lo busca mira donde no está.

Se ve en las cabeceras de respuesta, o en la prueba de URL en directo de Search Console, que informa de la directiva la encuentre donde la encuentre.

3. Bloqueada por robots.txt

Impide el rastreo. Y aquí está la trampa que casi todo el mundo pisa una vez: bloquear en robots.txt no desindexa. Si además la página tiene noindex, Googlebot no entra, no lo lee y la URL puede seguir apareciendo en resultados sin descripción.

El orden correcto para sacar algo del índice es dejar rastrear, poner noindex, esperar a que se procese y solo después bloquear si hace falta ahorrar rastreo.

4. Canonical apuntando a otra URL

Una etiqueta canónica que señala a otra página le dice a Google que la buena es la otra. Con frecuencia es un valor por defecto de la plantilla que nadie revisó, o una migración que dejó todas las canónicas apuntando a la home.

Estado: "Página alternativa con la etiqueta canónica adecuada". Si esa página debía indexarse por sí misma, no es adecuada.

Familia 2: no puede leerla

5. Errores de servidor o respuestas lentas

Si el servidor devuelve errores cuando Googlebot pasa, deja de insistir. No hace falta una caída completa: basta con que responda mal de forma intermitente bajo carga.

6. Contenido que depende de JavaScript

Googlebot descarga el HTML y, si el contenido se construye después con JavaScript, tiene que ejecutarlo en una cola aparte. Puede indexar la página con la mitad del contenido, o con ninguno.

Se comprueba en la prueba de URL en directo mirando el HTML renderizado, no el código fuente. Es una distinción que decide muchos casos raros.

7. Página protegida o detrás de un muro

Autenticación, un muro de pago sin marcado adecuado, un aviso de cookies que bloquea el contenido. Si el rastreador no ve el texto, no hay nada que indexar.

8. Redirecciones encadenadas o mal configuradas

Una cadena larga de redirecciones diluye la señal y a veces se corta. Estado: "Error de redirección". Aparece con frecuencia después de migraciones hechas por tramos, y el orden que las evita está en la guía de SEO técnico.

Familia 3: entró, la leyó y decidió que no

9. "Rastreada: actualmente sin indexar"

El estado más incómodo del informe, porque no es un fallo técnico: es un juicio. Google entró, leyó la página entera y decidió que no merecía guardarse.

En volumen, apunta a contenido delgado, muy parecido a otro que ya tiene, o que no aporta nada que no esté ya indexado. La solución no es técnica y no hay atajo: es que la página tenga una razón de existir.

Conviene no dar por hecho que "parecido" quiera decir corto. En un sitio de 234 entradas que opero, las 63 páginas que Google dejó en este estado medían casi 3.000 palabras y lo que compartían con sus hermanas ya indexadas era el juego de encabezados, no el texto. El diagnóstico entero, con el método y lo que todavía no se puede afirmar, está en 91 páginas fuera del índice.

10. Duplicado: Google eligió otra canónica

Considera que otra página tuya dice lo mismo y se queda con una. Ocurre con variantes de URL, con paginaciones y con contenido que se repite entre categorías.

11. Soft 404

La página responde 200 pero parece vacía o de error a ojos del sistema. Típico de resultados de búsqueda internos sin resultados, o de fichas de producto agotado que muestran un mensaje y poco más.

Familia 4: todavía no toca

12. "Descubierta: actualmente sin indexar"

Conoce la URL y no ha gastado rastreo en ella. En volumen, suele indicar un problema de presupuesto de rastreo o de valor percibido del sitio entero, no de la página concreta.

Aquí está la palanca que casi nadie usa y que es la más barata: enlazarla desde dentro. Una URL que solo existe en el sitemap está declarada; una enlazada desde páginas que ya se rastrean con frecuencia está recomendada.

En una auditoría propia había 35 páginas huérfanas con unas 180.000 impresiones al trimestre a las que la estructura interna no llegaba. El sitemap las declaraba todas. No bastaba. El método para arreglarlo está en la guía de enlazado interno.

El orden en que se revisa

  1. Abre el informe de páginas y ordena los motivos por volumen.
  2. Descarta lo que te pediste tú: noindex en HTML, noindex en cabecera, robots.txt, canonical.
  3. Comprueba que se puede leer: prueba de URL en directo, mirando el HTML renderizado.
  4. Cuenta cuántas URL comparten el motivo antes de arreglar una.
  5. Arregla el patrón, no la página.
  6. Vuelve a abrir la página publicada para confirmar que el cambio está donde crees. La base de datos dice lo que se guardó; la página dice lo que se sirve.

Cuándo la respuesta es esperar

Si el sitio es nuevo, publica poco y la URL aparece como "Descubierta", puede que no haya nada roto. La indexación no es instantánea y ningún truco la fuerza de forma sostenida. Pedir indexación manualmente una y otra vez no acelera nada y consume el tiempo que rendiría enlazando la página desde dentro.

Los tres requisitos, y la frase que casi nadie cita

Google publica exactamente tres requisitos técnicos para que una página pueda aparecer: que Googlebot no esté bloqueado, que la página devuelva un código HTTP 200 y que tenga contenido indexable en un formato admitido. Nada más. Todo lo que se lee sobre autoridad, antigüedad del dominio o número de palabras está fuera de esa lista.

Y a continuación viene la frase que cambia el diagnóstico entero y que casi ningún artículo del tema recoge: cumplir esos requisitos no garantiza la indexación. Está en la misma página. No hay derecho de entrada.

Esa frase explica el caso que más desconcierta, que es la página correcta, rápida, enlazada y declarada en el sitemap que sigue sin entrar. No está rota. Google la ha visto y ha decidido que no aporta lo suficiente como para guardarla, y esa decisión no se revierte insistiendo con la herramienta de inspección: se revierte cambiando lo que hay en la página, o retirándola.

La otra distinción que la documentación aclara y que se confunde a diario: bloquear en robots.txt impide el rastreo, pero la URL puede seguir apareciendo en los resultados. Para que no se indexe hay que usar noindex, que exige lo contrario, que la página sí se pueda rastrear para que la directiva se lea.

Las cinco causas, y dónde se comprueba cada una

Una directiva que lo impide. Un noindex heredado de pruebas o un bloqueo mal puesto, que no son lo mismo y se confunden: robots.txt.

Una canónica que señala a otra página. Entonces no es que no se indexe: es que se consolidó en otra, según contenido duplicado y la etiqueta canonical.

Que no está declarada. Comprobable en el sitemap XML.

Que el contenido no existe hasta que corre JavaScript, que es la causa que más tarda en descubrirse: JavaScript y SEO.

O que Google la ve y decide no guardarla, que no es un error y se resuelve con actualizar contenido antiguo, retirando lo que no aporta en lugar de insistir.

La causa que aparece en casi todas las listas y no lo es

Entre las razones que dan los primeros resultados para esta consulta se repite una que conviene apartar: "no tener sitemap dificulta que Google llegue a todas tus páginas".

Un sitemap ayuda al descubrimiento y no interviene en la indexación, que son las dos cosas que este artículo separa arriba. Una página enlazada desde el resto del sitio se descubre perfectamente sin sitemap, y una página que está en el sitemap no se indexa por estar ahí: si Google decide no indexarla, seguirá sin indexarla figure donde figure.

Eso convierte "generar un sitemap" en la solución más recomendada y menos efectiva de esta lista, porque se aplica a un problema que casi nunca es el que hay. La excepción real es un sitio grande, nuevo y con enlazado interno pobre, donde el descubrimiento sí es el cuello de botella; en un sitio normal de cincuenta páginas, no lo es nunca. Qué hace y qué no hace ese archivo está explicado más arriba, y la distinción entre descubrir e indexar es la que ordena las cuatro familias de este artículo.

La razón por la que el consejo sobrevive es cómoda de entender: es la única acción de la lista que se puede completar en diez minutos y marcar como hecha. Las demás exigen leer un motivo concreto en el informe y decidir, que es más lento y no produce la sensación de haber arreglado algo.

Errores que se repiten

Datos y transparencia

Que un sitemap ayuda al descubrimiento de URL y no interviene en la decisión de indexar procede de la documentación de Google, comprobada el 13 de agosto de 2026. Que varios de los primeros resultados en español para esta consulta presentan la ausencia de sitemap como causa de no indexación es una observación del mismo día y se recoge como confusión entre descubrimiento e indexación, no como fuente.

Que los tres requisitos técnicos son que Googlebot no esté bloqueado, que la página devuelva HTTP 200 y que tenga contenido indexable en un formato admitido, que cumplirlos no garantiza la indexación, y que bloquear en robots.txt no impide que la URL aparezca en los resultados, procede de la documentación pública de Google sobre requisitos técnicos, comprobada el 12 de agosto de 2026.

Los estados de indexación citados corresponden a las etiquetas del informe de páginas de Google Search Console vigentes a agosto de 2026. El caso de las 35 páginas huérfanas con unas 180.000 impresiones al trimestre procede de una auditoría propia sobre un recetario de cocina colombiana en inglés, 312 páginas en WordPress; es trabajo de cliente, el sitio no se nombra y las cifras van redondeadas. El criterio de barrer un defecto por todo el sitio procede del mismo proyecto, donde ninguno de los defectos encontrados resultó ser un caso aislado. Verificado a agosto de 2026.

Lo que esto cambia

Hay una asimetría en este problema que explica por qué se alarga tanto. La causa se puede leer en treinta segundos y la solución se puede probar durante semanas.

Lo que ordena el trabajo no es saber más sobre indexación: es abrir el informe antes de tocar nada y contar. En la mayoría de los sitios medianos que he auditado, el reparto de motivos ha revelado que el problema no era el que se estaba intentando arreglar, y que una parte incómoda del sitio nunca llegó a ser evaluada. Esa cifra, la de cuántas páginas tuyas Google nunca guardó, es la más útil que se puede sacar en una tarde.

Preguntas frecuentes

¿Cuánto tarda Google en indexar una página nueva?

No hay un plazo fijo. Depende de la autoridad del sitio, de con qué frecuencia publica y de cuántos enlaces internos apuntan a esa página. Lo que acelera el proceso de forma consistente es enlazarla desde páginas que ya se rastrean a menudo, no reenviar el sitemap ni pedir la indexación repetidamente.

¿Qué significa "Rastreada: actualmente sin indexar"?

Significa que Googlebot entró en la página, leyó su contenido y decidió no guardarla en el índice. No es un fallo técnico sino un juicio de valor: en volumen suele apuntar a contenido delgado o muy parecido a otro que Google ya tiene indexado. Se distingue de "Descubierta: actualmente sin indexar", donde ni siquiera llegó a entrar.

¿Bloquear una URL en robots.txt la elimina de Google?

No, y con frecuencia consigue lo contrario. El archivo robots.txt impide el rastreo, de modo que Googlebot no entra y no puede leer una etiqueta noindex que hubiera dentro. La URL puede seguir apareciendo en resultados, sin descripción. Para eliminarla hay que permitir el rastreo, poner noindex y esperar a que se procese.

¿Por qué mi página no se indexa si no tiene ningún noindex visible?

La causa más habitual es que la directiva llegue en una cabecera HTTP X-Robots-Tag en lugar de en el HTML, y por eso no aparece al ver el código fuente. Otras posibilidades son un canonical que apunta a otra URL, contenido que depende de JavaScript y no se renderiza, o un soft 404. La prueba de URL en directo de Search Console informa de la directiva venga de donde venga.

¿Sirve de algo pedir la indexación manualmente en Search Console?

Sirve puntualmente, para una URL concreta y recién publicada. No sirve como método: repetir la petición no acelera nada y no arregla ninguna de las doce causas de este artículo. Si una página no se indexa por un motivo estructural, seguirá sin indexarse por muchas veces que se pida.

La mayoría de sitios no tienen un problema de posicionamiento

Tienen un problema de qué pasa cuando alguien llega. Se puede estar primero en Google y no vender nada. El diagnóstico mira las dos cosas y te dice cuál de ellas te está costando dinero.

Ver el diagnóstico