Desindexar una URL en Google y bloquearla con robots.txt no son lo mismo. De hecho, utilizar mal cualquiera de las dos opciones puede provocar errores SEO importantes: páginas que siguen apareciendo en Google, URLs que no desaparecen nunca o contenidos que Google interpreta de forma incorrecta.
Uno de los errores más habituales en SEO técnico es pensar que bloquear una URL con robots.txt hace que desaparezca automáticamente del buscador. No funciona así.
Si lo que necesitas es eliminar una página del índice de Google, debes entender cómo funciona realmente el proceso de desindexación. De hecho, en esta guía sobre cómo dejar de aparecer en Google puedes ver qué métodos existen y cuándo conviene utilizar cada uno.
La diferencia es clave porque Google trata de forma distinta las páginas bloqueadas y las páginas desindexadas. Y eso afecta directamente al rastreo, la indexación y la visibilidad de tu sitio web.
En SEO Fiable podemos ayudarte tanto a desindexar como a saber qué está frenando el posicionamiento web de tu empresa a través de nuestras auditorías SEO completas.
Qué significa desindexar una URL en Google
Desindexar una URL en Google significa pedirle al buscador que elimine esa página de sus resultados de búsqueda. Es decir, la URL deja de aparecer indexada aunque siga existiendo dentro de tu web.
Esto puede hacerse mediante diferentes métodos:
- Etiqueta noindex.
- Cabeceras HTTP X-Robots-Tag.
- Herramienta de retirada temporal en Search Console.
- Códigos de estado como 404 o 410.
La clave está en entender que Google necesita poder acceder a la URL para procesar correctamente una instrucción de desindexación. Si bloqueas antes el rastreo, Google podría no llegar a interpretar nunca el noindex.
Según la documentación oficial de Google Search Central, una página bloqueada por robots.txt todavía puede aparecer indexada si Google descubre la URL mediante enlaces externos o internos. En esos casos, el buscador puede mostrar la URL sin contenido o con información limitada.
Además, Google confirmó hace años que el uso de noindex sigue siendo una de las formas más fiables para eliminar contenido del índice cuando la URL continúa accesible para el rastreo.
Diferencia real entre desindexar URL en Google y bloquear con robots.txt
Aquí es donde suele aparecer la confusión.
El archivo robots.txt sirve para controlar el rastreo, no la indexación. Es decir, le dice a Google qué URLs no debería rastrear, pero no obliga al buscador a eliminarlas de sus resultados.
En cambio, cuando desindexas una URL mediante noindex o Search Console, estás enviando una instrucción orientada directamente a la indexación.
| Acción | Qué controla | ¿Puede seguir apareciendo en Google? |
|---|---|---|
| Bloqueo con robots.txt | Rastreo | Sí |
| Noindex | Indexación | No |
| Retirada en Search Console | Ocultación temporal | Puede volver si no se aplica noindex |
Este detalle es especialmente importante porque muchos proyectos bloquean URLs desde robots.txt esperando que desaparezcan del índice. Y el resultado suele ser el contrario: Google deja de rastrearlas, pero sigue manteniendo referencias indexadas durante meses.
Google explicó en su documentación oficial sobre robots.txt que bloquear una página no evita necesariamente que aparezca en resultados si existen enlaces apuntando hacia ella.
Además, estudios de rastreo realizados por herramientas como Ahrefs y Screaming Frog muestran que una gran parte de errores de indexación en proyectos medianos provienen precisamente de conflictos entre directivas noindex y bloqueos en robots.txt.
En SEO técnico esto suele traducirse en tres problemas habituales:
- URLs bloqueadas que siguen indexadas.
- Páginas que Google no puede procesar correctamente.
- Presupuesto de rastreo desperdiciado.
Casos donde suele utilizarse mal robots.txt o la desindexación
En la práctica, estos errores aparecen constantemente en proyectos reales, especialmente en migraciones, ecommerce o webs con muchos filtros indexables.
Un ecommerce que bloqueó filtros esperando desindexarlos
Un ecommerce de moda detectó miles de URLs indexadas generadas por filtros internos. La solución inicial fue bloquear esas carpetas desde robots.txt.
El problema fue que las URLs seguían apareciendo en Google meses después porque todavía recibían enlaces internos y señales externas.
La solución correcta consistió en permitir temporalmente el rastreo, aplicar noindex y reducir la enlazabilidad interna de esas páginas hasta que Google terminó eliminándolas del índice.
Una migración donde Google seguía mostrando URLs antiguas
Durante una migración web, un proyecto decidió bloquear mediante robots.txt todas las URLs antiguas antes de implementar correctamente las redirecciones.
El resultado fue que Google no podía rastrear las páginas antiguas ni entender las señales de reemplazo. Muchas URLs permanecieron indexadas durante semanas mostrando títulos obsoletos.
Cuando se eliminó el bloqueo y se aplicaron redirecciones 301 correctamente, Google procesó la migración mucho más rápido.
Una web corporativa que quería ocultar PDFs internos
Una empresa tenía documentos PDF internos apareciendo en Google y decidió bloquear la carpeta desde robots.txt.
El problema fue que los PDFs seguían indexados porque Google ya conocía sus URLs.
La solución consistió en utilizar cabeceras HTTP X-Robots-Tag con noindex para que Google pudiera procesar correctamente la exclusión del índice.
Errores comunes al desindexar URL en Search Console
Search Console puede ayudar a ocultar URLs rápidamente, pero muchas veces se utiliza mal.
La herramienta de retirada temporal no elimina permanentemente una página del índice. Solo la oculta durante un tiempo limitado si no existe una instrucción adicional.
Estos son algunos errores frecuentes:
- Bloquear la URL antes de aplicar noindex.
- Usar solo Search Console pensando que la eliminación es permanente.
- Mantener URLs indexables dentro del enlazado interno.
- Olvidar redirecciones o códigos HTTP correctos.
- Confundir rastreo con indexación.
En la mayoría de casos, Google necesita tiempo para procesar correctamente los cambios. Por eso conviene revisar logs, rastreo y estado de indexación antes de tomar decisiones agresivas en robots.txt.
Preguntas frecuentes sobre desindexar URL en Google
¿Bloquear una URL con robots.txt hace que desaparezca de Google?
No. Robots.txt solo controla el rastreo. Si Google ya conoce la URL mediante enlaces u otras señales, todavía puede mantenerla indexada.
¿Cuál es la mejor forma de desindexar una URL en Search Console?
Lo recomendable es combinar la retirada temporal con una instrucción permanente como noindex, redirección o eliminación real de la página.
¿Google necesita rastrear una URL para procesar un noindex?
Sí. Si la URL está bloqueada por robots.txt, Google puede no llegar a interpretar nunca la directiva noindex.
Ideas finales sobre las diferencias entre desindexar URL en Google y bloquearla con robots.txt
La diferencia entre desindexar una URL en Google y bloquearla con robots.txt es mucho más importante de lo que parece.
Robots.txt sirve para controlar el rastreo. La desindexación sirve para eliminar contenido del índice. Confundir ambas cosas provoca muchos de los errores técnicos más habituales en SEO.
Antes de bloquear cualquier URL, asegúrate de entender qué necesitas realmente: evitar rastreo, eliminar indexación o ambas cosas al mismo tiempo.
