La diferencia principal entre noindex vs disallow es sencilla: noindex sirve para evitar que una página aparezca en Google, mientras que disallow sirve para impedir que los bots la rastreen. noarchive, en cambio, no elimina la página del índice: solo evita que Google muestre una copia en caché.
Si tu objetivo es reducir o controlar tu presencia en buscadores, esta guía encaja dentro de una estrategia más amplia sobre cómo dejar de aparecer en Google. Aquí nos centraremos en el uso técnico de cada directiva.
Resumen rápido
- Según Google Search Central,
noindeximpide que una página aparezca en los resultados si Google puede rastrearla. - Google aclara que una URL bloqueada por
robots.txtpuede seguir apareciendo en resultados si otros sitios la enlazan. noarchiveno desindexa: solo evita que Google muestre una copia almacenada en caché de la página.
Noindex vs disallow: cuál es la diferencia real
Google Search Central explica que noindex bloquea la indexación, mientras que robots.txt controla el rastreo; por eso, comparar noindex vs disallow es comparar indexación frente a rastreo.
noindex le dice a Google: “puedes rastrear esta página, pero no la muestres en resultados”. disallow le dice: “no rastrees esta URL o carpeta”. Son instrucciones distintas y no deberían usarse como si fueran equivalentes.
La confusión aparece porque ambas se usan para controlar visibilidad. Pero solo una está pensada para sacar una página del índice: noindex.
Citation Capsule: Según Google Search Central, una página bloqueada por robots.txt puede seguir apareciendo en Google si recibe enlaces externos. Para impedir que una URL se indexe, Google recomienda usar noindex, no una regla Disallow.
Qué es noindex y cuándo usarlo
Google define noindex como una regla que puede aplicarse mediante una metaetiqueta HTML o una cabecera HTTP para impedir que una página aparezca en los resultados de búsqueda.
Úsalo cuando la página puede existir, pero no debe posicionar. Es típico en páginas de gracias, landings duplicadas, resultados internos, filtros, páginas de prueba, contenido de baja calidad o URLs que no aportan valor SEO. Ya sabes cuánto tarda en posicionar una web, con lo que debes asegurarte de cada paso que das.
Ejemplo en HTML:
<meta name="robots" content="noindex">
Ejemplo solo para Googlebot:
<meta name="googlebot" content="noindex">
Para PDFs u otros archivos no HTML, puedes usar una cabecera HTTP:
X-Robots-Tag: noindex
La regla práctica es clara: si quieres que Google vea la página para entender que no debe indexarla, usa noindex y permite el rastreo. Bloquear el acceso antes de que Google lea la etiqueta puede retrasar el resultado.
Qué es disallow y cuándo usarlo
Google Search Central indica que Disallow en robots.txt sirve para indicar a rastreadores qué rutas no deben solicitar dentro de un sitio web.
Úsalo para gestionar rastreo, no para desindexar. Es útil cuando quieres evitar que Googlebot consuma recursos en zonas poco útiles, como parámetros infinitos, resultados de búsqueda interna, facetas innecesarias, carpetas técnicas o archivos sin valor para SEO.
Ejemplo básico:
User-agent: *
Disallow: /busqueda-interna/
Este código pide a todos los bots que no rastreen la carpeta /busqueda-interna/. Pero eso no garantiza que esas URLs desaparezcan de Google si ya estaban indexadas o si reciben enlaces.
Citation Capsule: Google advierte que una URL bloqueada por robots.txt puede seguir apareciendo en resultados si Google la descubre por enlaces externos. En ese caso, puede mostrarse la URL sin contenido rastreado.
En auditorías técnicas, muchas webs bloquean filtros con Disallow esperando que desaparezcan del índice. El resultado suele ser peor: Google no puede rastrear la página, pero la URL puede seguir detectada.
Qué es noarchive y cuándo usarlo
Google documenta noarchive como una directiva de robots que evita que se muestre una copia en caché de la página en los resultados de búsqueda.
noarchive no impide rastreo. Tampoco impide indexación. Solo afecta a cómo se muestra la página en Google, especialmente a la disponibilidad de versiones almacenadas.
Ejemplo:
<meta name="robots" content="noarchive">
También puede combinarse con otras directivas:
<meta name="robots" content="noindex, noarchive">
Úsalo cuando el contenido cambia con frecuencia, tiene precios sensibles, información legal actualizable, datos temporales o cualquier contenido donde no quieres que una versión antigua se consulte desde caché.
No lo uses esperando eliminar la URL. Si la página está indexada, seguirá pudiendo aparecer en Google. Simplemente no debería mostrarse una copia archivada.
Cuándo combinar noindex, noarchive y disallow
Google permite combinar directivas de robots como noindex y noarchive, pero Disallow pertenece a robots.txt y actúa antes del rastreo.
La combinación correcta depende del objetivo. Si quieres desindexar una página, no la bloquees con Disallow antes de que Google lea el noindex. Si quieres ahorrar crawl budget en una zona irrelevante, usa Disallow.
| Objetivo | Directiva recomendada | Motivo |
|---|---|---|
| Quitar una página de Google | noindex |
Impide que aparezca en resultados. |
| Evitar rastreo de una carpeta | Disallow |
Reduce acceso de bots a rutas concretas. |
| Evitar copia en caché | noarchive |
No elimina la URL, solo la copia almacenada. |
| Quitar página y evitar caché | noindex, noarchive |
Evita indexación y copia archivada. |
| Contenido privado | Contraseña o restricción de acceso | Las directivas SEO no sustituyen la seguridad. |
En SEO Fiable ofrecemos auditorías de posicionamiento web que son muy útiles para detectar todo tipo de problemas técnicos en tu web y mejorar así tu posicionamiento SEO.
Errores frecuentes al comparar noindex vs disallow
Google aclara que para ver una etiqueta noindex primero debe rastrear la página; por eso, bloquear la URL en robots.txt puede impedir que detecte la instrucción.
Estos son los fallos más habituales:
- Usar Disallow para desindexar: puede bloquear rastreo, pero no garantiza eliminación del índice.
- Bloquear una URL con noindex: Google quizá no pueda leer la metaetiqueta.
- Usar noarchive como si fuera noindex: la página puede seguir posicionando.
- Aplicar noindex en páginas importantes: puede borrar tráfico orgánico valioso.
- No revisar plantillas: una etiqueta mal puesta puede afectar a cientos de URLs.
Checklist recomendado antes de aplicar directivas: revisa si la URL recibe tráfico orgánico, si tiene backlinks, si está en el sitemap, si tiene enlaces internos y si existe una alternativa mejor para redirigir.
Citation Capsule: La comparación noindex vs disallow debe resolverse por intención: noindex controla si una URL aparece en resultados; Disallow controla si los bots pueden rastrearla; noarchive solo limita la copia en caché.
Cómo comprobar si la directiva está funcionando
Google recomienda usar la herramienta de inspección de URLs de Search Console para comprobar si una página puede rastrearse, si está indexada y qué señales ha detectado Google.
Después de aplicar una directiva, revisa:
- Inspección de URL: confirma si Google puede rastrear la página.
- HTML renderizado: comprueba que la metaetiqueta aparece en el
<head>. - robots.txt Tester: valida si la ruta está bloqueada.
- Informe de indexación: revisa si aparece como excluida por
noindex. - Sitemap XML: elimina URLs no indexables del sitemap.
Un detalle importante: no esperes cambios instantáneos. Google necesita volver a rastrear la página para detectar noindex o noarchive. Con Disallow, el efecto sobre rastreo puede ser más rápido, pero la indexación puede tardar más en reflejarse.
Preguntas frecuentes sobre noindex, noarchive y disallow
¿Qué es mejor: noindex o disallow?
Depende del objetivo. Según Google, noindex sirve para impedir que una página aparezca en resultados, mientras que Disallow bloquea rastreo. Si quieres desindexar, usa noindex. Si quieres ahorrar rastreo, usa Disallow.
¿Puedo usar noindex y disallow juntos?
No suele ser recomendable si quieres que Google detecte el noindex. Google necesita rastrear la página para leer esa etiqueta. Si la bloqueas con Disallow, puede no verla.
¿Noarchive elimina una página de Google?
No. noarchive solo evita que se muestre una copia en caché de la página. La URL puede seguir indexada y aparecer en resultados si no tiene también una directiva noindex.
¿Disallow protege contenido privado?
No. robots.txt es una instrucción de rastreo, no una medida de seguridad. Para contenido privado, usa autenticación, contraseña, permisos de servidor o bloqueo real de acceso.
¿Cuándo usar X-Robots-Tag?
Úsalo cuando quieras aplicar directivas como noindex o noarchive a archivos no HTML, como PDFs, imágenes o documentos servidos desde cabeceras HTTP.
Lo que debes recordar para diferenciar noindex vs disallow
La diferencia entre noindex vs disallow se resume en una frase: noindex controla la aparición en Google; Disallow controla el rastreo. noarchive juega en otra liga: solo afecta a la copia en caché.
Si quieres quitar una página de los resultados, usa noindex. Si quieres evitar que Googlebot rastree zonas sin valor, usa Disallow. Si quieres evitar versiones almacenadas, usa noarchive.
Antes de tocar directivas, revisa tráfico, enlaces, sitemap y objetivo de negocio. Una línea mal puesta puede sacar del índice una página clave.
