Desindexar una URL a Google i bloquejar-la amb robots.txt no són el mateix. De fet, utilitzar malament qualsevol de les dues opcions pot provocar errors SEO importants: pàgines que continuen apareixent a Google, URLs que no desapareixen mai o continguts que Google interpreta de manera incorrecta.
Un dels errors més habituals en SEO tècnic és pensar que bloquejar una URL amb robots.txt fa que desaparegui automàticament del cercador. No funciona així.
Si el que necessites és eliminar una pàgina de l’índex de Google, has d’entendre com funciona realment el procés de desindexació. De fet, en aquesta guia sobre com deixar d’aparèixer a Google pots veure quins mètodes existeixen i quan convé utilitzar cadascun.
La diferència és clau perquè Google tracta de manera diferent les pàgines bloquejades i les pàgines desindexades. I això afecta directament el rastreig, la indexació i la visibilitat del teu lloc web.
A SEO Fiable et podem ajudar tant a desindexar com a saber què està frenant el posicionament web de la teva empresa a través de les nostres auditories SEO completes.
Què significa desindexar una URL a Google
Desindexar una URL a Google significa demanar al cercador que elimini aquella pàgina dels seus resultats de cerca. És a dir, la URL deixa d’aparèixer indexada encara que continuï existint dins del teu web.
Això es pot fer mitjançant diferents mètodes:
- Etiqueta noindex.
- Capçaleres HTTP X-Robots-Tag.
- Eina de retirada temporal a Search Console.
- Codis d’estat com 404 o 410.
La clau és entendre que Google necessita poder accedir a la URL per processar correctament una instrucció de desindexació. Si bloqueges abans el rastreig, Google podria no arribar a interpretar mai el noindex.
Segons la documentació oficial de Google Search Central, una pàgina bloquejada per robots.txt encara pot aparèixer indexada si Google descobreix la URL mitjançant enllaços externs o interns. En aquests casos, el cercador pot mostrar la URL sense contingut o amb informació limitada.
A més, Google va confirmar fa anys que l’ús de noindex continua sent una de les formes més fiables per eliminar contingut de l’índex quan la URL continua accessible per al rastreig.
Diferència real entre desindexar una URL a Google i bloquejar-la amb robots.txt
Aquí és on acostuma a aparèixer la confusió.
El fitxer robots.txt serveix per controlar el rastreig, no la indexació. És a dir, diu a Google quines URLs no hauria de rastrejar, però no obliga el cercador a eliminar-les dels seus resultats.
En canvi, quan desindexes una URL mitjançant noindex o Search Console, estàs enviant una instrucció orientada directament a la indexació.
| Acció | Què controla | Pot continuar apareixent a Google? |
|---|---|---|
| Bloqueig amb robots.txt | Rastreig | Sí |
| Noindex | Indexació | No |
| Retirada a Search Console | Ocultació temporal | Pot tornar si no s’aplica noindex |
Aquest detall és especialment important perquè molts projectes bloquegen URLs des de robots.txt esperant que desapareguin de l’índex. I el resultat acostuma a ser el contrari: Google deixa de rastrejar-les, però continua mantenint referències indexades durant mesos.
Google va explicar a la seva documentació oficial sobre robots.txt que bloquejar una pàgina no evita necessàriament que aparegui als resultats si existeixen enllaços que hi apunten.
A més, estudis de rastreig realitzats per eines com Ahrefs i Screaming Frog mostren que una gran part dels errors d’indexació en projectes mitjans provenen precisament de conflictes entre directives noindex i bloquejos a robots.txt.
En SEO tècnic això acostuma a traduir-se en tres problemes habituals:
- URLs bloquejades que continuen indexades.
- Pàgines que Google no pot processar correctament.
- Pressupost de rastreig desaprofitat.
Casos on es sol utilitzar malament robots.txt o la desindexació
A la pràctica, aquests errors apareixen constantment en projectes reals, especialment en migracions, ecommerce o webs amb molts filtres indexables.
Un ecommerce que va bloquejar filtres esperant desindexar-los
Un ecommerce de moda va detectar milers d’URLs indexades generades per filtres interns. La solució inicial va ser bloquejar aquestes carpetes des de robots.txt.
El problema va ser que les URLs continuaven apareixent a Google mesos després perquè encara rebien enllaços interns i senyals externs.
La solució correcta va consistir a permetre temporalment el rastreig, aplicar noindex i reduir l’enllaçabilitat interna d’aquestes pàgines fins que Google les va acabar eliminant de l’índex.
Una migració on Google continuava mostrant URLs antigues
Durant una migració web, un projecte va decidir bloquejar mitjançant robots.txt totes les URLs antigues abans d’implementar correctament les redireccions.
El resultat va ser que Google no podia rastrejar les pàgines antigues ni entendre els senyals de substitució. Moltes URLs van romandre indexades durant setmanes mostrant títols obsolets.
Quan es va eliminar el bloqueig i es van aplicar redireccions 301 correctament, Google va processar la migració molt més ràpidament.
Un web corporatiu que volia ocultar PDFs interns
Una empresa tenia documents PDF interns que apareixien a Google i va decidir bloquejar la carpeta des de robots.txt.
El problema va ser que els PDFs continuaven indexats perquè Google ja coneixia les seves URLs.
La solució va consistir a utilitzar capçaleres HTTP X-Robots-Tag amb noindex perquè Google pogués processar correctament l’exclusió de l’índex.
Errors habituals en desindexar una URL a Search Console
Search Console pot ajudar a ocultar URLs ràpidament, però moltes vegades s’utilitza malament.
L’eina de retirada temporal no elimina permanentment una pàgina de l’índex. Només l’oculta durant un temps limitat si no existeix una instrucció addicional.
Aquests són alguns errors freqüents:
- Bloquejar la URL abans d’aplicar noindex.
- Utilitzar només Search Console pensant que l’eliminació és permanent.
- Mantenir URLs indexables dins de l’enllaçat intern.
- Oblidar redireccions o codis HTTP correctes.
- Confondre rastreig amb indexació.
En la majoria de casos, Google necessita temps per processar correctament els canvis. Per això convé revisar logs, rastreig i estat d’indexació abans de prendre decisions agressives a robots.txt.
Preguntes freqüents sobre desindexar una URL a Google
Bloquejar una URL amb robots.txt fa que desaparegui de Google?
No. Robots.txt només controla el rastreig. Si Google ja coneix la URL mitjançant enllaços o altres senyals, encara pot mantenir-la indexada.
Quina és la millor manera de desindexar una URL a Search Console?
El més recomanable és combinar la retirada temporal amb una instrucció permanent com noindex, redirecció o eliminació real de la pàgina.
Google necessita rastrejar una URL per processar un noindex?
Sí. Si la URL està bloquejada per robots.txt, Google pot no arribar a interpretar mai la directiva noindex.
Idees finals sobre les diferències entre desindexar una URL a Google i bloquejar-la amb robots.txt
La diferència entre desindexar una URL a Google i bloquejar-la amb robots.txt és molt més important del que sembla.
Robots.txt serveix per controlar el rastreig. La desindexació serveix per eliminar contingut de l’índex. Confondre totes dues coses provoca molts dels errors tècnics més habituals en SEO.
Abans de bloquejar qualsevol URL, assegura’t d’entendre què necessites realment: evitar el rastreig, eliminar la indexació o totes dues coses al mateix temps.
