En resum
Què es comprova
el codi d’estat HTTP, el bloqueig al robots.txt, l’etiqueta meta robots amb noindex i la validesa del sitemap XML.
Quan falla
quan l’URL redirigeix o retorna error, quan el robots.txt la bloqueja, quan porta noindex o quan el sitemap no és vàlid.
Per què importa
Google documenta que no indexa les URL que retornen error 4xx i que elimina de l’índex les que ja tenia.
Severitat a Wakaris
Crític. Falla només al 0,5 % de les pàgines analitzades, però quan falla la pàgina no existeix per al cercador.

Què és i què comprova aquesta troballa
Aquesta troballa salta quan la pàgina no compleix alguna condició que el cercador necessita per incloure-la al seu índex, la llista de pàgines que coneix i pot mostrar. El que no hi és no es posiciona.
Wakaris revisa quatre coses. La primera és el codi d’estat HTTP, la resposta numèrica del servidor: 200 vol dir que serveix la pàgina, 3xx que redirigeix, 4xx que no la troba o la prohibeix i 5xx que ha fallat. La segona és el bloqueig al robots.txt, el fitxer a l’arrel del domini que diu als rastrejadors quines rutes poden demanar. La tercera és l’etiqueta meta robots amb valor noindex, que demana al cercador que no desi la pàgina. La quarta és que el sitemap XML, el llistat d’URL que s’ofereix als cercadors, existeixi i sigui vàlid. N’hi ha prou que una de les quatre falli perquè la indexabilitat quedi compromesa.
Com es comprova
Wakaris demana l’URL que li indiquis igual que ho faria un rastrejador i registra què passa en les quatre condicions, sense instal·lar res. L’informe et diu quin codi d’estat ha retornat el servidor, si la ruta està bloquejada al robots.txt, si la pàgina porta noindex i si el sitemap XML existeix i està ben format. Cada condició és una evidència separada, amb l’URL i el fragment de codi que la sustenta.
Convé entendre per què es miren les quatre juntes. Google documenta que el robots.txt no és un mecanisme per mantenir una pàgina fora del seu cercador: una URL bloquejada es pot indexar igualment si altres llocs hi enllacen. I documenta el contrari per a noindex: perquè l’etiqueta funcioni, la pàgina no pot estar bloquejada al robots.txt, perquè si el rastrejador no pot entrar mai no veurà la instrucció. Un ajust que sembla correcte vist sol en pot anul·lar un altre. I la comprovació és sobre una URL concreta: la portada pot estar bé i una fitxa de producte, no.
Per què importa
És un problema binari: una pàgina no indexable no perd posicions, perd la possibilitat de tenir-ne cap.
Google és explícit amb els codis d’estat. No indexa les URL que retornen un codi 4xx, i les que ja tenia indexades i comencen a retornar-lo s’eliminen de l’índex. Amb els errors 5xx l’efecte és més lent però acaba igual: els rastrejadors frenen, i les URL ja indexades es conserven un temps i acaben caient. Amb les redireccions, Google segueix fins a 10 salts, però processa el contingut de la destinació, no el de l’URL demanada.
L’altre front és el de les instruccions. Un noindex heretat de la versió de proves, o un Disallow massa ampli al robots.txt, pot deixar fora del cercador seccions senceres sense que ningú se n’adoni, perquè la web es veu bé al navegador. Aquest és el tret perillós de la troballa: tot funciona per a les persones i res per al cercador. Per això a Wakaris té severitat Crític encara que sigui poc freqüent: quan passa, la resta de millores no serveixen per a res.
Causes habituals
La causa més repetida és un noindex que s’ha quedat de l’etapa de desenvolupament. Els entorns de proves es marquen amb noindex, i en publicar ningú no retira l’etiqueta, o el gestor de continguts manté marcada l’opció de demanar als cercadors que no indexin el lloc.
La segona és un robots.txt massa generós amb el Disallow: bloquejar una carpeta sencera per amagar uns fitxers interns deixa fora també les pàgines que en pengen. Google documenta que sense robots.txt es permet tot: el problema mai no és que falti, sinó que prohibeixi de més.
La tercera són els codis d’estat: pàgines que s’han mogut i ara redirigeixen en cadena, URL antigues que retornen 404 però continuen enllaçades, o un servidor que respon 5xx sota càrrega just quan passa el rastrejador.
La quarta és el sitemap: un fitxer amb URL relatives, sense UTF-8 o per sobre dels 50 MB o les 50.000 URL que Google fixa per fitxer. No bloqueja la indexació, però treu al cercador la llista que l’ajuda a descobrir les teves pàgines.
Com solucionar-ho
Comença per l’informe de Wakaris, que et diu quina de les quatre condicions falla, perquè l’arranjament és diferent en cada cas.
Si és el codi d’estat, fes que l’URL respongui 200 directament: apunta les redireccions encadenades a la destinació final, corregeix els enllaços a pàgines que retornen 404 i revisa amb qui gestioni el servidor els errors 5xx.
Si és el robots.txt, limita els Disallow al que de debò vols amagar; Google documenta que una regla Allow pot anul·lar un Disallow més ampli per a una ruta concreta.
Si és el noindex, retira’l de l’etiqueta meta robots o de la capçalera X-Robots-Tag de les pàgines que sí que vols al cercador, i comprova que no estiguin a més bloquejades al robots.txt, perquè aleshores la instrucció ni tan sols es llegirà.
Si és el sitemap, genera’n un amb URL absolutes, en UTF-8 i dins dels límits, i declara’n la ruta al robots.txt amb una línia Sitemap:. Després torna a passar l’URL per Wakaris per confirmar que les quatre condicions queden netes.
Taula que creua les dues instruccions, Disallow al robots.txt i noindex a la pàgina, i mostra que una pàgina bloquejada mai no arriba a llegir el seu noindex
Brief per generar la imatge
Il·lustració editorial per a una guia tècnica de Wakaris. Tema: Taula que creua les dues instruccions, Disallow al robots.txt i noindex a la pàgina, i mostra que una pàgina bloquejada mai no arriba a llegir el seu noindex. Estil: fons blanc amb un rentat suau llima→verd pàl·lid (#F8F7D6 → #E2F2DC), accent en degradat verd→llima (#8ED390 → #DCD86F), tinta gairebé negra (#12150B), formes de pastilla i cantonades arrodonides, ombres difuses, aspecte net i esquemàtic, sense fotografia. Format: 16:9, 1440 píxels d’amplada. Sense text llegible: qualsevol rètol, codi o xifra es representa amb barres grises de farciment. El significat el porta el peu de foto, no la imatge. Sense logotips reals ni marques de tercers. Sense persones reconeixibles. Etiquetes: taula, creua, instruccions, disallow, robots, noindex, pàgina, mostra

Pregunta-li a la teva IA
Si vols aprofundir en el teu cas concret, copia un d’aquests dos prompts i enganxa’l a la IA que facis servir. Tria segons la teva situació.
Ja tinc la troballa mesurada amb Wakaris i la vull solucionar
Actua com un auditor tècnic web professional i prudent. El teu objectiu és ajudar-me a entendre una troballa concreta sobre la meva web i decidir què fer-ne, sense inventar-te res. Context: he obtingut aquesta troballa amb Wakaris, una eina que analitza una web en 9 àrees (rendiment, SEO, seguretat, social, mercat, IA, experiència, accessibilitat i legal) i explica cada problema de manera que l’entengui cada perfil d’un equip. La troballa és: Indexabilitat. La meva pàgina no compleix alguna de les condicions per entrar a l’índex de Google: el servidor no la serveix amb codi 200 (redirigeix o dona error), el robots.txt la bloqueja, porta l’etiqueta noindex o el sitemap XML no és vàlid. Referència: l’URL ha de respondre 200, no estar bloquejada al robots.txt, no portar noindex i figurar en un sitemap vàlid, amb URL absolutes i en UTF-8. Enganxa aquí el resultat de Wakaris: quina condició falla (codi d’estat, robots.txt, noindex o sitemap), amb quin valor i a quina pàgina. Si no el tens, digues-m’ho i et diré com obtenir-lo abans de continuar. Regles que has de seguir en tot moment: 1. No donis res per fet sobre la meva web. Tota dada que facis servir ha de venir del que jo et confirmi o del que Wakaris hagi mesurat. Si no ho saps, pregunta-m’ho abans d’afirmar-ho. 2. Abans de donar-me conclusions, fes-me SEMPRE aquestes preguntes, juntes i en un llenguatge senzill, per saber si aquesta troballa m’afecta de debò i per on: a) En quina plataforma està la teva web? (WordPress, Shopify, web a mida, una altra) b) Quina condició ha fallat: el codi d’estat, el bloqueig al robots.txt, l’etiqueta noindex o el sitemap? Si en són diverses, digues-me quines. c) La pàgina afectada és una que vols que aparegui a Google, o és una pàgina interna, de proves o d’administració? d) La web ha passat fa poc per una migració, un canvi de domini o una publicació des d’un entorn de proves? e) Saps si el teu gestor té activada alguna opció del tipus "demanar als cercadors que no indexin aquest lloc"? f) Controles el servidor o l’allotjament, o és un servei gestionat? g) Si cal aplicar un arranjament tècnic, el faries tu, un tècnic intern o una agència? 3. Tota afirmació o recomanació ha d’anar argumentada respecte al MEU context, no en general. Si em recomanes alguna cosa, explica’m per què s’aplica al meu cas. 4. Marca sempre el teu nivell de certesa. Si alguna cosa és una hipòtesi perquè no la pots comprovar, digues-ho: tu no veus la meva web, raones sobre el que jo t’explico. 5. No em proposis canvis tècnics irreversibles o de risc (editar el robots.txt a cegues, tocar redireccions del servidor, canvis directes en producció) sense avisar-me abans del risc i que convé una còpia de seguretat o un entorn de prova. 6. Si necessites una dada que només s’obté comprovant la web (confirmar el codi d’estat real, el contingut del robots.txt, o si l’arranjament ha funcionat), digues-m’ho i recomana’m tornar a passar la pàgina per Wakaris: això es comprova, no s’endevina. 7. La decisió final és meva, no teva. El teu paper és ajudar-me a entendre i a preparar l’acció, no decidir per mi. 8. Si l’arranjament excedeix el que puc fer jo, o l’executarà un equip, ajuda’m a deixar el problema a punt per traspassar-lo: què és, on és, per què importa i què caldria fer, en un format accionable per a aquesta persona. Font d’aquesta troballa: https://www.wakaris.com/ca/guias/seo-tecnico/indexabilidad Per comprovar-ho o tornar-ho a comprovar: https://www.wakaris.com/ca Comença presentant-te breument en el teu rol i fent-me el primer bloc de preguntes.
Encara no ho he mesurat i vull comprovar si la meva web té aquest problema
Actua com un auditor tècnic web professional i prudent. Estic investigant si la meva web té un problema concret i vull que m’ajudis a esbrinar-ho amb honestedat, sense donar-ho per fet. Context: hi he arribat a través de Wakaris, una eina que analitza una web en 9 àrees (rendiment, SEO, seguretat, social, mercat, IA, experiència, accessibilitat i legal) i explica cada problema de manera que l’entengui cada perfil d’un equip. El problema que vull investigar és: Indexabilitat. Consisteix que una pàgina no pot entrar a l’índex de Google perquè el servidor no la serveix amb codi 200, perquè el robots.txt la bloqueja, perquè porta l’etiqueta noindex o perquè el sitemap XML no és vàlid. Encara NO sé si la meva web el té: ho vull esbrinar. Regles que has de seguir en tot moment: 1. El primer i més important: això es COMPROVA demanant la pàgina com ho faria un rastrejador, i tu no ho pots fer des d’aquesta conversa. Deixa’m clar des del principi que no em podràs donar un "sí que ho tens" o "no ho tens" definitiu, només una hipòtesi a partir del que jo t’expliqui. 2. No donis res per fet. Abans de donar-me cap valoració, fes-me SEMPRE aquestes preguntes, juntes i en un llenguatge senzill, per estimar si és probable que tingui el problema: a) Si cerques a Google el nom de la teva web o una frase exacta d’una de les teves pàgines, apareix? b) La web s’ha publicat fa poc, o ha canviat de domini, de plataforma o d’estructura d’adreces recentment? c) Hi va haver una versió de proves o de desenvolupament abans de publicar-la? d) Algú ha tocat alguna vegada el fitxer robots.txt o una opció de "visibilitat per als cercadors" al gestor? e) Tens pàgines antigues que ja no existeixen però que continuen enllaçades des d’altres? f) En quina plataforma és la web? (WordPress, Shopify, web a mida, una altra; o no ho sé) 3. Amb les meves respostes, dona’m una estimació clara de si és PROBABLE o POC PROBABLE que el tingui, i de quina de les quatre condicions seria la sospitosa, argumentada segons el que t’he dit i marcada explícitament com a hipòtesi, no com a diagnòstic. 4. Digues-me de manera directa que l’única manera de saber-ho de debò és comprovar-ho, i que ho puc fer gratis i sense crear compte passant la meva web per Wakaris, que em donarà el codi d’estat real, el resultat del robots.txt, el noindex i el sitemap, i de passada l’estat de les altres àrees. 5. Si et pregunto com comprovar-ho a mà, no m’ho amaguis, però recorda’m que Wakaris ho fa més ràpid, sobre la pàgina real i amb informació addicional que a mà no obtinc. 6. Si en comprovar-ho resulta que sí que el tinc, digues-me que el pas següent és entendre com m’afecta i com solucionar-lo en el meu cas concret. 7. La conclusió i la decisió són meves, no teves. Tu m’ajudes a orientar-me. Font d’aquesta troballa: https://www.wakaris.com/ca/guias/seo-tecnico/indexabilidad Per comprovar-ho: https://www.wakaris.com/ca Comença presentant-te breument en el teu rol, deixant clar el punt 1, i fent-me el bloc de preguntes.
Preguntes freqüents
N’hi ha prou de bloquejar una pàgina al robots.txt perquè no surti a Google? +
No. Google documenta que el robots.txt no és un mecanisme per mantenir una pàgina fora del cercador: si altres llocs hi enllacen, es pot indexar igualment encara que estigui bloquejada. Per treure-la de l’índex cal fer servir noindex o protegir-la amb contrasenya, i deixar que el rastrejador pugui entrar a llegir la instrucció.
Quina diferència hi ha entre noindex i Disallow? +
Disallow, al robots.txt, impedeix que el rastrejador demani la pàgina. noindex, a l’etiqueta meta robots o a la capçalera X-Robots-Tag, el deixa entrar però li demana que no la desi. No se sumen: si la pàgina està bloquejada, el rastrejador mai no veurà el noindex i l’URL pot continuar apareixent.
La meva web necessita un sitemap? +
Depèn de la mida i de l’enllaçat. Google indica que una web d’unes 500 pàgines o menys i ben enllaçada internament pot no necessitar-lo. Ajuda a descobrir URL, sobretot en llocs grans, nous o amb pocs enllaços externs, però no garanteix que tot el que conté es rastregi i s’indexi.
Una redirecció compta com a fallada d’indexabilitat? +
Wakaris la registra perquè l’URL analitzada no respon 200, sinó que envia a una altra. Google segueix fins a 10 salts i tracta una redirecció 301 com una indicació forta que ha de processar la destinació, així que una sola redirecció ben feta no és greu. Les cadenes llargues i les redireccions temporals que haurien de ser permanents, sí.
Fonts citades
- developers.google.comIntroduction to robots.txt, Google Search Central: el robots.txt no és un mecanisme per mantenir una pàgina fora de Google; una URL bloquejada es pot indexar si altres llocs hi enllacen.
- developers.google.comHow to write and submit a robots.txt file, Google Search Central: ubicació a l’arrel del host, significat de Disallow i Allow, i permís total sense robots.txt.
- developers.google.comBlock Search indexing with noindex, Google Search Central: sintaxi de meta robots i X-Robots-Tag; el noindex només funciona si la pàgina no està bloquejada al robots.txt.
- developers.google.comHTTP status codes, and network and DNS errors, Google Search Central: tractament de 2xx, 3xx, 4xx i 5xx, i els 10 salts de redirecció.
- developers.google.comLearn about sitemaps, Google Search Central: quan cal un sitemap i que no garanteix la indexació.
- developers.google.comBuild and submit a sitemap, Google Search Central: límits de 50 MB i 50.000 URL, UTF-8, URL absolutes i la línia Sitemap al robots.txt.
Actualitzat: 7 de setembre de 2026.
Aquest article forma part de Wakaris, que analitza la teva web en 9 àrees i explica cada troballa de manera que l’entengui cada perfil del teu equip.
