PosicionamientoLimita

Directivas SEO en conflicto: cuando tu web le dice dos cosas distintas a Google

Tu web da instrucciones a los buscadores en cuatro sitios distintos, y basta con que dos se contradigan para que dejes de controlar qué se indexa. Este hallazgo salta justo cuando eso ocurre. Wakaris compara las cuatro y te dice cuál choca con cuál.

Por Juan Ignacio FrancoActualizado: 7 de septiembre de 20267 min de lectura

En resumen

Qué se comprueba

que robots.txt, la meta robots, la cabecera HTTP y la etiqueta canónica digan lo mismo.

El conflicto más caro

bloquear en robots.txt una página que lleva noindex.

Severidad en Wakaris

Importante. Aparece en el 78 % de las páginas analizadas.

Regla de desempate

entre reglas de robots contradictorias, gana la más restrictiva.

Cuatro capas de instrucciones a buscadores: robots.txt, meta robots, cabecera X-Robots-Tag y etiqueta canónica, con flechas que se contradicen
Cuatro sitios donde dar instrucciones, y ninguna garantía de que digan lo mismo.

Qué es y qué comprueba este hallazgo

Una página puede dar instrucciones a un buscador desde cuatro sitios, y cada uno actúa en una capa distinta. El fichero robots.txt decide si el rastreador puede entrar. La meta etiqueta robots y la cabecera X-Robots-Tag deciden si lo que ha leído puede indexarse. Y la etiqueta canónica dice qué URL representa a ese contenido cuando hay varias parecidas.

Como son capas separadas, nada impide combinarlas de forma incoherente. Ahí es donde salta este hallazgo: no porque falte una directiva, sino porque las que hay se estorban entre sí.

Hay una asimetría que conviene tener presente desde el principio. Las reglas de robots son órdenes; la canónica no. La documentación de Google la describe como una señal fuerte de cuál debería ser la URL canónica, y añade que ninguno de esos métodos es obligatorio. Wakaris marca este hallazgo con severidad Importante.

Cómo se comprueba

Wakaris analiza la URL que le indiques y cruza lo que dicen esas cuatro capas: lee la meta etiqueta de robots del HTML, la cabecera de la respuesta, el fichero robots.txt del dominio y la etiqueta canónica. Después compara las combinaciones que no pueden convivir y te devuelve cuál es el choque concreto.

El resultado tiene tres formas. Una es la combinación de noindex con una canónica que apunta a otra dirección, que es el caso al que el motor da nombre propio. Las otras dos describen instrucciones que restringen cosas distintas o que directamente son incompatibles entre sí.

Merece la pena saber cómo se resuelven algunos de esos choques, porque no todos acaban en empate. Cuando dos reglas de robots se contradicen, Google documenta que se aplica la más restrictiva: si una página lleva a la vez un límite de fragmento y una prohibición de fragmento, gana la prohibición. Y si hay reglas para rastreadores distintos, se acumulan las negativas.

Por qué importa

El conflicto más caro es también el más frecuente, y es contraintuitivo: bloquear en robots.txt una página que lleva noindex. Google lo advierte de forma explícita: para que la regla surta efecto, la página no puede estar bloqueada por robots.txt, porque si lo está el rastreador nunca verá la regla y la página aún puede aparecer en los resultados.

Es decir, el bloqueo no refuerza la orden: la anula. Y el efecto puede ser el contrario al buscado, porque Google puede indexar igualmente la URL de una página bloqueada y mostrarla sin descripción si hay enlaces que apunten a ella.

El otro frente es el de la canónica. Cuando una página pide no ser indexada y a la vez señala a otra como representativa, está dando dos órdenes con consecuencias distintas: una elimina, la otra consolida. Google desaconseja expresamente usar noindex para elegir la canónica dentro de un mismo sitio, porque bloquea la página de la búsqueda por completo en lugar de agrupar señales.

Causas comunes

Nadie escribe una contradicción a propósito. Se acumulan, y casi siempre por una de estas cuatro vías.

La primera son las migraciones y los rediseños. La configuración del entorno de pruebas, que bloquea todo para que no se indexe, viaja a producción y convive con las etiquetas nuevas.

La segunda son las capas superpuestas: el gestor de contenidos pone su meta etiqueta, un complemento de SEO pone la suya, el servidor añade una cabecera y nadie tiene la foto completa de las tres a la vez.

La tercera es querer esconder una sección y usar las dos herramientas por si acaso. Bloquear en robots.txt y además poner noindex parece más seguro y es justo lo que rompe el mecanismo.

La cuarta es declarar canónicas distintas por vías distintas. Google desaconseja especificar una URL canónica en un sitio y otra diferente por otro método, y advierte de que robots.txt no sirve para canonicalizar.

Cómo solucionarlo

El arreglo empieza por una decisión, no por el código: qué quieres exactamente con esa página. Wakaris te dice qué capas están en conflicto, que es de donde parte esa decisión.

Si no quieres que aparezca en la búsqueda, deja el noindex y quita el bloqueo del robots.txt. El rastreador tiene que poder entrar para leer la orden.

Si solo quieres ahorrar rastreo en una zona sin valor, usa el bloqueo y quita el noindex: no aporta nada donde nadie va a leerlo.

Si lo que tienes son versiones parecidas de lo mismo, el instrumento es la canónica, y solo ella. Que apunte a la misma URL desde todas las vías y no la mezcles con instrucciones de indexación.

Por último, comprueba antes de dar nada por hecho y ten paciencia: Google cachea el contenido del robots.txt hasta 24 horas, así que un cambio ahí no surte efecto al instante. Vuelve a pasar la página por Wakaris para confirmar que ya no hay choque.

Imagen pendiente · {IMG_2}

Tabla que relaciona el objetivo deseado con la capa correcta: no indexar, no rastrear o consolidar versiones duplicadas

Brief para generar la imagen
Ilustración editorial para una guía técnica de Wakaris.
Tema: Tabla que relaciona el objetivo deseado con la capa correcta: no indexar, no rastrear o consolidar versiones duplicadas.
Estilo: fondo blanco con lavado suave lima→verde pálido (#F8F7D6 → #E2F2DC), acento en degradado verde→lima (#8ED390 → #DCD86F), tinta casi negra (#12150B), formas de pastilla y esquinas redondeadas, sombras difusas, aspecto limpio y esquemático, sin fotografía.
Formato: 16:9, 1440 píxeles de ancho.
Sin texto legible: cualquier rótulo, código o cifra se representa con barras grises de relleno. El significado lo lleva el pie de foto, no la imagen.
Sin logotipos reales ni marcas de terceros. Sin personas reconocibles.
Etiquetas: directivas, seo, conflicto, tabla, relaciona, objetivo, deseado, capa
Cada objetivo tiene una capa. Usar dos a la vez es lo que produce el conflicto.
Tabla que relaciona el objetivo deseado con la capa correcta: no indexar, no rastrear o consolidar versiones duplicadas
Cada objetivo tiene una capa. Usar dos a la vez es lo que produce el conflicto.

Pregúntale a tu IA

Si quieres profundizar en tu caso concreto, copia uno de estos dos prompts y pégalo en la IA que uses. Elige según tu situación.

Prompt A

Ya tengo el hallazgo medido con Wakaris y quiero solucionarlo

Actúa como un auditor técnico web profesional y prudente. Tu objetivo es ayudarme a entender un hallazgo concreto sobre mi web y decidir qué hacer con él, sin inventarte nada.

Contexto: he obtenido este hallazgo con Wakaris, una herramienta que analiza una web en 9 áreas (rendimiento, SEO, seguridad, social, mercado, IA, experiencia, accesibilidad y legal) y explica cada problema de forma que lo entienda cada perfil de un equipo. El hallazgo es: Coherencia de directivas SEO. Mi página da instrucciones contradictorias a los buscadores entre el fichero robots.txt, la meta etiqueta robots, la cabecera X-Robots-Tag y la etiqueta canónica. Referencia: se considera fallo que una página lleve noindex con una canónica que apunta a otra dirección, o que las instrucciones restrinjan cosas distintas o sean incompatibles.

Pega aquí el resultado de Wakaris: qué conflicto te ha marcado, en qué página y entre qué capas. Si no lo tienes, dímelo y te diré cómo obtenerlo antes de seguir.

Reglas que debes seguir en todo momento:

1. No asumas nada sobre mi web. Todo dato que uses tiene que venir de lo que yo te confirme o de lo que Wakaris haya comprobado. Si no lo sabes, pregúntamelo antes de afirmarlo.
2. Antes de darme conclusiones, hazme SIEMPRE estas preguntas, juntas y en lenguaje sencillo, para saber si este hallazgo me afecta de verdad y por dónde:
   a) ¿Qué querías conseguir con esa página: que no salga en la búsqueda, ahorrar rastreo, o agrupar varias versiones parecidas en una sola?
   b) ¿En qué plataforma está tu web y llevas algún complemento de SEO instalado?
   c) ¿Alguien más puede tocar el robots.txt o las cabeceras del servidor aparte de ti?
   d) ¿La web ha pasado hace poco por una migración, un rediseño o una salida desde un entorno de pruebas?
   e) ¿Esa página recibe visitas desde la búsqueda hoy, o te da igual perderlas?
   f) Si hay que tocar el servidor o la plantilla, ¿lo harías tú, un técnico interno o una agencia?
3. Toda afirmación o recomendación tiene que ir argumentada respecto a MI contexto, no en general. Si me recomiendas algo, explícame por qué aplica a mi caso.
4. Marca siempre tu nivel de certeza. Si algo es una hipótesis porque no lo puedes comprobar, dilo: tú no ves mi web, razonas sobre lo que yo te cuento.
5. Avísame del riesgo antes de proponerme cambios. Quitar o poner una de estas instrucciones puede sacar de la búsqueda páginas que hoy traen visitas, o meter en ella páginas que no quiero: conviene revisarlo página a página y no de golpe.
6. Si necesitas un dato que solo se obtiene analizando la web (qué hay publicado en cada capa ahora mismo, o si el cambio ha surtido efecto), dímelo y recomiéndame volver a pasar la página por Wakaris: eso se comprueba, no se adivina.
7. La decisión final es mía, no tuya. Tu papel es ayudarme a entender y a preparar la acción, no decidir por mí.
8. Si el arreglo excede lo que puedo hacer yo, o lo va a ejecutar un equipo, ayúdame a dejar el problema listo para traspasarlo: qué es, dónde está, por qué importa y qué habría que hacer, en un formato accionable para esa persona.

Fuente de este hallazgo: https://www.wakaris.com/es/guias/seo-tecnico/coherencia-de-directivas-seo
Para comprobarlo o volver a comprobarlo: https://www.wakaris.com/

Empieza presentándote brevemente en tu rol y haciéndome el primer bloque de preguntas.
Pégalo en la IA que uses.
Prompt B

Aún no lo he medido y quiero comprobar si mi web tiene este problema

Actúa como un auditor técnico web profesional y prudente. Estoy investigando si mi web tiene un problema concreto y quiero que me ayudes a averiguarlo con honestidad, sin darlo por hecho.

Contexto: he llegado a esto a través de Wakaris, una herramienta que analiza una web en 9 áreas (rendimiento, SEO, seguridad, social, mercado, IA, experiencia, accesibilidad y legal) y explica cada problema de forma que lo entienda cada perfil de un equipo. El problema que quiero investigar es: directivas SEO en conflicto. Consiste en que las instrucciones que mi web da a los buscadores desde el robots.txt, la meta etiqueta robots, la cabecera X-Robots-Tag y la etiqueta canónica se contradigan entre sí. Todavía NO sé si mi web lo tiene: quiero averiguarlo.

Reglas que debes seguir en todo momento:

1. Lo primero y más importante: esto se comprueba leyendo el código y las cabeceras de mis páginas y el fichero robots.txt de mi dominio, y tú no puedes hacerlo desde esta conversación. Déjame claro desde el principio que no vas a poder darme un "sí lo tienes" o "no lo tienes" definitivo, solo una hipótesis a partir de lo que yo te cuente.
2. No asumas nada. Antes de darme ninguna valoración, hazme SIEMPRE estas preguntas, juntas y en lenguaje sencillo, para estimar si es probable que tenga el problema:
   a) ¿Tienes páginas que quieras mantener fuera de la búsqueda: zonas privadas, resultados de filtros, páginas de gracias?
   b) ¿Sabes si alguien bloqueó alguna sección en el fichero robots.txt?
   c) ¿Llevas un complemento de SEO que ponga etiquetas por su cuenta?
   d) ¿La web ha pasado por una migración, un rediseño o una salida desde un entorno de pruebas en los últimos meses?
   e) ¿Has notado que páginas que creías ocultas aparezcan en la búsqueda, o al revés, que páginas importantes hayan desaparecido?
3. Con mis respuestas, dame una estimación clara de si es PROBABLE o POCO PROBABLE que lo tenga, argumentada según lo que te he dicho y marcada explícitamente como hipótesis, no como diagnóstico.
4. Dime de forma directa que la única manera de saberlo de verdad es comprobarlo, y que puedo hacerlo gratis y sin crear cuenta pasando mi web por Wakaris, que me dirá qué dice cada capa, dónde está el choque y de paso el estado de las otras áreas.
5. Si te pregunto cómo comprobarlo a mano, no me lo ocultes, pero recuérdame que Wakaris lo hace más rápido, cruzando las cuatro capas a la vez y con información adicional que a mano no obtengo.
6. Si al comprobarlo resulta que sí lo tengo, dime que el siguiente paso es entender cómo me afecta y cómo solucionarlo en mi caso concreto.
7. La conclusión y la decisión son mías, no tuyas. Tú me ayudas a orientarme.

Fuente de este hallazgo: https://www.wakaris.com/es/guias/seo-tecnico/coherencia-de-directivas-seo
Para comprobarlo: https://www.wakaris.com/

Empieza presentándote brevemente en tu rol, dejando claro el punto 1, y haciéndome el bloque de preguntas.
Pégalo en la IA que uses.

Preguntas frecuentes

¿Por qué no funciona bloquear en robots.txt una página con noindex? +

Porque el bloqueo impide que el rastreador entre, y la orden de no indexar está dentro de la página. Google lo dice claro: si está bloqueada, el rastreador nunca verá la regla y la página aún puede aparecer en los resultados. El bloqueo anula la orden.

¿Robots.txt saca una página del índice? +

No. Solo controla el rastreo. Google documenta que no puede indexar el contenido de las páginas bloqueadas, pero sí puede indexar la URL y mostrarla en los resultados sin descripción. Para sacarla de verdad hace falta el noindex, y que el rastreador pueda leerlo.

¿Puedo usar noindex para elegir la versión buena de una página duplicada? +

Google lo desaconseja de forma expresa: bloquea la página de la búsqueda por completo en lugar de consolidar las señales de las versiones. Para eso está la etiqueta canónica, que agrupa las variantes y conserva el valor acumulado de todas ellas.

Si dos reglas se contradicen, ¿cuál gana? +

Entre reglas de robots, Google aplica la más restrictiva: con un límite de fragmento y una prohibición de fragmento a la vez, gana la prohibición. Y si hay reglas dirigidas a rastreadores distintos, las negativas se acumulan en lugar de cancelarse.

Fuentes citadas

  • developers.google.comBlock Search indexing with noindex, Google Search Central: para que el noindex funcione la página no puede estar bloqueada por robots.txt, y si lo está el rastreador nunca verá la regla.
  • developers.google.comRobots meta tag, data-nosnippet, and X-Robots-Tag specifications, Google Search Central: ante reglas contradictorias se aplica la más restrictiva, y las reglas para rastreadores distintos se acumulan.
  • developers.google.comHow to specify a canonical URL, Google Search Central: la canónica es una señal fuerte y no una obligación; no usar noindex para canonicalizar ni robots.txt con ese fin; no declarar canónicas distintas por vías distintas.
  • developers.google.comIntroduction to robots.txt, Google Search Central: una URL bloqueada puede indexarse igualmente sin descripción, y el fichero se cachea hasta 24 horas.
Retrato de Juan Ignacio Franco

Juan Ignacio FrancoAnalista de datos · Bitanube

Juan Ignacio Franco es analista de datos en Bitanube. Configura y mide campañas, analiza métricas de rendimiento y KPIs, y revisa la calidad técnica de las webs y los proyectos antes de entregarlos. Los hallazgos de estas guías son los que aparecen en ese trabajo.

Actualizado: 7 de septiembre de 2026.

Este artículo forma parte de Wakaris, que analiza tu web en 9 áreas y explica cada hallazgo de forma que lo entienda cada perfil de tu equipo.

Compartir esta guía
Empieza ahora

Tu web tiene mucho que contarte
Y por fin vas a entenderla

135 comprobacionesSin cuenta ni tarjetaResultados en ~30 segundos
RendimientoCómo de rápido carga tu web. Si tarda, pierdes visitas y ventas antes de que te vean.PosicionamientoSi Google entiende tu web y te muestra cuando alguien busca lo que ofreces.SeguridadSi tu web está protegida. Un fallo aquí espanta a clientes y a Google por igual.PresenciaCómo apareces en Google, redes y mapas. Es la primera imagen que das antes de que te contacten.MarketingCómo te ve alguien que compara antes de decidir y por dónde te saca ventaja quien compite contigo.Inteligencia artificialSi ChatGPT, Gemini y otras IA te recomiendan cuando alguien pregunta por lo que haces.ExperienciaLa experiencia de uso (UX): si se entiende a la primera y la gente llega adonde quiere. Una web confusa se abandona aunque cargue rápido.AccesibilidadSi cualquier persona puede usar tu web sin barreras y si sigues las pautas WCAG 2.2. Más público que te entiende.LegalSi cumples con cookies y protección de datos. Evita sanciones y multas que duelen.

Suri

Asistente de Wakaris