← Volver al blog

La etiqueta Noindex, explicada: qué hace y cuándo usarla

La etiqueta Noindex, explicada: qué hace y cuándo usarla

Una etiqueta noindex es una instrucción que les dice a los buscadores que dejen una página fuera de sus resultados. Puede estar en el HTML como meta etiqueta robots o enviarse como cabecera HTTP, y se confunde a menudo con nofollow y con un Disallow del robots.txt, que hacen cosas distintas.

Usada a propósito, la noindex tag es una de las herramientas más prácticas del SEO técnico. Colocada por accidente en una página que trae tráfico, saca esa página de Google sin ningún mensaje de error ni cambio visible en la propia página.

Qué hace la etiqueta noindex y qué no hace

Cuando Googlebot rastrea una página y encuentra noindex, la página sale del índice. A partir de ahí no aparece para ninguna búsqueda, por muy bueno que sea su contenido o sus backlinks.

Los límites importan igual. noindex no impide el rastreo; de hecho, Googlebot tiene que descargar la página para poder leer la instrucción. No borra la página ni cambia nada para los visitantes, y no afecta directamente a otras páginas del sitio.

Hay un efecto secundario a largo plazo. Google ha explicado que una página que pasa mucho tiempo en noindex acaba rastreándose menos y que sus enlaces pasan a tratarse como si fueran nofollow. Por eso, un noindex prolongado en una página hub o de categoría puede debilitar el enlazado interno hacia las páginas que cuelgan de ella.

La meta etiqueta y la cabecera X-Robots-Tag

La meta etiqueta robots va en el <head>:

<meta name="robots" content="noindex">

name="robots" se aplica a todos los rastreadores que la respetan, mientras que name="googlebot" se dirige solo a Google. Las directivas se pueden combinar con una coma, como en content="noindex, follow", que mantiene la página fuera de los resultados pero deja que los rastreadores sigan sus enlaces (con la salvedad a largo plazo que acabamos de ver).

La misma instrucción se puede enviar como cabecera de respuesta HTTP:

X-Robots-Tag: noindex

La cabecera existe porque no todos los archivos tienen un <head>. Es la única forma de aplicar noindex a un PDF, una imagen o un archivo de texto plano. En Apache, una regla de .htaccess como esta lo aplica a todos los PDF del sitio:

<Files "*.pdf">
  Header set X-Robots-Tag "noindex"
</Files>

En Nginx, add_header X-Robots-Tag "noindex"; dentro de un bloque location hace lo mismo.

La cabecera es también donde se esconden los noindex no deseados. Nunca aparece en el código fuente, así que una página puede verse limpia en "Ver código fuente" mientras el servidor le dice a Google que la retire. Solo la verás en las cabeceras de respuesta, ya sea en la pestaña Network de las herramientas de desarrollo del navegador o con curl -sI contra la URL.

Noindex vs nofollow vs Disallow

Instrucción Dónde vive Qué controla Efecto
noindex Meta etiqueta o cabecera HTTP Indexación Mantiene la página fuera de los resultados de búsqueda
nofollow Meta etiqueta o atributo rel del enlace Enlaces Pide a los buscadores que no sigan los enlaces ni transmitan valor a través de ellos
Disallow robots.txt Rastreo Pide a los buscadores que no descarguen la URL en absoluto

La confusión que sale cara es la de noindex con Disallow. Una regla Disallow impide que Google descargue la URL, lo que significa que nunca podrá ver un noindex en esa página. La URL puede seguir indexada, normalmente sin descripción, porque Google sigue conociéndola por los enlaces. Para quitar una página de los resultados, déjala rastreable y usa noindex. Solo cuando ya haya salido del índice deberías añadir un Disallow, si además quieres que deje de rastrearse.

Una línea noindex dentro del robots.txt nunca fue una regla oficial, y Google dejó de tenerla en cuenta por completo en septiembre de 2019.

Si una página tiene que desaparecer de Google rápido, la herramienta Retiradas de Search Console la oculta de los resultados durante unos seis meses. Es temporal. Lo que hace que la retirada sea definitiva es el noindex o borrar la página.

Páginas que deberían llevar noindex

Para duplicados que tienen una versión principal clara, una etiqueta canonical suele ser mejor opción, porque concentra las señales en la URL principal en lugar de limitarse a descartar el duplicado.

Cómo acaba un noindex en la página equivocada

Casi siempre por un cambio que nadie relacionó con el SEO. Se copia a producción la configuración o la base de datos de staging y el noindex viaja con ella. En WordPress, la casilla "Disuadir a los motores de búsqueda de indexar este sitio" de Ajustes > Lectura sigue marcada después del lanzamiento. Una actualización o un restablecimiento de ajustes de un plugin SEO pasa un tipo de contenido entero a noindex. Un desarrollador añade una regla de cabecera para ocultar una sección en construcción y se olvida de ella en el lanzamiento.

La página sigue cargando con normalidad, así que nadie en el lado del cliente nota nada. Google vuelve a rastrear, lee la directiva y retira la URL, y la gráfica de tráfico lo muestra semanas después. Quitar la etiqueta lleva minutos. Lo que hace el daño es lo que se tarda en verla. La parte práctica de encontrarla la tratamos en cómo detectar un noindex en producción.

Comprobar y monitorizar la etiqueta noindex

Para una sola URL, la herramienta Inspección de URLs de Search Console es la comprobación más fiable. Indica si se permite la indexación y si el bloqueo viene de la meta etiqueta robots o de la cabecera X-Robots-Tag. El informe Indexación de páginas enumera todas las URLs que Google ha encontrado bajo "Excluida por la etiqueta 'noindex'", y merece la pena revisarlo después de cualquier release importante para confirmar que la lista solo contiene páginas que querías excluir.

Los dos dependen de que alguien decida mirar, y los dos reflejan el último rastreo de Google, no la página tal como está hoy. Deltio va por otro camino en los sitios de clientes. Revisa a diario las páginas de cada sitemap, lee el noindex tanto de la meta etiqueta como de la cabecera y avisa por Slack y email cuando una página que era indexable en la comprobación anterior ya no lo es. Los cambios en el robots.txt, los cambios de canonical y las URLs que salen del sitemap se comparan de la misma forma. Si quieres alertas limitadas a esos eventos, consulta alertas de cambios SEO, o prueba Deltio gratis durante 14 días.

Preguntas frecuentes

¿Cómo pongo en noindex una sola página en WordPress?
Con Yoast SEO, abre la página en el editor, ve a la sección Avanzado del panel de Yoast y responde No a "¿Permitir que los motores de búsqueda muestren este contenido en los resultados de búsqueda?". Con Rank Math, abre la pestaña Avanzado de su panel y marca No Index en Robots Meta. Los dos añaden la meta etiqueta robots solo a esa página.
¿Puede una página tener a la vez un noindex y un canonical que apunta a otra URL?
Puede, pero es mejor evitarlo. Un canonical dice que la página es un duplicado de otra URL cuyas señales deben consolidarse; un noindex dice que se retire esta página. Las dos envían señales contradictorias, así que elige la que corresponda a tu intención.
¿Bing respeta la etiqueta noindex?
Sí. Bing admite tanto la meta etiqueta robots como la cabecera X-Robots-Tag, y puedes dirigirte a él en concreto con name="bingbot" en la meta etiqueta.
¿Puedo hacer que una página salga de los resultados automáticamente en una fecha?
Google admite la directiva unavailable_after, por ejemplo <meta name="robots" content="unavailable_after: 2026-12-31">, o el mismo valor en una cabecera X-Robots-Tag. A partir de esa fecha la página deja de mostrarse en los resultados, algo útil para eventos y ofertas con fecha límite.
¿Una página con noindex debería seguir en el sitemap XML?
No. Un sitemap solo debería incluir las URLs que quieres indexar. Mantener en él una URL con noindex envía una señal contradictoria y llena de ruido el informe Indexación de páginas de Search Console.