¿Qué es noindex?
Visibilidad en buscadores, rastreo y datos estructurados
noindex es una directiva que solicita a los motores de búsqueda que no incluyan una página o recurso en sus resultados. Se establece mediante una etiqueta meta robots en el encabezado HTML de las páginas web, o con un encabezado HTTP X-Robots-Tag para archivos que no son HTML, como PDFs e imágenes. Para que funcione, el rastreador debe poder acceder a la página y leer la instrucción, por lo que bloquear la misma URL en robots.txt la anula. noindex controla la inclusión en los resultados, no el acceso, de modo que no es un mecanismo de privacidad para datos sensibles.
Revisado por Jackie, Head of Learning & Development, Levellers - Última revisión: 8 de junio de 2026
Qué significa esto
noindex es la instrucción que dice: puedes ver esta página, pero no la incluyas en tu catálogo. Un motor de búsqueda que cumpla la directiva y lea la instrucción eliminará la página de sus resultados, aunque otros sitios enlacen a ella.
Hay un problema que confunde a muchos equipos. El rastreador debe tener permiso para acceder a la página y poder leer la instrucción noindex. Si además se bloquea la página en robots.txt, el rastreador nunca la lee, nunca ve el noindex y la página puede seguir apareciendo en los resultados. Los dos controles cumplen funciones distintas: robots.txt gestiona el rastreo, y noindex gestiona si una página rastreada se incluye en los resultados.
Por qué es importante
noindex es la herramienta adecuada para páginas que son accesibles pero no aportan valor en la búsqueda. Por ejemplo, restos de entornos de pruebas, páginas de utilidad con filtros, rutas duplicadas, páginas de aterrizaje de campañas caducadas, marcadores de posición, resultados de búsqueda interna y páginas con poco contenido. Mantener estas páginas fuera de los resultados mejora la imagen del sitio y evita que compitan con las páginas que realmente importan.
El riesgo comercial opera en ambas direcciones. Aplicar noindex por accidente a través de una plantilla puede eliminar silenciosamente páginas importantes de la búsqueda. No aplicarlo donde corresponde hace que páginas de escaso valor saturen los resultados y distorsionen la imagen que un motor de búsqueda construye del sitio. Dado que la directiva es poderosa y suele establecerse en plantillas compartidas, requiere una gestión deliberada y una verificación antes de publicar.
Cómo funciona
Dos formas de configurarlo
Para una página HTML, se coloca una etiqueta meta robots en el encabezado del documento; por ejemplo, una etiqueta meta robots con el valor de contenido noindex. Para archivos que no son HTML, como PDFs, imágenes y vídeos, no hay un encabezado HTML que editar, por lo que se devuelve un encabezado HTTP X-Robots-Tag con el valor noindex. Ambos métodos se tratan de la misma manera una vez que el rastreador detecta la directiva. El X-Robots-Tag también es útil para aplicar reglas de forma masiva a un tipo de archivo.
El rastreador debe poder verlo
Para que noindex surta efecto, la página o el recurso no deben estar bloqueados por robots.txt y deben ser accesibles para el rastreador. Si la URL está bloqueada, el rastreador no puede acceder a ella, no puede leer la directiva y la URL puede seguir apareciendo en los resultados cuando otras páginas enlazan a ella. La línea noindex no oficial de robots.txt nunca fue compatible con Google y dejó de funcionar el 1 de septiembre de 2019, por lo que noindex debe entregarse a través de la página o del encabezado HTTP.
Diferencias con controles relacionados
Una etiqueta canonical indica a un motor de búsqueda cuál de varias URLs similares es la preferida para indexar. Consolida los duplicados y es una sugerencia, no una instrucción de eliminación. Combinar noindex con una canonical que apunta a otro lugar envía señales contradictorias y puede interpretarse de forma incorrecta. La eliminación y la protección con contraseña son opciones distintas. Eliminar una página o ponerla detrás de un inicio de sesión mantiene el contenido completamente inaccesible, que es la vía adecuada para material genuinamente privado.
Eliminación rápida y el problema del renderizado
En casos urgentes, la herramienta de eliminaciones del motor de búsqueda puede ocultar temporalmente una URL de los resultados durante unos seis meses mientras se aplica una solución permanente, y también borra la copia en caché. Para que la eliminación sea permanente, hay que aplicar noindex en una página rastreable, o eliminar la página y devolver un 404 o 410. También conviene conocer un problema relacionado con JavaScript. Cuando un motor de búsqueda detecta una instrucción noindex en el HTML inicial, puede omitir el renderizado y no ejecutar JavaScript, por lo que intentar añadir o eliminar noindex posteriormente con JavaScript no es fiable. Si se quiere que una página sea indexada, no se debe incluir noindex en el código original de la página.
Ejemplos
Un equipo lanza una campaña con varias páginas de aterrizaje temporales. Cuando la campaña termina, aplican noindex a las páginas caducadas para que dejen de aparecer en los resultados, pero las mantienen accesibles para quienes tengan un enlace directo.
Un sitio aloja documentos internos como PDFs que no deben aparecer en la búsqueda. Como un PDF no tiene encabezado HTML, configuran el servidor para que devuelva un encabezado X-Robots-Tag noindex para esos archivos, aplicado de forma masiva a todo el directorio.
Una empresa descubre un conjunto antiguo de páginas con poco contenido que siguen posicionando y confunden a los visitantes. Confirman que las páginas no están bloqueadas en robots.txt, aplican noindex y utilizan la herramienta de eliminaciones para ocultarlas temporalmente mientras la directiva se recoge en el siguiente rastreo.
Malentendidos frecuentes
El malentendido más perjudicial es tratar noindex como un control de privacidad. Solo determina si una página aparece en los resultados, no si se puede acceder a ella. Cualquier persona con la URL puede seguir abriendo la página, por lo que los datos privados requieren autenticación, un entorno restringido o la eliminación del contenido.
Un segundo error es combinar noindex con un bloqueo en robots.txt, lo que impide que el rastreador vea la directiva.
Un tercer error es asumir que JavaScript puede añadir o eliminar noindex de forma fiable después de que la página se cargue. No puede hacerlo, porque el motor de búsqueda puede decidir no renderizar la página en absoluto.
Un cuarto error es confundir noindex con canonical. Uno solicita la eliminación; el otro expresa una preferencia entre duplicados, y no deben aplicarse juntos a la misma URL.
Riesgos y límites
El mayor riesgo es un noindex accidental a través de una plantilla compartida, que puede eliminar secciones enteras de un sitio de la búsqueda sin que nadie lo note hasta que el tráfico cae.
El segundo es la trampa de combinar robots.txt con noindex, donde bloquear la URL impide que la directiva sea leída.
El tercero es el problema de JavaScript, donde un noindex en el HTML inicial lleva al motor de búsqueda a omitir el renderizado, lo que hace que cualquier cambio posterior basado en scripts sea impredecible.
El límite de gobernanza es relevante para las organizaciones del Reino Unido que gestionan datos personales. noindex no satisface las obligaciones de protección de datos. Cuando alguien ejerce el derecho de supresión, o cuando los datos personales deben controlarse, la Oficina del Comisionado de Información espera una supresión o restricción real de los datos, no simplemente ocultar una página de los resultados de búsqueda.
Próximos pasos
Clasifica las URLs en cuatro grupos: páginas que deben mantenerse indexadas, páginas a las que aplicar noindex pero mantener accesibles, páginas que deben eliminarse por completo y páginas que deben protegerse con controles de acceso. La herramienta adecuada se desprende del grupo al que pertenece cada página.
Audita las plantillas que insertan etiquetas meta robots, ya que un solo error en una plantilla puede afectar a miles de páginas. Establece una verificación previa a la publicación que inspeccione el HTML en producción y los encabezados HTTP de las páginas clave, confirmando que noindex está presente solo donde se desea y ausente donde no corresponde. Para todo lo que implique datos personales o confidenciales, trata la supresión o el control de acceso como el requisito principal, y noindex como una medida de orden, no como una salvaguarda.
¿Tienes alguna pregunta o sugerencia, o quieres saber cómo investigamos y revisamos estas guías? Lee sobre nuestros estándares editoriales y cómo contactarnos.
Preguntas frecuentes
¿Cómo aplico noindex a un PDF o una imagen?
No es posible incluir una etiqueta meta dentro de un PDF o una imagen, por lo que hay que devolver un encabezado HTTP X-Robots-Tag con el valor noindex para esos archivos. Esto puede aplicarse de forma masiva a un tipo de archivo a nivel de servidor.
¿Por qué una página a la que apliqué noindex sigue apareciendo en la búsqueda?
Normalmente porque el rastreador no la ha vuelto a visitar desde que se añadió la directiva, o porque la página está bloqueada en robots.txt y el rastreador no puede ver el noindex. Permite el rastreo, confirma que la etiqueta está activa y solicita un nuevo rastreo.
¿Debo usar noindex para páginas de campañas caducadas?
Sí, si quieres que sean accesibles mediante enlace directo pero que no aparezcan en la búsqueda. Aplica noindex dejando la página rastreable. Si no deben ser accesibles en absoluto, elimínalas y devuelve un 404 o 410.
¿Es suficiente noindex para mantener algo privado?
No. noindex solo impide que una página aparezca en los resultados. La página sigue siendo accesible para cualquier persona con la URL. Utiliza autenticación, un entorno restringido o la eliminación para datos privados o personales.
¿Cuál es la diferencia entre noindex y canonical?
noindex solicita a un motor de búsqueda que elimine una página de los resultados. Una etiqueta canonical indica la versión preferida entre páginas similares para que los duplicados se consoliden. No deben aplicarse juntos a la misma URL, ya que eso envía señales contradictorias.
¿Puedo bloquear una página en robots.txt y añadir noindex para mayor seguridad?
No. Si robots.txt bloquea la URL, el rastreador no puede acceder a la página y nunca ve el noindex, por lo que la página puede permanecer en los resultados. Permite el rastreo hasta que la página desaparezca de los resultados y, si lo deseas, bloquea la ruta después.
¿Por qué debo evitar establecer noindex con JavaScript?
Si un noindex aparece en el HTML inicial, el motor de búsqueda puede omitir el renderizado y no ejecutar el JavaScript, por lo que los cambios basados en scripts no son fiables. Mantén noindex fuera del código original de cualquier página que quieras indexar.
¿Cómo elimino una página rápidamente?
Utiliza la herramienta de eliminaciones del motor de búsqueda para una ocultación temporal de unos seis meses y, a continuación, hazla permanente aplicando noindex en una página rastreable, o eliminando la página y devolviendo un 404 o 410.
Fuentes
Block Search Indexing with noindex (Google Search Central). The definition of noindex, the meta robots tag and X-Robots-Tag header methods, and the requirement that the page must be crawlable and not blocked by robots.txt for the rule to be seen.
HTML Living Standard, meta name=robots (WHATWG). The standard definition of the robots meta tag and its values, including noindex, in HTML.
RFC 9309: Robots Exclusion Protocol (Internet Engineering Task Force (IETF)). The principle that crawl control and indexing control are separate and that the robots protocol is not a content security measure.
Right to erasure (Information Commissioner's Office (ICO)). The UK data protection boundary that personal data must be genuinely erased or restricted, not merely hidden from search.
