«Bloquear una página» es una instrucción demasiado ambigua para una tarea SEO. Puede significar impedir que un crawler solicite el contenido, evitar que la página aparezca en resultados o simplemente ocultarla en una herramienta de análisis. Esas acciones pertenecen a sistemas diferentes y no deberían utilizarse como sinónimos.
Decide qué resultado necesitas
Robots.txt regula acceso de rastreo. Noindex indica que un recurso no debe indexarse cuando el buscador puede procesar esa instrucción. La guía de noindex explica por qué bloquear el rastreo puede impedir que Google llegue a ver la directiva.
Antes de cambiar nada, escribe el objetivo: «esta página de uso interno no debe aparecer en búsquedas» es distinto de «estas combinaciones generan demasiadas solicitudes». Además, robots.txt no es una medida de seguridad para proteger información privada; esa necesidad requiere control de acceso adecuado.
Revisa dónde está la instrucción
Comprueba el robots.txt del host correcto y las reglas que se aplican al crawler. Examina también las etiquetas robots del HTML y las cabeceras HTTP. Google documenta el uso de robots meta y X-Robots-Tag, incluida su aplicación a recursos que no son HTML.
No te limites al editor del CMS. Un plugin, una plantilla, el servidor o una CDN pueden añadir instrucciones. Guarda la respuesta observada y la fecha para poder comprobar si el cambio llega al entorno público.
Un conflicto frecuente
Un equipo publica noindex en una página y, al mismo tiempo, bloquea su rastreo. Después espera que la etiqueta sea procesada inmediatamente. La investigación debe comprobar si Google puede acceder a la instrucción y qué información conserva de la URL, en vez de añadir reglas cada vez más restrictivas sin un objetivo definido.
No existe una solución única para todo bloqueo. Un entorno privado requiere autenticación; una página pública que no debe indexarse exige otro análisis; una duplicidad puede requerir canonicalización.
Registra implementación y observación
- Objetivo acordado para la URL o grupo.
- Regla o directiva encontrada y lugar donde se genera.
- Cambio realizado y responsable.
- Respuesta pública después de desplegarlo.
- Inspecciones posteriores y fecha de cada observación.
Reindexa puede mostrar otros estados durante el seguimiento de URLs previamente guardadas. Utiliza esa señal para abrir una investigación técnica. No interpreta una exclusión de tu vista como una orden para Google ni modifica robots.txt por aplicar un filtro.
Al cerrar la tarea, distingue entre haber corregido la configuración y haber observado el resultado esperado en Google. Esa separación evita declarar un problema resuelto solo porque el código del sitio ya cambió.