Bloquear una URL en robots.txt no garantiza que Google olvide que existe. Si encuentra enlaces hacia esa dirección u otras referencias, puede llegar a conocer la URL aunque no rastree su contenido.
Por eso Search Console puede mostrar estados que parecen contradictorios.
1. Google puede conocer una URL sin leerla
Los enlaces internos, externos, sitemaps antiguos y otras señales pueden revelar una dirección al buscador.
2. robots.txt impide rastreo, no necesariamente indexación
Si Google no puede entrar, no ve el contenido completo de la página ni las directivas internas.
3. La URL puede aparecer con información limitada
En determinados casos puede mostrarse el enlace sin un fragmento normal de contenido, porque Google no ha podido rastrear la página.
4. Si quieres eliminarla del índice, noindex es más apropiado
Para que Google lea noindex, la página debe ser rastreable. Puede ser necesario permitir temporalmente el acceso para que procese la directiva.
5. Si la página no debería existir, considera su estado HTTP
Una URL eliminada definitivamente y sin sustituto puede devolver un estado adecuado de no disponible en lugar de mantenerse accesible.
6. No mezcles soluciones sin estrategia
Bloquear, redirigir y añadir noindex simultáneamente puede dificultar entender qué señal está siguiendo Google.
7. Revisa por qué Google descubre la URL
Si sigue apareciendo, busca enlaces internos, sitemaps o referencias que la mantengan viva.
8. Protege contenido privado correctamente
No utilices robots.txt para datos sensibles. Un área privada necesita autenticación o permisos de servidor.
9. Comprueba la URL después del cambio
La herramienta de inspección ayuda a verificar si Google puede rastrear y qué estado detecta.
10. Da tiempo para actualizar el índice
Después de cambiar reglas, Google necesita volver a procesar la URL. La desaparición no siempre es inmediata.
Conclusión
"Indexada aunque bloqueada por robots.txt" no es tan contradictorio como parece. El bloqueo afecta al rastreo, pero Google puede conocer la URL por otras vías. La solución depende de si quieres impedir acceso, impedir indexación o eliminar la página.
\[BOTÓN: Quiero corregir problemas de robots.txt e indexación\]
\[ENLACE INTERNO: robots.txt vs noindex: diferencias\]
\[ENLACE INTERNO: Qué hacer con páginas antiguas: 404, 301 o mantener\]
\[ENLACE INTERNO: Cómo saber por qué una página no aparece en Google\]
- indexada aunque bloqueada por robots.txt
- robots.txt Search Console
- URL indexada bloqueada
- noindex
- SEO técnico
- indexación Google
Elviria Digital
¿Lo llevamos a la práctica en tu negocio?
Somos una agencia de marketing digital en Marbella. Analizamos tu situación y te decimos qué haríamos primero, sin compromiso.
Pide tu reunión gratis