Que un buscador haya visitado una página no significa que la haya incorporado a su índice. Y estar en el índice no garantiza aparecer para una consulta determinada. Separar estas etapas permite investigar una ausencia en Google sin cambiar directivas al azar.
Del descubrimiento a los resultados
| Etapa | Qué ocurre | Qué comprobar |
|---|---|---|
| Descubrimiento | El buscador conoce una URL mediante enlaces u otras fuentes. | Enlaces internos y sitemap. |
| Rastreo | Solicita recursos de la URL. | Acceso, respuesta HTTP y bloqueos. |
| Renderizado | Procesa la página y sus recursos, incluido JavaScript cuando corresponde. | Contenido y enlaces disponibles tras renderizar. |
| Indexación | Analiza el contenido y decide su incorporación y representación. | Directivas, duplicados y versión canonical. |
| Resultados | Selecciona respuestas para una búsqueda. | Pertinencia y contexto de la consulta. |
Este esquema describe funciones, no una garantía de que cada URL avance ni un calendario fijo. Google explica que puede descubrir páginas sin rastrearlas y procesarlas sin indexarlas. El rastreo y el renderizado pueden estar relacionados dentro del procesamiento de una página.
robots.txt controla acceso, no confidencialidad
Las reglas de robots.txt indican a los rastreadores compatibles qué rutas pueden solicitar. No son un sistema de autenticación. Una URL bloqueada puede seguir siendo conocida por enlaces externos, por lo que no conviene usar ese bloqueo como sustituto de una exclusión del índice.
Ejemplo hipotético: se quiere retirar de resultados una página pública y se añade noindex, pero la misma ruta está bloqueada en robots.txt. Google no podrá leer la directiva si no accede al recurso. El diagnóstico debe revisar ambas señales juntas antes de decidir la corrección.
noindex necesita ser leído
Google admite noindex mediante una metaetiqueta o una cabecera HTTP. Para procesarlo, necesita poder acceder a la respuesta. No es una instrucción de no visitar la página, sino de no incluirla en el índice. Por eso rastreo e indexación no son sinónimos.
Para contenido sensible, utiliza controles de acceso adecuados. No confíes en una directiva de buscadores para proteger documentos privados. Si el objetivo es resolver duplicados, estudia primero si procede una canonical, una redirección o mantener las variantes: son problemas diferentes.
Canonical, sitemap y redirecciones cumplen funciones distintas
La canonical propone una versión representativa de páginas duplicadas o muy similares. Google puede elegir otra según las señales disponibles. Contradicciones entre enlaces internos, sitemap y canonical dificultan interpretar qué URL prefieres.
El sitemap ayuda a comunicar URL que quieres dar a conocer, pero no obliga a indexarlas. Una redirección, en cambio, lleva una solicitud a otra ubicación. Una 301 expresa permanencia; una 302, temporalidad. Elige según la intención del traslado y comprueba el destino final.
Un diagnóstico ordenado en Search Console
- Empieza por la URL exacta, incluidos protocolo, ruta y parámetros.
- Consulta la información de la versión indexada y la fecha del último rastreo disponible.
- Revisa si el estado descrito corresponde a una exclusión esperada o a un problema.
- Utiliza la prueba en directo para comprobar el acceso actual, sin confundirla con una confirmación de indexación.
- Contrasta canonical declarada y seleccionada cuando esos datos estén disponibles.
- Comprueba una muestra de otras URL de la misma plantilla antes de concluir que el fallo es general.
La versión indexada puede reflejar un estado anterior a la última modificación. La prueba en directo responde a otra pregunta: qué se puede obtener ahora. Solicitar indexación tampoco garantiza que una página se incorpore ni cuándo ocurrirá.
Cómo interpretar dos escenarios habituales
Escenario ilustrativo A: una ficha nueva funciona en el navegador, pero no tiene enlaces internos y no aparece en el sitemap. Antes de reescribirla, mejora su descubrimiento y confirma que debe ser pública. El problema inicial puede ser de acceso a la URL dentro de la arquitectura.
Escenario ilustrativo B: una página es rastreable y muestra canonical hacia otra variante equivalente. Puede que la representación de esa otra URL sea coherente con el diseño. Investiga si la selección es la deseada antes de tratar la exclusión como un error.
Errores que conviene evitar
- Contar todas las exclusiones como fallos, aunque correspondan a duplicados o páginas no destinadas a búsqueda.
- Usar una consulta site: como único inventario de indexación.
- Suponer que un estado HTTP 200 garantiza contenido útil o inclusión.
- Bloquear recursos necesarios sin comprobar el contenido renderizado.
- Cambiar varias directivas a la vez sin registrar el estado previo.
- Interpretar una prueba en directo correcta como promesa de posicionamiento.
Documenta el síntoma, la etapa afectada, la evidencia y la prueba de aceptación. Para relacionar el diagnóstico con contenidos y prioridades, utiliza la guía SEO. Las definiciones de códigos y directivas están en el glosario.