La cadena básica es sencilla: el buscador debe descubrir una URL, poder cargarla, entender cuál es la versión canónica y tener permiso para indexarla. Si esa cadena se rompe, el diseño de la página no lo arregla.
Descubrir no es lo mismo que indexar
Un buscador puede conocer una URL sin incluirla en el índice. Los enlaces y sitemaps ayudan a descubrir; la calidad y las señales técnicas influyen en la indexación.
robots.txt y noindex hacen cosas distintas
robots.txt controla el rastreo. noindex indica que la página no debe mantenerse en el índice cuando el buscador puede procesar esa instrucción.
Haz coherentes los canonicals
Enlaces internos, sitemap y redirects deberían apoyar en general la misma URL preferida. No uses canonical como parche universal para páginas pobres o duplicadas.
Mantén limpio el sitemap
Incluye URLs canónicas, indexables y con respuesta correcta. Saca redirects, 404, duplicados por parámetros y páginas que has decidido excluir.
Usa bien los códigos HTTP
200 para páginas activas, redirects para contenido movido y errores apropiados para URLs eliminadas. Evita soft 404 y cadenas largas de redirecciones.
Preguntas frecuentes
¿Enviar un sitemap garantiza indexación?
No. Ayuda a descubrir URLs, pero el buscador decide qué rastrear e indexar.
¿Todas las páginas deberían ser indexables?
No. El objetivo es indexar las páginas correctas, no el mayor número posible.