O SEO técnico começa com uma cadeia simples: uma ferramenta de rastreio tem de descobrir um URL, carregá-lo com sucesso, perceber qual é a versão canónica e ter permissão para a indexar. Uma página bonita não consegue posicionar-se se essa cadeia estiver quebrada.
Descoberta não é o mesmo que indexação
Um motor de pesquisa pode saber que um URL existe sem o indexar. Sitemaps e links ajudam na descoberta, enquanto a qualidade do conteúdo e os sinais técnicos influenciam as decisões de indexação.
Um URL também pode estar indexado sem aparecer para pesquisas valiosas. A indexação é apenas um pré-requisito, não o objetivo final.
Ao diagnosticar uma página específica, verifique o estado desse URL em vez de assumir que o problema afeta todo o site.
Regras de robots e noindex têm funções diferentes
O robots.txt controla instruções de rastreamento; uma diretiva noindex diz ao motor de pesquisa para não manter a página no índice depois de conseguir processar essa diretiva.
Bloquear o rastreio de um URL pode impedir o robô de pesquisa de ver instruções definidas na própria página. Use cada mecanismo para a função para a qual foi concebido.
Teste cuidadosamente estas regras no ambiente de testes antes do lançamento. Levar por engano diretivas noindex ou de bloqueio para produção é um erro comum e evitável.
O URL canónico deve corresponder à versão preferida
Use a tag rel="canonical" para indicar a versão preferida quando vários URLs têm essencialmente o mesmo conteúdo.
Mantenha os sinais consistentes: links internos, URLs no sitemap e redirecionamentos devem, em geral, apontar para o mesmo destino canónico.
Não use a tag rel="canonical" como solução universal para todas as páginas duplicadas ou de baixa qualidade. Por vezes, a solução correta é um redirecionamento, remoção ou uma arquitetura de site melhor.
Os sitemaps XML devem estar limpos
Inclua URLs canónicos e indexáveis que devolvam respostas de sucesso e mereçam ser descobertos.
Remova redirecionamentos antigos, 404, duplicados por parâmetros e páginas intencionalmente excluídas da pesquisa.
Divida sitemaps muito grandes ou especializados quando isso ajudar na monitorização, mas não crie complexidade sem benefício de diagnóstico.
Os códigos de estado HTTP dizem aos motores de pesquisa o que aconteceu
Use respostas de sucesso para páginas ativas, redirecionamentos para conteúdo movido e respostas de erro adequadas para URLs removidos.
Evite soft 404, em que uma página inexistente devolve um código normal de sucesso acompanhado de uma mensagem de erro.
Mantenha as cadeias de redirecionamento curtas e atualize os links internos para o destino final depois de migrações.
Perguntas frequentes
Enviar um sitemap garante a indexação?
Não. Um sitemap ajuda na descoberta e comunica os URLs preferidos, mas os motores de pesquisa continuam a decidir o que rastrear e indexar.
Todas as páginas devem ser indexáveis?
Não. Páginas utilitárias, duplicadas, de conta ou de pouco valor podem não fazer sentido nos resultados de pesquisa. O objetivo é indexar as páginas certas, não o maior número possível.