Modelo de paginação e navegação facetada
Modelo gratuito para controlar como os mecanismos de busca rastreiam e indexam séries paginadas e navegação facetada, para que as URLs certas ranqueiem.
Séries paginadas e filtros facetados podem gerar milhares de URLs quase duplicadas ou pobres em conteúdo, que consomem o orçamento de rastreamento e sepultam o seu melhor conteúdo. Este modelo oferece um sistema repetível para mapear essas URLs, decidir o que indexar e o que bloquear, e aplicar as regras corretas de canonical, robots e links internos. Use-o para manter os rastreadores focados em páginas valiosas, garantindo ao mesmo tempo que itens mais profundos continuem descobríveis.
6 variações prontas para usar
Mapeie suas URLs paginadas e facetadas
Inventarie cada padrão de URL paginada e filtrada antes de mudar qualquer coisa, para que as decisões se baseiem em dados reais.
Monte um inventário completo de URLs
Você não consegue controlar o rastreamento e a indexação enquanto não souber exatamente o que existe. Comece catalogando cada série paginada (listagens de categoria, arquivos de blog, resultados de busca) e cada parâmetro facetado (cor, tamanho, preço, marca, ordenação, visualização).
- Fonte: rastreamento completo com [Nome da ferramenta de rastreamento] & logs de servidor de [Fonte dos arquivos de log]
- Padrão de paginação: [/category/?page=N or /category/page/N/]
- Parâmetros de faceta: [?color=, ?size=, ?sort=]
- Profundidade de combinação: [uma faceta vs. várias facetas empilhadas]
Para cada padrão, registre o canonical atual, o robots meta e se a URL está no sitemap XML. Sinalize qualquer URL que esteja ao mesmo tempo canonicalizada para outra página e bloqueada no robots.txt: isso é um conflito a corrigir depois.
Marque cada padrão como Indexar, Apenas rastrear ou Bloquear. Este inventário torna-se a única fonte de verdade para o resto do modelo.
Boas práticas de paginação
Torne as páginas componentes de uma série rastreáveis e autocanônicas, para que itens mais profundos sejam descobertos e indexados.
Trate cada página como sua própria URL
O Google descontinuou o rel=next/prev e não o usa mais como sinal de indexação, portanto não confie nele. Em vez disso, faça com que cada página da série se sustente por conta própria.
- Autocanônica: a página 2 aponta o canonical para si mesma ([/category/?page=2]), nunca de volta para a página 1.
- Links rastreáveis: use tags anchor reais com href para próxima, anterior e páginas numeradas, não botões, apenas rolagem infinita ou manipuladores exclusivamente em JavaScript.
- URLs estáveis: cada página retorna 200 e mostra um conjunto consistente de itens.
- Confirme que os links de paginação estão no HTML renderizado.
- Garanta que a página 2 em diante seja indexável (sem noindex generalizado).
- Mantenha títulos e meta descriptions distintos ou acrescente o número da página.
O objetivo é a descoberta: os rastreadores seguem os links de paginação para alcançar produtos ou artigos no fundo da série. Evite uma página “ver tudo” apenas se ela carregar lentamente demais para ser prática.
Facetas: indexar vs. bloquear
Decida quais combinações filtradas merecem indexação e quais devem ser bloqueadas para proteger o orçamento de rastreamento.
Indexe o valioso, bloqueie o ruído
A navegação facetada pode gerar combinações quase infinitas. Apenas um pequeno subconjunto merece indexação: aquelas com demanda de busca real e estoque único e útil.
Indexe estas:
- Facetas individuais de alta demanda que os usuários buscam ([tênis de corrida vermelhos], [jaquetas impermeáveis]).
- Combinações com volume de palavras-chave claro e produtos suficientes para serem úteis.
Bloqueie ou aplique noindex nestas:
- Parâmetros de ordenação e visualização ([?sort=price, ?view=grid]) que apenas reordenam os mesmos itens.
- Pilhas de múltiplas facetas ([cor + tamanho + preço + marca]) que criam páginas pobres e sobrepostas.
- IDs de sessão, parâmetros de rastreamento e conjuntos de resultados vazios.
Valide a demanda com pesquisa de palavras-chave antes de promover qualquer faceta para indexável. Na dúvida, mantenha-a fora do índice: páginas filtradas pobres diluem a relevância e desperdiçam a capacidade de rastreamento que deveria alcançar suas páginas que geram receita.
Controlar o rastreamento
Use regras de robots, tratamento de parâmetros e links internos para direcionar os rastreadores para as URLs que importam.
Direcione o rastreamento deliberadamente
O controle de rastreamento é uma questão de ênfase: leve os rastreadores para URLs valiosas e para longe do descontrole de parâmetros de baixo valor.
- robots.txt: proíba caminhos de parâmetros inúteis ([/*?sort=], [/*?sessionid=]) que você não precisa que sejam renderizados. Lembre-se de que uma URL proibida ainda assim não pode ser rastreada para ler o seu canonical ou a tag noindex.
- Links internos: aponte de forma proeminente para facetas indexáveis e páginas paginadas; evite linkar para combinações que você quer ignorar. A ligação interna é o seu sinal de rastreamento mais forte.
- nofollow: considere-o em links de filtro que você não indexa nem quer rastrear, embora seja uma dica mais fraca e não vinculante.
- Mapeie quais parâmetros agregam valor e quais apenas reembaralham.
- Bloqueie na origem os parâmetros que desperdiçam rastreamento.
- Mantenha um caminho limpo e raso para cada página que você quer indexar.
Nunca proíba uma URL no robots.txt se você também precisa que o Google leia um canonical ou noindex nela: páginas bloqueadas mantêm invisíveis os seus sinais conflitantes.
Regras de canonical e indexação para facetas
Aplique uma lógica consistente de canonical e noindex às páginas filtradas sem criar sinais conflitantes.
Faça os sinais concordarem
As diretivas de canonical e de indexação devem apontar na mesma direção. Sinais misturados confundem os rastreadores e desperdiçam o orçamento que você tenta economizar.
- Faceta indexável: autocanônica para a sua própria URL limpa ([/shoes/red/] aponta o canonical para [/shoes/red/]), inclua-a no sitemap e faça links internos para ela.
- Variante duplicada: se uma versão com ordenação ou parâmetro mostra os mesmos itens de uma página limpa, aponte o canonical da variante para essa URL limpa.
- Combinação pobre: aplique noindex, follow para que fique fora do índice, mas ainda repasse a autoridade dos links adiante.
Evite estes conflitos:
- Não combine canonical e noindex na mesma URL: eles se contradizem.
- Não coloque canonical em uma página que você também bloqueia no robots.txt.
- Não aponte um canonical para um destino com noindex ou redirecionado.
Uma URL, uma instrução clara. Audite as sobreposições para que cada faceta tenha exatamente uma decisão de indexação consistente.
QA e monitoramento
Verifique se as diretivas são renderizadas corretamente e acompanhe a cobertura de indexação ao longo do tempo para detectar regressões cedo.
Teste e continue observando
A configuração só está correta se os rastreadores realmente a virem na saída renderizada. Faça QA antes do lançamento e depois monitore continuamente.
Verificações pré-lançamento:
- Inspecione o HTML renderizado (não apenas o código-fonte) em busca das tags corretas de canonical e robots em URLs paginadas e facetadas de amostra.
- Confirme que os links de paginação são anchors reais e rastreáveis e que a página 2 em diante é indexável.
- Use a inspeção de URL no [Search Console / ferramentas do Bing] para confirmar que o canonical escolhido corresponde à sua intenção.
- Verifique se o robots.txt não bloqueia URLs que carregam tags canonical ou noindex.
Monitoramento contínuo:
- Acompanhe mensalmente a cobertura de indexação e os relatórios de excluído por noindex / duplicado.
- Observe os logs de servidor em busca de desperdício de rastreamento em parâmetros bloqueados.
- Rastreie novamente após mudanças de modelo ou de filtro.
Estabeleça uma revisão recorrente na [cadência, ex.: trimestral] para que novas facetas ou mudanças de paginação nunca quebrem silenciosamente suas regras de rastreamento e indexação.
Como usar este modelo
- Rastreie seu site e extraia os logs de servidor para montar um inventário completo de cada URL de série paginada e de parâmetro facetado.
- Marque cada padrão de URL como Indexar, Apenas rastrear ou Bloquear com base na demanda de busca, na exclusividade e na profundidade de estoque.
- Torne as páginas paginadas autocanônicas com links anchor reais e rastreáveis, e não confie no descontinuado rel=next/prev.
- Escolha quais facetas individuais e combinações de alta demanda indexar; reserve a indexação para páginas com demanda genuína de palavras-chave.
- Aplique autocanônica às facetas indexáveis, aponte o canonical das variantes duplicadas para a URL limpa e use noindex,follow nas combinações pobres.
- Proíba no robots.txt os parâmetros que desperdiçam rastreamento (ordenação, visualização, sessão, rastreamento), mas nunca bloqueie URLs que carregam tags canonical ou noindex.
- Reforce os links internos para as URLs que você quer indexar e remova os links para combinações que você quer ignorar.
- Faça QA do HTML renderizado, valide os canonicals no Search Console e depois monitore a cobertura de indexação e os logs de rastreamento em um cronograma recorrente.
Dicas profissionais
- Verifique se os sinais concordam: nunca coloque canonical e noindex na mesma URL, e nunca aponte o canonical de uma página que você também bloqueia no robots.txt.
- Valide a demanda da faceta com pesquisa de palavras-chave antes de indexar uma combinação; na dúvida, mantenha páginas filtradas pobres fora do índice.
- Use anchors reais <a href> na paginação para que os rastreadores possam segui-los; apenas JavaScript ou somente rolagem infinita podem ocultar itens mais profundos.
- Audite o HTML renderizado, não apenas o código-fonte, pois canonicals e tags robots injetados por JavaScript podem diferir da resposta bruta.
Perguntas frequentes
Ainda devo usar rel=next/prev para paginação?
Não. O Google descontinuou o rel=next/prev e não o usa mais para indexação. Concentre-se, em vez disso, em links anchor rastreáveis e páginas autocanônicas, para que cada página da série possa ser descoberta e indexada por conta própria.
A página 2 deve apontar o canonical de volta para a página 1?
Não. A página 2 em diante deve ter canonical para a sua própria URL. Canonicalizá-las para a página 1 diz aos mecanismos de busca que as páginas mais profundas são duplicadas, o que pode impedir que produtos ou artigos listados apenas em páginas posteriores sejam descobertos.
Quais páginas facetadas devo deixar o Google indexar?
Apenas facetas com demanda de busca real e estoque útil e único, como um único filtro popular do tipo jaquetas impermeáveis. Bloqueie ou aplique noindex a parâmetros de ordenação/visualização e a pilhas de múltiplas facetas que criam páginas pobres e sobrepostas com pouco valor agregado.
Devo bloquear URLs facetadas no robots.txt ou usar noindex?
Depende da intenção. Use noindex,follow quando quiser manter uma página fora do índice, mas ainda rastreada para que a autoridade dos links flua. Use o disallow do robots.txt apenas para parâmetros que você nunca precisa que sejam rastreados, e nunca bloqueie uma URL que também carrega um canonical ou noindex que precisa ser lido.
Posso usar canonical e noindex juntos em uma página filtrada?
Não, eles enviam instruções conflitantes. O canonical diz para consolidar em outra URL, enquanto o noindex diz para remover esta por completo. Escolha um: autocanônica ou canonical para uma página limpa se for uma duplicata, ou noindex,follow se a página for simplesmente pobre em conteúdo.
Como manter descobríveis os itens em páginas profundas?
Garanta que cada página paginada retorne 200, permaneça indexável e exponha links anchor reais e rastreáveis para a próxima página e para as páginas numeradas no HTML renderizado. Isso permite que os rastreadores percorram a série inteira e alcancem itens listados apenas em páginas mais profundas.