Se você estivesse criando um site sobre livros, faria uma página para cada livro. Obviamente.
O Goodreads também fez isso. Depois continuou, e essa é a parte interessante.
Lemos seu robots.txt e encontramos 16 sistemas de sitemap separados, um para cada tipo de coisa no site. Não seções de um site — diferentes tipos de substantivo. Autores. Prêmios. Gêneros. Grupos. Entrevistas. Listas. Temas de leitura. Sorteios. Perguntas que leitores fizeram sobre um livro, e perguntas que leitores fizeram sobre um autor, mantidas separadas como duas coisas diferentes.
E os maiores deles não são livros.
Resultados em resumo
A maioria dos catálogos tem um substantivo. O Goodreads encontrou dezesseis e então construiu toda a máquina — sitemap, modelo, padrão de URL — para cada um.
O maior tipo de página individual depois dos autores é a humilde tag de citação.
16 substantivos, não um
Esta é a lista completa que o Goodreads declara: author, award, blog, genre, giveaway, group, interview, list, quote, quote tag, related work, topic, user, um index e dois tipos separados de community question — um ligado a livros, outro ligado a autores.
Atrás deles ficam 527 arquivos de sitemap. Amostrar as folhas dá uma noção da escala:
| Tipo de página | Arquivos de sitemap | Aproximadamente |
|---|---|---|
| Autores | 186 | ~9 milhões |
| Tags de citações | 125 | ~6 milhões |
| Citações | 111 | ~5.5 milhões |
| Temas | 57 | ~2 milhões |
| Usuários, perguntas, listas | 40 | menor |
Leia essa tabela de novo. Um site sobre livros construiu cerca de seis milhões de páginas para tags em citações.
A página que ninguém pensaria em criar
Uma página de tag de citação é exatamente o que parece. Alguém destacou uma linha de um romance, alguém a marcou como "scifi", e essa tag virou uma página listando todas as citações que alguém já marcou da mesma forma.
O Goodreads não escreveu nada disso. Leitores digitaram as citações e leitores aplicaram as tags. A empresa forneceu um modelo e uma URL, e o catálogo se construiu sozinho.
Esse é o truque que vale copiar. A citação já estava no site, dentro de uma página de livro onde ninguém podia procurá-la. Dar a ela uma página própria não criou conteúdo novo. Tornou encontrável um conteúdo que já existia.
Pequena demanda, seis milhões de vezes
Agora a parte honesta, porque a objeção óbvia é justa: alguém realmente pesquisa isso?
Medimos uma das maiores tags e ela voltou com alguns milhares de buscas por mês, com dificuldade de 75 em 100. É um prêmio pequeno e disputado.
Esse é o ponto inteiro. Nenhuma tag de citação isolada vale a construção de uma página. Seis milhões delas valem. É a mesma aritmética do arquivo da Zillow de casas que ninguém pode comprar: individualmente trivial, coletivamente enorme, e viável apenas porque a página não custa nada para produzir.
O que todos esses substantivos rendem
Autoridade de domínio de 97 em 100 e quase 288,000 sites apontando links para o Goodreads. Isso coloca o Goodreads no nível mais alto de tudo que medimos.
E faz sentido quando você vê a arquitetura. Uma citação é um dos objetos mais linkáveis da internet. As pessoas as colocam em posts de blog, ensaios, newsletters e respostas de fóruns, e quando fazem isso, linkam para onde a citação vive.
Uma página de livro não consegue coletar esse link. Uma página de citação consegue.
A pontuação que ele não consegue
Um número vai na direção oposta, e vale a pena reportá-lo.
Rodamos goodreads.com pelo nosso próprio Website Audit e ele voltou com 74 em 100 — um problema crítico, quatro avisos, duas notificações, 112 verificações aprovadas. É a menor pontuação técnica de qualquer empresa nesta série. Calculator.net, um site com 222 páginas, marcou 95.
Dezesseis tipos de página e dezenas de milhões de URLs são uma superfície grande para manter arrumada, e isso aparece. Se esse é um custo real ou aceitável depende de quanto do arquivo o Google algum dia iria observar de perto.
Copie isto em uma tarde
Você não precisa de dezesseis tipos de página. Quase certamente precisa de mais de um. Quatro passos.
1. Liste os substantivos que já existem dentro das suas páginas. Não as seções do seu site — as coisas. Uma página de receita contém ingredientes, técnicas, culinárias, ocasiões e equipamentos. Cada um desses é um substantivo que alguém pesquisa.
2. Pergunte quais deles as pessoas pesquisam por conta própria. "Frango" é um substantivo que as pessoas pesquisam. "Etapa 4" não é. Esse é o filtro que impede você de gerar lixo.
3. Dê aos sobreviventes uma página, um padrão de URL e um sitemap. A página deve listar tudo que compartilha esse substantivo. Se o conteúdo já existe dentro de outras páginas, você não está escrevendo nada novo — está indexando o que tem.
4. Deixe as pessoas marcarem coisas com tags, se você tiver pessoas. As seis milhões de páginas de tags do Goodreads existem porque leitores as fizeram. Marcação por tags é a operação de conteúdo mais barata que existe, e as tags também são as palavras-chave.
O que você não pode copiar e o que não conseguimos verificar
Um público que digita coisas. O Goodreads tem milhões de leitores que transcrevem citações de graça. Se ninguém contribui para seu site, as tags não aparecem sozinhas, e você volta a escrever.
Vinte anos de acumulação. Isso não chegou como um lançamento. Cresceu, um tipo de página por vez.
E aqui está o que não conseguimos verificar:
Nós amostramos, não rastreamos. As contagens de páginas vêm da contagem de arquivos de sitemap e da multiplicação pelas URLs de uma folha amostrada. Os totais reais serão diferentes, e URLs declaradas não são páginas indexadas.
Não há um sitemap separado para livros. Os livros parecem viver em uma série genérica de sitemaps numerados, em vez de um índice de entidade nomeado, então não podemos oferecer uma contagem de livros para comparar com a contagem de citações. Preferimos dizer isso a adivinhar.
Sem dados de tráfego ou receita. Nenhum estava disponível para nós e nenhum é afirmado.
Antes de criar um novo tipo de página, verifique se alguém pesquisa por ele. Nossa ferramenta Keyword Research fornece volume, dificuldade e intenção para qualquer termo, além de variações relacionadas e de cauda longa — que é exatamente como você diferencia um substantivo real de um que inventou.
- Volume, dificuldade, custo por clique e intenção
- Termos relacionados, variações de cauda longa e formulações de perguntas
- 3 verificações por dia, sem cadastro, sem cartão
Perguntas frequentes
Quais são os 16 tipos de página do Goodreads?
A partir do robots.txt de 23 de agosto de 2026: author, author community question, award, blog, book community question, genre, giveaway, group, index, interview, list, quote, quote tag, related work, topic e user. Cada um tem seu próprio índice de sitemap, e juntos apontam para 527 arquivos de sitemap filhos.
Como vocês estimaram as contagens de páginas?
Contando os arquivos filhos em cada índice de sitemap, abrindo uma folha de cada um dos maiores tipos e multiplicando. Autores: 186 arquivos com cerca de 48,700 URLs cada. Tags de citações: 125 arquivos com 50,000, o máximo que um arquivo de sitemap pode conter. Citações: 111 arquivos com cerca de 49,894. Temas: 57 arquivos com cerca de 34,334. Essas são estimativas de uma amostra, e URLs declaradas não são o mesmo que páginas indexadas.
Por que não há sitemap para livros?
Não conseguimos encontrar um nomeado. Os índices index e related work apontam para uma série genérica de sitemaps numerados, que é muito provavelmente onde as páginas de livros vivem. Como não conseguimos isolá-las, este artigo não compara o número de páginas de livros com o número de páginas de citações, por mais tentadora que essa comparação seja.
As páginas de tags de citações realmente recebem buscas?
Sim, embora modestamente por tag. Medimos uma das maiores tags e ela retornou alguns milhares de buscas por mês com uma dificuldade de 75 em 100. O valor não está em qualquer tag isolada; está no fato de haver cerca de seis milhões delas e cada uma não custar nada para produzir, já que os leitores fornecem tanto as citações quanto as tags.
Qual é o perfil de backlinks do Goodreads?
Nosso Backlink Analyzer retornou Domain Rank 97 em 100, 287,990 domínios de referência, 68,791,730 links dofollow e 17,712,147 nofollow, 108,839 IPs de referência e 47,356 sub-redes de referência em 23 de agosto de 2026. Só Booking.com e Canva igualaram 97 nesta série.
Como ele se saiu em uma auditoria técnica?
Mal, em relação ao resto da série. Nosso Website Audit retornou 74 em 100 para a página inicial, com 1 problema crítico, 4 avisos, 2 notificações e 112 verificações aprovadas. Para comparação, Calculator.net marcou 95 com 222 páginas, e wikiHow, Zillow e NerdWallet marcaram todos 88.
Isso é apenas conteúdo gerado por usuários?
Em parte, e esse é o ponto. As citações e tags vêm dos leitores, mas os tipos de página não. Alguém no Goodreads decidiu que uma tag em uma citação merecia sua própria URL, modelo e sitemap. A contribuição é gratuita; a arquitetura que a transforma em páginas encontráveis é o trabalho.
Posso verificar isso por conta própria?
Sim, em cerca de dez minutos. Abra goodreads.com/robots.txt, liste as linhas Sitemap: e perceba que cada uma nomeia um tipo de coisa em vez de uma seção. Siga algumas delas, conte os arquivos filhos e abra uma folha. Esse é todo o método por trás deste artigo.
Encontre seu segundo substantivo
Cada empresa nesta série escalou algo diferente. RTINGS escalou medições. Wise escalou moedas. Zapier escalou pares e se recusou a publicar a maioria deles. Booking escalou adjetivos. Zillow escalou o passado. Calculator.net se recusou a escalar. wikiHow escalou desenhos. NerdWallet escalou humanos nomeados. IKEA escalou mercados.
O Goodreads escalou tipos de coisa. Ele olhou para uma página de livro e viu um autor, um gênero, um prêmio, uma lista, uma discussão, uma citação e uma tag nessa citação — e deu uma URL a cada um deles.
A maioria dos sites para no primeiro substantivo. Aquele que vende. Todo o resto fica enterrado dentro de uma página onde ninguém pode pesquisar por ele.
Então olhe para sua página mais importante e anote cada coisa distinta mencionada nela. Essa lista é o mapa real do seu site, e você provavelmente está publicando apenas a primeira linha dela.
Depois verifique quais desses substantivos as pessoas realmente pesquisam. Leva um minuto, e é a diferença entre um novo tipo de página e uma nova pilha de páginas.
Medido em 23 de agosto de 2026. Os tipos de página vêm do robots.txt de goodreads.com; as contagens vêm da contagem de arquivos de sitemap filhos e da multiplicação pelas URLs em uma folha amostrada, com cada número amostrado publicado na FAQ acima.
Números de links, palavras-chave e auditoria são execuções gratuitas de nossas próprias ferramentas. URLs declaradas em sitemaps não são páginas indexadas. Nenhum dado de tráfego ou receita do Goodreads estava disponível para nós e nenhum é afirmado aqui.