Blog da UNmiss

Goodreads criou 16 tipos de página, não apenas livros

O Goodreads declara 16 sistemas de sitemap, um para cada tipo de coisa. Autores chegam a cerca de 9 milhões de páginas e tags de citações a cerca de 6 milhões. Livros nem ficam no topo da lista.

Se você estivesse criando um site sobre livros, faria uma página para cada livro. Obviamente.

O Goodreads também fez isso. Depois continuou, e essa é a parte interessante.

Lemos seu robots.txt e encontramos 16 sistemas de sitemap separados, um para cada tipo de coisa no site. Não seções de um site — diferentes tipos de substantivo. Autores. Prêmios. Gêneros. Grupos. Entrevistas. Listas. Temas de leitura. Sorteios. Perguntas que leitores fizeram sobre um livro, e perguntas que leitores fizeram sobre um autor, mantidas separadas como duas coisas diferentes.

E os maiores deles não são livros.

Resultados em resumo

16
tipos de página separados, cada um com seu próprio sitemap
~6M
páginas só para tags de citações
97
autoridade de domínio, medida com nossa própria ferramenta
A versão curta

A maioria dos catálogos tem um substantivo. O Goodreads encontrou dezesseis e então construiu toda a máquina — sitemap, modelo, padrão de URL — para cada um.

O maior tipo de página individual depois dos autores é a humilde tag de citação.

16 substantivos, não um

Esta é a lista completa que o Goodreads declara: author, award, blog, genre, giveaway, group, interview, list, quote, quote tag, related work, topic, user, um index e dois tipos separados de community question — um ligado a livros, outro ligado a autores.

Atrás deles ficam 527 arquivos de sitemap. Amostrar as folhas dá uma noção da escala:

Tipo de páginaArquivos de sitemapAproximadamente
Autores186~9 milhões
Tags de citações125~6 milhões
Citações111~5.5 milhões
Temas57~2 milhões
Usuários, perguntas, listas40menor

Leia essa tabela de novo. Um site sobre livros construiu cerca de seis milhões de páginas para tags em citações.

A página que ninguém pensaria em criar

Uma página de tag de citação é exatamente o que parece. Alguém destacou uma linha de um romance, alguém a marcou como "scifi", e essa tag virou uma página listando todas as citações que alguém já marcou da mesma forma.

Uma página de tag de citação do Goodreads para scifi, listando citações de romances com autor e livro; cada citação carrega vários links de tags, ao lado de uma barra lateral Browse By Tag mostrando tamanhos de tags como Love Quotes 102k e Life Quotes 80.5k.
O que observar: cada citação carrega três ou quatro tags, e cada tag é um link para outra página como esta. A barra lateral mostra o tamanho que algumas atingem — Love Quotes tem 102,000.

O Goodreads não escreveu nada disso. Leitores digitaram as citações e leitores aplicaram as tags. A empresa forneceu um modelo e uma URL, e o catálogo se construiu sozinho.

Esse é o truque que vale copiar. A citação já estava no site, dentro de uma página de livro onde ninguém podia procurá-la. Dar a ela uma página própria não criou conteúdo novo. Tornou encontrável um conteúdo que já existia.

Pequena demanda, seis milhões de vezes

Agora a parte honesta, porque a objeção óbvia é justa: alguém realmente pesquisa isso?

Resultado do UNmiss Keyword Research para o termo love quotes, mostrando volume mensal de buscas, uma pontuação de dificuldade de 75 em 100 e intenção informacional.
O que observar: volume mensal modesto, mas dificuldade de 75 em 100. Essas não são consultas vazias e não são fáceis.

Medimos uma das maiores tags e ela voltou com alguns milhares de buscas por mês, com dificuldade de 75 em 100. É um prêmio pequeno e disputado.

Esse é o ponto inteiro. Nenhuma tag de citação isolada vale a construção de uma página. Seis milhões delas valem. É a mesma aritmética do arquivo da Zillow de casas que ninguém pode comprar: individualmente trivial, coletivamente enorme, e viável apenas porque a página não custa nada para produzir.

O que todos esses substantivos rendem

Relatório do UNmiss Backlink Analyzer para goodreads.com mostrando Domain Rank 97 em 100, cerca de 81.6 milhões de backlinks totais, 287,990 domínios de referência e 80 por cento de links dofollow.
O que observar: Domain Rank 97. Só Booking.com e Canva igualaram isso nesta série.

Autoridade de domínio de 97 em 100 e quase 288,000 sites apontando links para o Goodreads. Isso coloca o Goodreads no nível mais alto de tudo que medimos.

E faz sentido quando você vê a arquitetura. Uma citação é um dos objetos mais linkáveis da internet. As pessoas as colocam em posts de blog, ensaios, newsletters e respostas de fóruns, e quando fazem isso, linkam para onde a citação vive.

Uma página de livro não consegue coletar esse link. Uma página de citação consegue.

A pontuação que ele não consegue

Um número vai na direção oposta, e vale a pena reportá-lo.

Rodamos goodreads.com pelo nosso próprio Website Audit e ele voltou com 74 em 100 — um problema crítico, quatro avisos, duas notificações, 112 verificações aprovadas. É a menor pontuação técnica de qualquer empresa nesta série. Calculator.net, um site com 222 páginas, marcou 95.

Dezesseis tipos de página e dezenas de milhões de URLs são uma superfície grande para manter arrumada, e isso aparece. Se esse é um custo real ou aceitável depende de quanto do arquivo o Google algum dia iria observar de perto.

Copie isto em uma tarde

Você não precisa de dezesseis tipos de página. Quase certamente precisa de mais de um. Quatro passos.

1. Liste os substantivos que já existem dentro das suas páginas. Não as seções do seu site — as coisas. Uma página de receita contém ingredientes, técnicas, culinárias, ocasiões e equipamentos. Cada um desses é um substantivo que alguém pesquisa.

2. Pergunte quais deles as pessoas pesquisam por conta própria. "Frango" é um substantivo que as pessoas pesquisam. "Etapa 4" não é. Esse é o filtro que impede você de gerar lixo.

3. Dê aos sobreviventes uma página, um padrão de URL e um sitemap. A página deve listar tudo que compartilha esse substantivo. Se o conteúdo já existe dentro de outras páginas, você não está escrevendo nada novo — está indexando o que tem.

4. Deixe as pessoas marcarem coisas com tags, se você tiver pessoas. As seis milhões de páginas de tags do Goodreads existem porque leitores as fizeram. Marcação por tags é a operação de conteúdo mais barata que existe, e as tags também são as palavras-chave.

O que você não pode copiar e o que não conseguimos verificar

Um público que digita coisas. O Goodreads tem milhões de leitores que transcrevem citações de graça. Se ninguém contribui para seu site, as tags não aparecem sozinhas, e você volta a escrever.

Vinte anos de acumulação. Isso não chegou como um lançamento. Cresceu, um tipo de página por vez.

E aqui está o que não conseguimos verificar:

Nós amostramos, não rastreamos. As contagens de páginas vêm da contagem de arquivos de sitemap e da multiplicação pelas URLs de uma folha amostrada. Os totais reais serão diferentes, e URLs declaradas não são páginas indexadas.

Não há um sitemap separado para livros. Os livros parecem viver em uma série genérica de sitemaps numerados, em vez de um índice de entidade nomeado, então não podemos oferecer uma contagem de livros para comparar com a contagem de citações. Preferimos dizer isso a adivinhar.

Sem dados de tráfego ou receita. Nenhum estava disponível para nós e nenhum é afirmado.

Grátis, sem conta
Encontre os substantivos que valem uma página

Antes de criar um novo tipo de página, verifique se alguém pesquisa por ele. Nossa ferramenta Keyword Research fornece volume, dificuldade e intenção para qualquer termo, além de variações relacionadas e de cauda longa — que é exatamente como você diferencia um substantivo real de um que inventou.

  • Volume, dificuldade, custo por clique e intenção
  • Termos relacionados, variações de cauda longa e formulações de perguntas
  • 3 verificações por dia, sem cadastro, sem cartão
Pesquisar uma palavra-chave grátis

Perguntas frequentes

Quais são os 16 tipos de página do Goodreads?

A partir do robots.txt de 23 de agosto de 2026: author, author community question, award, blog, book community question, genre, giveaway, group, index, interview, list, quote, quote tag, related work, topic e user. Cada um tem seu próprio índice de sitemap, e juntos apontam para 527 arquivos de sitemap filhos.

Como vocês estimaram as contagens de páginas?

Contando os arquivos filhos em cada índice de sitemap, abrindo uma folha de cada um dos maiores tipos e multiplicando. Autores: 186 arquivos com cerca de 48,700 URLs cada. Tags de citações: 125 arquivos com 50,000, o máximo que um arquivo de sitemap pode conter. Citações: 111 arquivos com cerca de 49,894. Temas: 57 arquivos com cerca de 34,334. Essas são estimativas de uma amostra, e URLs declaradas não são o mesmo que páginas indexadas.

Por que não há sitemap para livros?

Não conseguimos encontrar um nomeado. Os índices index e related work apontam para uma série genérica de sitemaps numerados, que é muito provavelmente onde as páginas de livros vivem. Como não conseguimos isolá-las, este artigo não compara o número de páginas de livros com o número de páginas de citações, por mais tentadora que essa comparação seja.

As páginas de tags de citações realmente recebem buscas?

Sim, embora modestamente por tag. Medimos uma das maiores tags e ela retornou alguns milhares de buscas por mês com uma dificuldade de 75 em 100. O valor não está em qualquer tag isolada; está no fato de haver cerca de seis milhões delas e cada uma não custar nada para produzir, já que os leitores fornecem tanto as citações quanto as tags.

Qual é o perfil de backlinks do Goodreads?

Nosso Backlink Analyzer retornou Domain Rank 97 em 100, 287,990 domínios de referência, 68,791,730 links dofollow e 17,712,147 nofollow, 108,839 IPs de referência e 47,356 sub-redes de referência em 23 de agosto de 2026. Só Booking.com e Canva igualaram 97 nesta série.

Como ele se saiu em uma auditoria técnica?

Mal, em relação ao resto da série. Nosso Website Audit retornou 74 em 100 para a página inicial, com 1 problema crítico, 4 avisos, 2 notificações e 112 verificações aprovadas. Para comparação, Calculator.net marcou 95 com 222 páginas, e wikiHow, Zillow e NerdWallet marcaram todos 88.

Isso é apenas conteúdo gerado por usuários?

Em parte, e esse é o ponto. As citações e tags vêm dos leitores, mas os tipos de página não. Alguém no Goodreads decidiu que uma tag em uma citação merecia sua própria URL, modelo e sitemap. A contribuição é gratuita; a arquitetura que a transforma em páginas encontráveis é o trabalho.

Posso verificar isso por conta própria?

Sim, em cerca de dez minutos. Abra goodreads.com/robots.txt, liste as linhas Sitemap: e perceba que cada uma nomeia um tipo de coisa em vez de uma seção. Siga algumas delas, conte os arquivos filhos e abra uma folha. Esse é todo o método por trás deste artigo.

Encontre seu segundo substantivo

Cada empresa nesta série escalou algo diferente. RTINGS escalou medições. Wise escalou moedas. Zapier escalou pares e se recusou a publicar a maioria deles. Booking escalou adjetivos. Zillow escalou o passado. Calculator.net se recusou a escalar. wikiHow escalou desenhos. NerdWallet escalou humanos nomeados. IKEA escalou mercados.

O Goodreads escalou tipos de coisa. Ele olhou para uma página de livro e viu um autor, um gênero, um prêmio, uma lista, uma discussão, uma citação e uma tag nessa citação — e deu uma URL a cada um deles.

A maioria dos sites para no primeiro substantivo. Aquele que vende. Todo o resto fica enterrado dentro de uma página onde ninguém pode pesquisar por ele.

Então olhe para sua página mais importante e anote cada coisa distinta mencionada nela. Essa lista é o mapa real do seu site, e você provavelmente está publicando apenas a primeira linha dela.

Depois verifique quais desses substantivos as pessoas realmente pesquisam. Leva um minuto, e é a diferença entre um novo tipo de página e uma nova pilha de páginas.

Medido em 23 de agosto de 2026. Os tipos de página vêm do robots.txt de goodreads.com; as contagens vêm da contagem de arquivos de sitemap filhos e da multiplicação pelas URLs em uma folha amostrada, com cada número amostrado publicado na FAQ acima.

Números de links, palavras-chave e auditoria são execuções gratuitas de nossas próprias ferramentas. URLs declaradas em sitemaps não são páginas indexadas. Nenhum dado de tráfego ou receita do Goodreads estava disponível para nós e nenhum é afirmado aqui.

Blog