Si vous construisiez un site sur les livres, vous créeriez une page pour chaque livre. Évidemment.
Goodreads l'a fait aussi. Puis il a continué, et c'est là que cela devient intéressant.
Nous avons lu son robots.txt et trouvé 16 systèmes de sitemap séparés, un pour chaque type de chose sur le site. Pas des sections d'un site — différents types de nom. Auteurs. Prix. Genres. Groupes. Entretiens. Listes. Sujets de lecture. Concours. Questions posées par les lecteurs sur un livre, et questions posées par les lecteurs sur un auteur, gardées séparées comme deux choses différentes.
Et les plus grands ne sont pas du tout des livres.
Résultats en bref
La plupart des catalogues ont un seul nom. Goodreads en a trouvé seize, puis a construit toute la mécanique — sitemap, modèle, schéma d'URL — pour chacun.
Le plus grand type de page isolé après les auteurs est l'humble tag de citation.
16 noms, pas un seul
Voici la liste complète que Goodreads déclare : author, award, blog, genre, giveaway, group, interview, list, quote, quote tag, related work, topic, user, un index, et deux types distincts de community question — l'un attaché aux livres, l'autre attaché aux auteurs.
Derrière eux se trouvent 527 fichiers de sitemap. Échantillonner les feuilles donne une idée de l'échelle :
| Type de page | Fichiers de sitemap | Environ |
|---|---|---|
| Auteurs | 186 | ~9 millions |
| Tags de citations | 125 | ~6 millions |
| Citations | 111 | ~5.5 millions |
| Sujets | 57 | ~2 millions |
| Utilisateurs, questions, listes | 40 | plus petit |
Relisez ce tableau. Un site sur les livres a construit environ six millions de pages pour des tags sur des citations.
La page que personne ne penserait à construire
Une page de tag de citation est exactement ce que son nom indique. Quelqu'un a surligné une ligne d'un roman, quelqu'un l'a taguée "scifi", et ce tag est devenu une page listant chaque citation que quelqu'un a jamais taguée de la même manière.
Goodreads n'a rien écrit de tout cela. Les lecteurs ont saisi les citations et les lecteurs ont appliqué les tags. L'entreprise a fourni un modèle et une URL, et le catalogue s'est construit tout seul.
C'est l'astuce qui mérite d'être reprise. La citation était déjà sur le site, assise dans une page de livre où personne ne pouvait la chercher. Lui donner sa propre page n'a pas créé de nouveau contenu. Cela a rendu trouvable du contenu qui existait déjà.
Petite demande, six millions de fois
Maintenant la partie honnête, parce que l'objection évidente est légitime : est-ce que quelqu'un cherche vraiment cela ?
Nous avons mesuré l'un des plus grands tags et il est revenu à quelques milliers de recherches par mois, avec une difficulté de 75 sur 100. C'est un petit prix disputé.
C'est tout l'enjeu. Aucun tag de citation isolé ne mérite qu'on construise une page pour lui. Six millions d'entre eux, oui. C'est la même arithmétique que l'archive de Zillow de maisons que personne ne peut acheter : individuellement triviale, collectivement énorme, et viable seulement parce que la page ne coûte rien à produire.
Ce que rapportent tous ces noms
Autorité de domaine de 97 sur 100, et près de 288,000 sites qui pointent vers Goodreads. Cela place Goodreads dans le tout premier groupe de tout ce que nous avons mesuré.
Et cela a du sens dès que vous voyez l'architecture. Une citation est l'un des objets les plus faciles à lier sur internet. Les gens les mettent dans des articles de blog, des essais, des newsletters et des réponses de forum, et quand ils le font, ils créent un lien vers l'endroit où vit la citation.
Une page de livre ne peut pas capter ce lien. Une page de citation le peut.
Le score qu'il n'obtient pas
Un chiffre va dans l'autre sens, et il mérite d'être signalé.
Nous avons passé goodreads.com dans notre propre Website Audit et il est revenu à 74 sur 100 — un problème critique, quatre avertissements, deux avis, 112 contrôles réussis. C'est le score technique le plus bas de toutes les entreprises de cette série. Calculator.net, un site de 222 pages, a obtenu 95.
Seize types de pages et des dizaines de millions d'URL forment une grande surface à garder propre, et cela se voit. Que ce soit un vrai coût ou un coût acceptable dépend de la part de l'archive que Google allait vraiment examiner de près.
Copier cela en un après-midi
Vous n'avez pas besoin de seize types de pages. Vous avez presque certainement besoin de plus d'un. Quatre étapes.
1. Listez les noms déjà présents dans vos pages. Pas les sections de votre site — les choses. Une page de recette contient des ingrédients, des techniques, des cuisines, des occasions et du matériel. Chacun de ceux-là est un nom que quelqu'un recherche.
2. Demandez lesquels sont recherchés seuls par les gens. "Poulet" est un nom que les gens recherchent. "Étape 4" ne l'est pas. C'est le filtre qui vous empêche de générer des déchets.
3. Donnez aux survivants une page, un schéma d'URL et un sitemap. La page doit lister tout ce qui partage ce nom. Si le contenu existe déjà dans d'autres pages, vous n'écrivez rien de nouveau — vous indexez ce que vous avez.
4. Laissez les gens ajouter des tags aux choses, si vous avez des gens. Les six millions de pages de tags de Goodreads existent parce que les lecteurs les ont faites. L'ajout de tags est l'opération de contenu la moins chère qui soit, et les tags sont aussi les mots-clés.
Ce que vous ne pouvez pas copier, et ce que nous avons manqué
Une audience qui saisit des choses. Goodreads a des millions de lecteurs qui transcrivent des citations gratuitement. Si personne ne contribue à votre site, les tags n'apparaîtront pas d'eux-mêmes, et vous revenez à l'écriture.
Vingt ans d'accumulation. Ce n'est pas arrivé comme un lancement. Cela a grandi, un type de page à la fois.
Et voici ce que nous n'avons pas pu vérifier :
Nous avons échantillonné, nous n'avons pas exploré tout le site. Les comptes de pages viennent du comptage des fichiers de sitemap et de la multiplication par les URL d'une feuille échantillonnée. Les totaux réels seront différents, et les URL déclarées ne sont pas des pages indexées.
Il n'y a pas de sitemap séparé pour les livres. Les livres semblent vivre dans une série générique de sitemaps numérotés plutôt que dans un index d'entité nommé, donc nous ne pouvons pas vous donner un nombre de livres à comparer au nombre de citations. Nous préférons le dire plutôt que le deviner.
Pas de données de trafic ni de revenus. Aucune ne nous était disponible et aucune n'est revendiquée.
Avant de construire un nouveau type de page, vérifiez si quelqu'un le recherche. Notre outil Keyword Research vous donne le volume, la difficulté et l'intention pour n'importe quel terme, plus les variantes associées et de longue traîne — c'est exactement ainsi que vous distinguez un vrai nom d'un nom inventé.
- Volume, difficulté, coût par clic et intention
- Termes associés, variantes de longue traîne et formulations de questions
- 3 contrôles par jour, sans inscription, sans carte
Questions fréquentes
Quels sont les 16 types de pages de Goodreads ?
D'après son robots.txt du 23 août 2026 : author, author community question, award, blog, book community question, genre, giveaway, group, index, interview, list, quote, quote tag, related work, topic et user. Chacun a son propre index de sitemap, et ensemble ils pointent vers 527 fichiers de sitemap enfants.
Comment avez-vous estimé les comptes de pages ?
En comptant les fichiers enfants dans chaque index de sitemap, en ouvrant une feuille de chacun des plus grands types, puis en multipliant. Auteurs : 186 fichiers à environ 48,700 URL chacun. Tags de citations : 125 fichiers à 50,000, le maximum qu'un fichier de sitemap peut contenir. Citations : 111 fichiers à environ 49,894. Sujets : 57 fichiers à environ 34,334. Ce sont des estimations tirées d'un échantillon, et les URL déclarées ne sont pas la même chose que des pages indexées.
Pourquoi n'y a-t-il pas de sitemap pour les livres ?
Nous n'en avons pas trouvé de nommé. Les index index et related work pointent vers une série générique de sitemaps numérotés, qui est très probablement l'endroit où vivent les pages de livres. Comme nous ne pouvons pas les isoler, cet article ne compare pas le nombre de pages de livres au nombre de pages de citations, aussi tentante que soit cette comparaison.
Les pages de tags de citations sont-elles vraiment recherchées ?
Oui, quoique modestement par tag. Nous avons mesuré l'un des plus grands tags et il a renvoyé quelques milliers de recherches par mois avec une difficulté de 75 sur 100. La valeur n'est pas dans un tag particulier; elle est dans le fait qu'il y en a environ six millions et que chacun ne coûte rien à produire, puisque les lecteurs fournissent à la fois les citations et les tags.
Quel est le profil de backlinks de Goodreads ?
Notre Backlink Analyzer a renvoyé un Domain Rank de 97 sur 100, 287,990 domaines référents, 68,791,730 liens dofollow et 17,712,147 liens nofollow, 108,839 IP référentes et 47,356 sous-réseaux référents le 23 août 2026. Seuls Booking.com et Canva ont atteint 97 dans cette série.
Quel résultat a-t-il obtenu lors d'un audit technique ?
Mauvais, par rapport au reste de la série. Notre Website Audit a renvoyé 74 sur 100 pour la page d'accueil, avec 1 problème critique, 4 avertissements, 2 avis et 112 contrôles réussis. À titre de comparaison, Calculator.net a obtenu 95 avec 222 pages, et wikiHow, Zillow et NerdWallet ont tous obtenu 88.
Est-ce seulement du contenu généré par les utilisateurs ?
En partie, et c'est le point. Les citations et les tags viennent des lecteurs, mais pas les types de pages. Quelqu'un chez Goodreads a décidé qu'un tag sur une citation méritait sa propre URL, son propre modèle et son propre sitemap. La contribution est gratuite; l'architecture qui la transforme en pages trouvables est le travail.
Puis-je vérifier cela moi-même ?
Oui, en une dizaine de minutes. Ouvrez goodreads.com/robots.txt, listez les lignes Sitemap: et remarquez que chacune nomme un type de chose plutôt qu'une section. Suivez-en quelques-unes, comptez les fichiers enfants et ouvrez une feuille. C'est toute la méthode derrière cet article.
Trouvez votre deuxième nom
Chaque entreprise de cette série a fait passer quelque chose à l'échelle. RTINGS a fait passer les mesures à l'échelle. Wise a fait passer les devises à l'échelle. Zapier a fait passer les paires à l'échelle et a refusé d'en publier la plupart. Booking a fait passer les adjectifs à l'échelle. Zillow a fait passer le passé à l'échelle. Calculator.net a refusé de passer à l'échelle. wikiHow a fait passer les dessins à l'échelle. NerdWallet a fait passer des humains nommés à l'échelle. IKEA a fait passer les marchés à l'échelle.
Goodreads a fait passer des types de choses à l'échelle. Il a regardé une page de livre et y a vu un auteur, un genre, un prix, une liste, une discussion, une citation et un tag sur cette citation — puis a donné une URL à chacun.
La plupart des sites s'arrêtent au premier nom. Celui qu'ils vendent. Tout le reste reste enfoui dans une page où personne ne peut le chercher.
Regardez donc votre page la plus importante et notez chaque chose distincte qui y est mentionnée. Cette liste est la vraie carte de votre site, et vous n'en publiez probablement que la première ligne.
Puis vérifiez lesquels de ces noms sont réellement recherchés par les gens. Cela prend une minute, et c'est la différence entre un nouveau type de page et un nouveau tas de pages.
Mesuré le 23 août 2026. Les types de pages viennent du robots.txt de goodreads.com; les comptes viennent du comptage des fichiers de sitemap enfants et de la multiplication par les URL d'une feuille échantillonnée, chaque chiffre échantillonné étant publié dans la FAQ ci-dessus.
Les chiffres de liens, de mots-clés et d'audit sont des exécutions gratuites de nos propres outils. Les URL déclarées dans les sitemaps ne sont pas des pages indexées. Aucune donnée de trafic ou de revenus pour Goodreads ne nous était disponible, et aucune n'est revendiquée ici.