Блог UNmiss

Goodreads построил 16 типов страниц, а не только страницы книг

Goodreads объявляет 16 систем sitemap, по одной на каждый тип сущности. Авторы дают около 9 миллионов страниц, а теги цитат около 6 миллионов. Книги даже не возглавляют список.

Если бы вы строили сайт о книгах, вы сделали бы страницу для каждой книги. Очевидно.

Goodreads тоже так сделал. Затем он продолжил, и именно это здесь самое интересное.

Мы прочитали его robots.txt и нашли 16 отдельных систем sitemap, по одной для каждого типа сущности на сайте. Не разделы сайта — разные типы существительных. Авторы. Награды. Жанры. Группы. Интервью. Списки. Темы для чтения. Розыгрыши. Вопросы, которые читатели задавали о книге, и вопросы, которые читатели задавали об авторе, оставленные как две разные вещи.

И самые большие из них вовсе не книги.

Результаты в двух словах

16
отдельных типов страниц, у каждого свой sitemap
~6M
страниц только для тегов цитат
97
авторитет домена, измеренный нашим собственным инструментом
Короткая версия

У большинства каталогов есть одно существительное. Goodreads нашел шестнадцать, а затем построил всю механику — sitemap, шаблон, URL-паттерн — для каждого.

Самый крупный отдельный тип страниц после авторов — скромный тег цитаты.

16 существительных, а не одно

Вот полный список, который объявляет Goodreads: author, award, blog, genre, giveaway, group, interview, list, quote, quote tag, related work, topic, user, один index и два отдельных вида community question — один привязан к книгам, другой к авторам.

За ними стоят 527 файлов sitemap. Выборка листьев дает почувствовать масштаб:

Тип страницыФайлы sitemapПримерно
Авторы186~9 миллионов
Теги цитат125~6 миллионов
Цитаты111~5.5 миллиона
Темы57~2 миллиона
Пользователи, вопросы, списки40меньше

Прочитайте эту таблицу еще раз. Сайт о книгах построил примерно шесть миллионов страниц для тегов на цитатах.

Страница, которую никто не подумал бы построить

Страница тега цитаты ровно такая, как звучит. Кто-то выделил строку из романа, кто-то пометил ее тегом "scifi", и этот тег стал страницей со всеми цитатами, которые кто-либо когда-либо пометил так же.

Страница тега цитаты Goodreads для scifi, где перечислены цитаты из романов с автором и книгой; у каждой цитаты есть несколько ссылок-тегов, а рядом боковая панель Browse By Tag с размерами тегов, например Love Quotes 102k и Life Quotes 80.5k.
На что обратить внимание: у каждой цитаты есть три или четыре тега, и каждый тег ведет на другую такую же страницу. Боковая панель показывает, насколько большими бывают некоторые теги — Love Quotes содержит 102,000.

Goodreads ничего из этого не писал. Читатели вводили цитаты, и читатели применяли теги. Компания дала шаблон и URL, а каталог построил сам себя.

Вот прием, который стоит перенять. Цитата уже была на сайте, внутри страницы книги, где никто не мог ее искать. Собственная страница не создала новый контент. Она сделала уже существующий контент находимым.

Маленький спрос, шесть миллионов раз

Теперь честная часть, потому что очевидное возражение справедливо: кто-нибудь вообще это ищет?

Результат UNmiss Keyword Research для термина love quotes, показывающий месячный объем поиска, оценку сложности 75 из 100 и информационное намерение.
На что обратить внимание: скромный месячный объем, но сложность 75 из 100. Это не пустые запросы, и они не легкие.

Мы измерили один из самых больших тегов, и он вернулся с несколькими тысячами поисков в месяц при сложности 75 из 100. Это маленький, спорный приз.

В этом и весь смысл. Ни один отдельный тег цитаты не стоит того, чтобы строить под него страницу. Шесть миллионов таких тегов стоят. Это та же арифметика, что и у архива Zillow с домами, которые никто не может купить: по отдельности мелочь, вместе огромно, и жизнеспособно только потому, что производство страницы ничего не стоит.

Что зарабатывают все эти существительные

Отчет UNmiss Backlink Analyzer для goodreads.com с Domain Rank 97 из 100, примерно 81.6 миллиона backlinks всего, 287,990 ссылающимися доменами и 80 процентами dofollow-ссылок.
На что обратить внимание: Domain Rank 97. В этой серии до него дотянулись только Booking.com и Canva.

Авторитет домена 97 из 100 и почти 288,000 сайтов, которые ссылаются на Goodreads. Это ставит Goodreads в верхний эшелон всего, что мы измеряли.

И это становится логичным, когда видишь архитектуру. Цитата — один из самых легко цитируемых и ссылочных объектов в интернете. Люди вставляют их в посты блогов, эссе, рассылки и ответы на форумах, и когда они это делают, они ссылаются туда, где живет цитата.

Страница книги не может собрать такую ссылку. Страница цитаты может.

Оценка, которую он не получает

Одна цифра идет в другую сторону, и о ней стоит сказать.

Мы прогнали goodreads.com через наш собственный Website Audit, и результат составил 74 из 100 — одна критическая проблема, четыре предупреждения, два уведомления, 112 проверок пройдено. Это самая низкая техническая оценка среди всех компаний в этой серии. Calculator.net, сайт с 222 страницами, получил 95.

Шестнадцать типов страниц и десятки миллионов URL — большая поверхность, которую нужно держать в порядке, и это видно. Реальная ли это цена или приемлемая, зависит от того, какую часть архива Google вообще собирался рассматривать внимательно.

Скопируйте это за один день

Вам не нужны шестнадцать типов страниц. Почти наверняка вам нужно больше одного. Четыре шага.

1. Перечислите существительные, которые уже есть внутри ваших страниц. Не разделы вашего сайта — вещи. Страница рецепта содержит ингредиенты, техники, кухни, поводы и оборудование. Каждое из них — существительное, которое кто-то ищет.

2. Спросите, какие из них люди ищут сами по себе. "Курица" — существительное, которое люди ищут. "Шаг 4" — нет. Это фильтр, который не даст вам генерировать мусор.

3. Дайте выжившим страницу, URL-паттерн и sitemap. Страница должна перечислять все, что разделяет это существительное. Если контент уже существует внутри других страниц, вы не пишете ничего нового — вы индексируете то, что у вас есть.

4. Позвольте людям тегировать вещи, если у вас есть люди. Шесть миллионов страниц тегов Goodreads существуют потому, что их создали читатели. Тегирование — самая дешевая контент-операция, и теги также являются ключевыми словами.

Что вы не можете скопировать и что мы не проверили

Аудитория, которая что-то вводит. У Goodreads есть миллионы читателей, которые бесплатно переписывают цитаты. Если никто не вносит вклад на ваш сайт, теги не появятся сами по себе, и вы снова возвращаетесь к написанию.

Двадцать лет накопления. Это не появилось как запуск. Оно росло, по одному типу страниц за раз.

А вот что мы не смогли проверить:

Мы брали выборку, а не обходили весь сайт. Количество страниц получено из подсчета файлов sitemap и умножения на URL в выбранном листе. Реальные итоги будут отличаться, а объявленные URL не являются индексированными страницами.

Отдельного sitemap для книг нет. Книги, похоже, живут в общей пронумерованной серии sitemap, а не в именованном индексе сущности, поэтому мы не можем дать вам число книг для сравнения с числом цитат. Мы лучше скажем это, чем будем угадывать.

Нет данных о трафике или выручке. Они нам не были доступны, и мы ничего такого не утверждаем.

Бесплатно, без аккаунта
Найдите существительные, достойные страницы

Прежде чем строить новый тип страницы, проверьте, ищет ли его кто-нибудь. Наш инструмент Keyword Research дает объем, сложность и намерение для любого термина, а также связанные варианты и варианты длинного хвоста — именно так вы отличаете настоящее существительное от придуманного.

  • Объем, сложность, стоимость за клик и намерение
  • Связанные термины, варианты длинного хвоста и формулировки вопросов
  • 3 проверки в день, без регистрации, без карты
Исследовать ключевое слово бесплатно

Часто задаваемые вопросы

Какие 16 типов страниц есть у Goodreads?

Из его robots.txt на 23 августа 2026 года: author, author community question, award, blog, book community question, genre, giveaway, group, index, interview, list, quote, quote tag, related work, topic и user. У каждого есть собственный индекс sitemap, и вместе они указывают на 527 дочерних файлов sitemap.

Как вы оценили количество страниц?

Мы посчитали дочерние файлы в каждом индексе sitemap, открыли по одному листу из каждого крупнейшего типа и умножили. Авторы: 186 файлов примерно по 48,700 URL в каждом. Теги цитат: 125 файлов по 50,000, максимум, который может содержать файл sitemap. Цитаты: 111 файлов примерно по 49,894. Темы: 57 файлов примерно по 34,334. Это оценки по выборке, а объявленные URL не то же самое, что индексированные страницы.

Почему нет sitemap для книг?

Мы не смогли найти именованный. Индексы index и related work указывают на общую пронумерованную серию sitemap, где, скорее всего, и живут страницы книг. Поскольку мы не можем их изолировать, эта статья не сравнивает число страниц книг с числом страниц цитат, каким бы заманчивым ни было это сравнение.

Страницы тегов цитат действительно ищут?

Да, хотя скромно по каждому тегу. Мы измерили один из крупнейших тегов, и он вернул несколько тысяч поисков в месяц при сложности 75 из 100. Ценность не в каком-то одном теге; она в том, что их примерно шесть миллионов и каждый ничего не стоит произвести, потому что читатели дают и цитаты, и теги.

Какой у Goodreads профиль backlinks?

Наш Backlink Analyzer вернул Domain Rank 97 из 100, 287,990 ссылающихся доменов, 68,791,730 dofollow- и 17,712,147 nofollow-ссылок, 108,839 ссылающихся IP и 47,356 ссылающихся подсетей на 23 августа 2026 года. Только Booking.com и Canva достигли 97 в этой серии.

Как он прошел технический аудит?

Плохо относительно остальной серии. Наш Website Audit вернул 74 из 100 для главной страницы, с 1 критической проблемой, 4 предупреждениями, 2 уведомлениями и 112 пройденными проверками. Для сравнения, Calculator.net получил 95 при 222 страницах, а wikiHow, Zillow и NerdWallet получили по 88.

Это просто пользовательский контент?

Отчасти, и в этом смысл. Цитаты и теги приходят от читателей, но типы страниц — нет. Кто-то в Goodreads решил, что тег на цитате заслуживает собственной URL, шаблона и sitemap. Вклад бесплатен; работа заключается в архитектуре, которая превращает его в находимые страницы.

Могу ли я проверить это сам?

Да, примерно за десять минут. Откройте goodreads.com/robots.txt, выпишите строки Sitemap: и обратите внимание, что каждая называет тип вещи, а не раздел. Перейдите по паре из них, посчитайте дочерние файлы и откройте один лист. Это весь метод, стоящий за этой статьей.

Найдите свое второе существительное

Каждая компания в этой серии масштабировала что-то свое. RTINGS масштабировал измерения. Wise масштабировал валюты. Zapier масштабировал пары и отказался публиковать большинство из них. Booking масштабировал прилагательные. Zillow масштабировал прошлое. Calculator.net вообще отказался масштабироваться. wikiHow масштабировал рисунки. NerdWallet масштабировал именованных людей. IKEA масштабировала рынки.

Goodreads масштабировал типы вещей. Он посмотрел на страницу книги и увидел автора, жанр, награду, список, обсуждение, цитату и тег на этой цитате — и дал каждому из них URL.

Большинство сайтов останавливаются на первом существительном. На том, что они продают. Все остальное остается погребенным внутри страницы, где никто не может это искать.

Поэтому посмотрите на свою самую важную страницу и выпишите каждую отдельную вещь, которая на ней упомянута. Этот список — настоящая карта вашего сайта, и вы, вероятно, публикуете только первую ее строку.

Затем проверьте, какие из этих существительных люди действительно ищут. Это занимает минуту, и это разница между новым типом страниц и новой кучей страниц.

Измерено 23 августа 2026 года. Типы страниц взяты из robots.txt goodreads.com; подсчеты получены путем подсчета дочерних файлов sitemap и умножения на URL в выбранном листе, причем каждая выборочная цифра опубликована в FAQ выше.

Показатели ссылок, ключевых слов и аудита — бесплатные запуски наших собственных инструментов. Объявленные URL sitemap не являются индексированными страницами. Данные о трафике или выручке Goodreads нам не были доступны, и здесь мы их не заявляем.

Блог