Si estuvieras creando una web sobre libros, harías una página para cada libro. Obvio.
Goodreads también hizo eso. Luego siguió adelante, y esa es la parte interesante.
Leímos su robots.txt y encontramos 16 sistemas de sitemap separados, uno para cada tipo de cosa del sitio. No secciones de una web — distintos tipos de sustantivo. Autores. Premios. Géneros. Grupos. Entrevistas. Listas. Temas de lectura. Sorteos. Preguntas que los lectores hicieron sobre un libro, y preguntas que los lectores hicieron sobre un autor, mantenidas separadas como dos cosas distintas.
Y los más grandes no son libros en absoluto.
Resultados de un vistazo
La mayoría de los catálogos tienen un sustantivo. Goodreads encontró dieciséis y luego construyó toda la maquinaria — sitemap, plantilla, patrón de URL — para cada uno.
El tipo de página individual más grande después de los autores es la humilde etiqueta de cita.
16 sustantivos, no uno
Esta es la lista completa que declara Goodreads: author, award, blog, genre, giveaway, group, interview, list, quote, quote tag, related work, topic, user, un index y dos tipos separados de community question — uno asociado a libros y otro asociado a autores.
Detrás de ellos hay 527 archivos de sitemap. Muestrear las hojas da una idea de la escala:
| Tipo de página | Archivos de sitemap | Aproximadamente |
|---|---|---|
| Autores | 186 | ~9 millones |
| Etiquetas de citas | 125 | ~6 millones |
| Citas | 111 | ~5.5 millones |
| Temas | 57 | ~2 millones |
| Usuarios, preguntas, listas | 40 | más pequeño |
Lee esa tabla otra vez. Una web sobre libros ha construido aproximadamente seis millones de páginas para etiquetas en citas.
La página que nadie pensaría crear
Una página de etiqueta de cita es exactamente lo que parece. Alguien resaltó una línea de una novela, alguien la etiquetó como "scifi", y esa etiqueta se convirtió en una página que lista cada cita que alguien haya etiquetado de la misma manera.
Goodreads no escribió nada de esto. Los lectores escribieron las citas y los lectores aplicaron las etiquetas. La empresa proporcionó una plantilla y una URL, y el catálogo se construyó solo.
Ese es el truco que vale la pena copiar. La cita ya estaba en el sitio, dentro de una página de libro donde nadie podía buscarla. Darle una página propia no creó contenido nuevo. Hizo encontrable contenido que ya existía.
Poca demanda, seis millones de veces
Ahora la parte honesta, porque la objeción obvia es justa: ¿alguien busca esto de verdad?
Medimos una de las etiquetas más grandes y volvió con unos pocos miles de búsquedas al mes, con una dificultad de 75 sobre 100. Es un premio pequeño y disputado.
Ese es precisamente el punto. Ninguna etiqueta de cita por sí sola merece que se construya una página. Seis millones de ellas sí. Es la misma aritmética que el archivo de Zillow de casas que nadie puede comprar: trivial de forma individual, enorme en conjunto, y viable solo porque la página no cuesta nada producirla.
Qué ganan todos esos sustantivos
Autoridad de dominio de 97 sobre 100 y casi 288,000 webs enlazando hacia Goodreads. Eso coloca a Goodreads en el nivel más alto de todo lo que hemos medido.
Y tiene sentido cuando ves la arquitectura. Una cita es uno de los objetos más enlazables de internet. La gente las pone en artículos de blog, ensayos, newsletters y respuestas de foros, y cuando lo hace, enlaza a donde vive la cita.
Una página de libro no puede recoger ese enlace. Una página de cita sí.
La puntuación que no consigue
Un número va en la otra dirección, y vale la pena reportarlo.
Pasamos goodreads.com por nuestro propio Website Audit y devolvió 74 sobre 100 — un problema crítico, cuatro advertencias, dos avisos, 112 comprobaciones aprobadas. Es la puntuación técnica más baja de cualquier empresa en esta serie. Calculator.net, una web con 222 páginas, obtuvo 95.
Dieciséis tipos de página y decenas de millones de URL son una superficie grande que mantener ordenada, y se nota. Que eso sea un coste real o aceptable depende de cuánto del archivo Google iba a mirar de cerca alguna vez.
Copia esto en una tarde
No necesitas dieciséis tipos de página. Casi seguro necesitas más de uno. Cuatro pasos.
1. Enumera los sustantivos que ya están dentro de tus páginas. No las secciones de tu sitio — las cosas. Una página de receta contiene ingredientes, técnicas, cocinas, ocasiones y utensilios. Cada una de esas cosas es un sustantivo que alguien busca.
2. Pregunta cuáles de ellos busca la gente por sí mismos. "Pollo" es un sustantivo que la gente busca. "Paso 4" no lo es. Este es el filtro que evita que generes basura.
3. Da a los supervivientes una página, un patrón de URL y un sitemap. La página debe listar todo lo que comparte ese sustantivo. Si el contenido ya existe dentro de otras páginas, no estás escribiendo nada nuevo — estás indexando lo que tienes.
4. Deja que la gente etiquete cosas, si tienes gente. Los seis millones de páginas de etiquetas de Goodreads existen porque los lectores las hicieron. Etiquetar es la operación de contenido más barata que existe, y las etiquetas también son las palabras clave.
Lo que no puedes copiar y lo que no pudimos comprobar
Una audiencia que escribe cosas. Goodreads tiene millones de lectores que transcriben citas gratis. Si nadie contribuye a tu sitio, las etiquetas no aparecerán solas y vuelves a escribir.
Veinte años de acumulación. Esto no llegó como un lanzamiento. Creció, un tipo de página a la vez.
Y esto es lo que no pudimos comprobar:
Muestreamos, no rastreamos. Los recuentos de páginas vienen de contar archivos de sitemap y multiplicar por las URL de una hoja muestreada. Los totales reales diferirán, y las URL declaradas no son páginas indexadas.
No hay un sitemap separado para libros. Los libros parecen vivir en una serie genérica de sitemaps numerados, no en un índice de entidad con nombre, así que no podemos darte un recuento de libros para compararlo con el recuento de citas. Preferimos decir eso antes que adivinarlo.
Sin datos de tráfico ni ingresos. No había ninguno disponible para nosotros y no se afirma ninguno.
Antes de construir un nuevo tipo de página, comprueba si alguien lo busca. Nuestra herramienta Keyword Research te da volumen, dificultad e intención para cualquier término, además de variaciones relacionadas y de cola larga — justo así distingues un sustantivo real de uno inventado.
- Volumen, dificultad, coste por clic e intención
- Términos relacionados, variantes de cola larga y formulaciones de pregunta
- 3 comprobaciones al día, sin registro, sin tarjeta
Preguntas frecuentes
¿Cuáles son los 16 tipos de página de Goodreads?
Desde su robots.txt del 23 de agosto de 2026: author, author community question, award, blog, book community question, genre, giveaway, group, index, interview, list, quote, quote tag, related work, topic y user. Cada uno tiene su propio índice de sitemap, y juntos apuntan a 527 archivos de sitemap secundarios.
¿Cómo estimaron los recuentos de páginas?
Contando los archivos secundarios de cada índice de sitemap, abriendo una hoja de cada uno de los tipos más grandes y multiplicando. Autores: 186 archivos con unas 48,700 URL cada uno. Etiquetas de citas: 125 archivos con 50,000, el máximo que puede contener un archivo de sitemap. Citas: 111 archivos con unas 49,894. Temas: 57 archivos con unas 34,334. Son estimaciones a partir de una muestra, y las URL declaradas no son lo mismo que páginas indexadas.
¿Por qué no hay un sitemap para libros?
No pudimos encontrar uno con nombre. Los índices index y related work apuntan a una serie genérica de sitemaps numerados, que es muy probablemente donde viven las páginas de libros. Como no podemos aislarlas, este artículo no compara el número de páginas de libros con el número de páginas de citas, por tentadora que sea esa comparación.
¿Las páginas de etiquetas de citas se buscan de verdad?
Sí, aunque modestamente por etiqueta. Medimos una de las etiquetas más grandes y devolvió unos pocos miles de búsquedas al mes con una dificultad de 75 sobre 100. El valor no está en una etiqueta cualquiera; está en que hay aproximadamente seis millones de ellas y cada una no cuesta nada producirla, porque los lectores aportan tanto las citas como las etiquetas.
¿Cuál es el perfil de backlinks de Goodreads?
Nuestro Backlink Analyzer devolvió Domain Rank 97 sobre 100, 287,990 dominios de referencia, 68,791,730 enlaces dofollow y 17,712,147 nofollow, 108,839 IP de referencia y 47,356 subredes de referencia el 23 de agosto de 2026. Solo Booking.com y Canva han igualado 97 en esta serie.
¿Cómo le fue en una auditoría técnica?
Mal, en relación con el resto de la serie. Nuestro Website Audit devolvió 74 sobre 100 para la página de inicio, con 1 problema crítico, 4 advertencias, 2 avisos y 112 comprobaciones aprobadas. En comparación, Calculator.net obtuvo 95 con 222 páginas, y wikiHow, Zillow y NerdWallet obtuvieron 88.
¿Esto es solo contenido generado por usuarios?
En parte, y ese es el punto. Las citas y las etiquetas vienen de los lectores, pero los tipos de página no. Alguien en Goodreads decidió que una etiqueta en una cita merecía su propia URL, plantilla y sitemap. La contribución es gratis; la arquitectura que la convierte en páginas encontrables es el trabajo.
¿Puedo comprobarlo yo mismo?
Sí, en unos diez minutos. Abre goodreads.com/robots.txt, lista las líneas Sitemap: y observa que cada una nombra una clase de cosa en lugar de una sección. Sigue un par de ellas, cuenta los archivos secundarios y abre una hoja. Ese es todo el método detrás de este artículo.
Encuentra tu segundo sustantivo
Cada empresa de esta serie escaló algo distinto. RTINGS escaló mediciones. Wise escaló divisas. Zapier escaló pares y se negó a publicar la mayoría. Booking escaló adjetivos. Zillow escaló el pasado. Calculator.net se negó a escalar en absoluto. wikiHow escaló dibujos. NerdWallet escaló humanos con nombre. IKEA escaló mercados.
Goodreads escaló tipos de cosa. Miró una página de libro y vio un autor, un género, un premio, una lista, una discusión, una cita y una etiqueta en esa cita — y dio a cada uno su URL.
La mayoría de las webs se detienen en el primer sustantivo. El que venden. Todo lo demás queda enterrado dentro de una página donde nadie puede buscarlo.
Así que mira tu página más importante y escribe cada cosa distinta que se menciona en ella. Esa lista es el mapa real de tu sitio, y probablemente solo estás publicando la primera línea.
Luego comprueba cuáles de esos sustantivos busca la gente de verdad. Toma un minuto, y es la diferencia entre un nuevo tipo de página y una nueva pila de páginas.
Medido el 23 de agosto de 2026. Los tipos de página provienen del robots.txt de goodreads.com; los recuentos provienen de contar archivos de sitemap secundarios y multiplicar por las URL de una hoja muestreada, con cada cifra muestreada publicada en las preguntas frecuentes anteriores.
Las cifras de enlaces, palabras clave y auditoría son ejecuciones gratuitas de nuestras propias herramientas. Las URL declaradas en sitemaps no son páginas indexadas. No teníamos datos de tráfico ni ingresos de Goodreads disponibles, y no se afirma ninguno aquí.