Volver al blog

24 de junio de 2026

Contenido duplicado en WordPress causado por categorías, etiquetas y archivos

Por qué WordPress crea más páginas de las que espera

Una entrada de WordPress aparece en múltiples páginas de archivo y paginación.
Una entrada de WordPress aparece en múltiples páginas de archivo y paginación.

WordPress puede publicar una entrada y hacer que esa misma entrada sea accesible desde muchas URL diferentes.

Existe el enlace permanente principal de la entrada, pero WordPress también crea páginas de archivo para categorías, etiquetas, autores y fechas.

Si el tema muestra la entrada completa en esas páginas de archivo, el mismo texto aparece en varios lugares.

Incluso si muestra extractos, los mismos títulos, imágenes y textos introductorios pueden repetirse en distintas páginas de archivo.

Esta duplicación también se produce con la paginación.

La página de inicio del blog puede mostrar entradas en la página 1 y luego repetir conjuntos parcialmente coincidentes en /page/2/ y las páginas posteriores.

Las páginas de búsqueda pueden volver a mostrar esas mismas entradas en una URL de consulta como /?s=keyword.

El resultado es que WordPress «crea» muchas más páginas indexables que la cantidad de entradas y páginas publicadas.

Para entender por qué, es necesario analizar cómo funcionan los archivos internamente.

Cómo los archivos de WordPress replican el contenido de las entradas en múltiples rutas

Una entrada principal se replica en varias rutas de archivo superpuestas.
Una entrada principal se replica en varias rutas de archivo superpuestas.

WordPress funciona como un sistema de enrutamiento que responde a muchas solicitudes distintas con el mismo conjunto de entradas.

Es posible navegar por fecha en el índice del blog, por tema en los archivos de categorías y etiquetas, por autor en los archivos de autor y por calendario en los archivos de fechas.

Cada ruta apunta a colecciones que se superponen, por lo que una entrada puede aparecer en la página de inicio del blog, en una o más categorías, en varias etiquetas, bajo el nombre de su autor y en el archivo de un mes o día.

Que esto se convierta en «contenido duplicado» depende de lo que muestre cada página de archivo.

Algunos temas presentan el contenido completo de las entradas en los archivos, lo que puede replicar grandes bloques palabra por palabra.

Otros temas muestran extractos, lo que reduce la repetición exacta, aunque siguen duplicando elementos clave como encabezados, imágenes destacadas y enlaces internos.

Los feeds pueden agregar más rutas que reproducen los mismos elementos, y las páginas de resultados de búsqueda pueden mostrar la misma lista de entradas en numerosas URL de consulta.

En este modelo, la «URL única y verdadera» es el enlace permanente de la entrada, que también debe coincidir con la señal de URL canónica que indica a los motores de búsqueda cuál es la versión considerada principal.

A partir de ahí, conviene entender cómo suelen responder los buscadores cuando encuentran todas estas páginas superpuestas.

Cómo suelen tratar los motores de búsqueda estos duplicados: selección, no penalización automática

El buscador selecciona una URL canónica y filtra las versiones duplicadas.
El buscador selecciona una URL canónica y filtra las versiones duplicadas.

Cuando los motores de búsqueda rastrean los archivos y enlaces permanentes de WordPress, suelen elegir una versión para indexarla y filtrar las demás.

En muchos casos, seleccionan el enlace permanente porque parece ser la página más específica para ese contenido.

Este comportamiento significa que no siempre se observa una caída de posicionamiento que parezca una penalización, aunque la duplicación sea real.

Aun así, las herramientas SEO pueden detectar este patrón.

En Google Search Console pueden aparecer estados como «Duplicada: el usuario no ha indicado ninguna versión canónica» o «Duplicada: Google ha elegido una versión canónica diferente a la del usuario».

Aunque el posicionamiento no cambie, las URL duplicadas de los archivos pueden dividir la atención entre varias páginas, y los rastreadores pueden dedicar tiempo a páginas de poco valor en lugar de entradas nuevas o actualizadas.

Estos riesgos señalan la necesidad de aplicar controles prácticos que mantengan la utilidad de los archivos para la navegación sin permitir que compitan con las URL principales de las entradas.

Extractos, gestión de URL canónicas y «seguir, pero no indexar» en los archivos

Los archivos conservan enlaces mientras algunas páginas quedan fuera del índice.
Los archivos conservan enlaces mientras algunas páginas quedan fuera del índice.

Es posible reducir la duplicación al cambiar lo que muestran las páginas de archivo.

Al presentar extractos en lugar de entradas completas en los archivos de categorías, etiquetas, autores y fechas, se evita copiar todo el contenido de la entrada en numerosas URL de archivo.

También se pueden redactar extractos personalizados para que el fragmento del archivo sea diferente del primer párrafo de la entrada.

Las etiquetas canónicas ofrecen una segunda capa de control.

Una etiqueta canónica indica a los motores de búsqueda qué URL representa la versión principal de una página.

En el caso de las entradas, debe apuntar al enlace permanente.

En las páginas de archivo, las URL canónicas suelen apuntar a sí mismas porque cada archivo es una página independiente, pero las páginas de las entradas deben seguir siendo el destino principal del texto de cada entrada.

Un enfoque habitual para los archivos de poco valor es usar la metaetiqueta robots «noindex, follow».

«Noindex» solicita al rastreador que no almacene ese archivo en el índice, mientras que «follow» le permite recorrer los enlaces de la página y descubrir las entradas.

Depender únicamente de nofollow no resuelve la duplicación en el índice, ya que esa configuración no garantiza que una página quede fuera de él.

Muchos sitios utilizan plugins SEO como Yoast SEO, Rank Math, o All in One SEO para configurar noindex en taxonomías y archivos.

Esto exige decidir qué se debe indexar y qué conviene excluir.

Indexar o aplicar noindex a los archivos: sitemaps, bloqueos y redirecciones

Las páginas de archivo se separan en rutas aprobadas, excluidas y redirigidas.
Las páginas de archivo se separan en rutas aprobadas, excluidas y redirigidas.

Primero, hay que decidir qué páginas de archivo cumplen una función para el sitio y sus lectores.

Si una página de categoría tiene un tema claro y una descripción única en la parte superior, puede mantenerse indexable.

Si las páginas de etiquetas existen porque estas se acumulan sin una estrategia, o si se trata de un blog con un solo autor donde sus archivos no aportan valor, es posible configurar los archivos de etiquetas, autores y fechas como noindex, follow.

También es importante que el sitio tenga una única versión preferida del dominio y el protocolo.

Se debe elegir https y decidir entre la versión con www o sin www; luego, hay que usar redirecciones y URL canónicas coherentes para que solo esa versión permanezca indexable.

Después, conviene revisar los sitemaps XML.

Si un sitemap incluye URL de etiquetas o categorías y estas generan informes de duplicación, se puede dejar de enviar esas secciones y enviar únicamente las entradas y páginas, sin eliminar los archivos utilizados para la navegación.

Si no se desea que los archivos se rastreen en absoluto, es posible desautorizar rutas como /tag/ y /category/ en robots.txt.

Sin embargo, disallow bloquea el rastreo y puede limitar el descubrimiento de entradas a través de esas páginas.

En el caso de patrones inusuales de URL similares a archivos que no deberían existir, como segmentos /page/0/ repetidos, se pueden redirigir a la página válida más cercana o devolver un error 404 claro.

Después, es posible comprobar el resultado en Google Search Console comparando la cantidad esperada de páginas indexadas y supervisando los informes de duplicación a lo largo del tiempo.

Así se completa la revisión del comportamiento de estas URL de WordPress en la práctica.

Preguntas frecuentes

Search Console informa de repente miles de URL de archivo. ¿Qué se debe auditar primero?

Primero se deben agrupar las URL por categorías, etiquetas, autores, fechas, búsquedas y patrones de paginación antes de cambiar cualquier configuración.

Después se compara cada grupo con el enlace permanente y con las señales canónicas, robots y de sitemap para atender primero el conflicto más grande.

¿Cómo se pueden conservar las páginas de categoría útiles y eliminar el ruido de archivos de poco valor?

Solo deben conservarse los archivos con un propósito distinto, una introducción única y una función estable dentro de los enlaces internos.

Los archivos poco útiles de etiquetas, autores y fechas pueden configurarse como noindex, follow o redirigirse si ya no son necesarios para la navegación.

¿Qué ocurre si el tema y el plugin SEO envían señales canónicas o noindex contradictorias?

Se debe inspeccionar el HTML renderizado de cada tipo de archivo representativo para identificar qué capa escribe la directiva final.

Conviene cambiar una sola fuente de control, vaciar la caché y volver a probar antes de aplicar el ajuste en todo el sitio.

¿Cómo se comprueba que la limpieza de archivos funcionó sin crear un nuevo problema de rastreo?

Durante varios ciclos de rastreo se deben comparar las URL enviadas e indexadas, las tendencias de duplicación, la actividad de rastreo y el descubrimiento de entradas nuevas.

El cambio específico debe revertirse si desaparecen categorías importantes o si el contenido nuevo resulta más difícil de descubrir.

Mejora tu Presencia en Línea, Reconocimiento de Marca y Branding

Si necesitas ayuda para conseguir más clientes, envía un mensaje para comenzar con tu sitio web o iniciar una estrategia de SEO que te posicione en Google y AI, generando más llamadas, mensajes y correos.

This site is protected by reCAPTCHA and the Google Privacy Policy and Terms of Service apply.