Qué pasó cuando eliminamos 12.000 URLs innecesarias de un ecommerce

En un ecommerce grande, tener más URLs no significa tener más oportunidades SEO.

A veces significa exactamente lo contrario.

Puedes tener 30.000 productos y acabar con 100.000, 200.000 o más URLs accesibles para Google debido a:

  • filtros;
  • parámetros;
  • paginaciones;
  • búsquedas internas;
  • variantes;
  • ordenaciones;
  • combinaciones de atributos;
  • URLs duplicadas;
  • antiguas categorías;
  • productos eliminados;
  • páginas generadas automáticamente.

Y muchas de ellas no tienen ninguna posibilidad real de generar tráfico ni ventas.

En uno de los escenarios más habituales que encontramos en ecommerce grandes, el problema no era que faltasen páginas.

El problema era que sobraban miles.

En este caso, el objetivo fue reducir aproximadamente 12.000 URLs innecesarias.

No para “tener menos páginas”.

Sino para conseguir que Google dedicase más atención a las páginas que realmente importaban.


El problema empezó con algo aparentemente inocente

El ecommerce había ido creciendo durante años.

Cada nueva funcionalidad añadía URLs.

Primero llegaron los filtros.

Después las marcas.

Después nuevas formas de ordenar productos.

Después variantes.

Después parámetros utilizados por campañas.

Después categorías antiguas que nunca se eliminaron correctamente.

Individualmente ninguna parecía especialmente preocupante.

El problema apareció cuando las sumamos todas.

Una categoría podía generar URLs como:

/mesas-jardin/?color=negro

/mesas-jardin/?orden=precio

/mesas-jardin/?marca=x

/mesas-jardin/?color=negro&marca=x

/mesas-jardin/?color=negro&material=aluminio

Y muchas otras combinaciones.

Algunas podían tener sentido para SEO.

La mayoría no.


Tener 12.000 URLs de más no era el verdadero problema

El número, por sí solo, no significa demasiado.

Un ecommerce puede tener cientos de miles de URLs perfectamente justificadas.

Lo importante era qué tipo de URLs eran.

Cuando analizamos el conjunto encontramos páginas:

  • prácticamente duplicadas;
  • sin búsquedas;
  • sin enlaces;
  • sin tráfico;
  • sin ventas;
  • con muy pocos productos;
  • generadas por parámetros;
  • demasiado similares a categorías principales;
  • antiguas;
  • sin utilidad real para el usuario.

Es decir:

Google estaba encontrando miles de páginas que nosotros mismos no considerábamos importantes.

Ahí estaba el problema.


Antes de eliminar nada, clasificamos

Eliminar URLs masivamente sin entender qué función cumplen puede ser peor que mantenerlas.

Por eso el primer paso no debería ser:

vamos a bloquear 12.000 URLs.

Primero hay que saber qué estamos eliminando.

Nosotros separaríamos las URLs en grupos.

URLs claramente inútiles

Por ejemplo:

  • parámetros de ordenación;
  • combinaciones sin demanda;
  • páginas vacías;
  • búsquedas internas;
  • URLs técnicas.

Aquí normalmente la decisión es relativamente sencilla.


URLs duplicadas

Dos o más páginas prácticamente iguales.

Aquí hay que estudiar:

  • canonical;
  • arquitectura;
  • enlaces internos;
  • redirecciones;
  • parametrización.

No siempre queremos eliminarlas físicamente.

A veces simplemente queremos dejar claro cuál es la URL principal.


URLs con potencial SEO

Este grupo es especialmente importante.

Un filtro puede parecer inicialmente innecesario y, sin embargo, responder a una búsqueda real.

Por ejemplo:

/mesas-jardin/aluminio/

puede tener sentido.

Mientras que:

/mesas-jardin/?orden=precio-descendente

probablemente no.

Por eso nunca eliminaríamos URLs simplemente porque sean filtros.

Primero preguntamos:

¿Existe demanda real para esta combinación?


Lo primero que cambió fue la claridad de la arquitectura

Antes de la limpieza teníamos muchas rutas diferentes llevando a contenidos similares.

Después empezamos a conseguir una estructura mucho más clara.

En lugar de:

100 maneras diferentes de llegar prácticamente al mismo resultado,

teníamos menos páginas, pero con funciones más definidas.

Por ejemplo:

Categoría principal

Mesas de jardín

Subcategorías relevantes

Mesas de jardín de aluminio
Mesas de jardín extensibles
Mesas de jardín redondas

Filtros de usuario no indexables

Ordenar por precio
Disponibilidad
Rango de precio
Otros atributos sin demanda SEO

Esto simplifica mucho la relación entre:

categoría → intención de búsqueda → URL

Y esa claridad es importante tanto para Google como para el equipo que gestiona el ecommerce.


Después cambió el rastreo

Uno de los objetivos principales era conseguir que Google dedicase menos esfuerzo a URLs que no nos interesaban.

Imaginemos que Google entra en una tienda y encuentra:

  • 20.000 productos importantes;
  • 5.000 categorías útiles;
  • 30.000 filtros sin interés;
  • 10.000 URLs parametrizadas;
  • miles de variantes.

Estamos haciendo que el buscador tenga que decidir entre una enorme cantidad de posibilidades.

Nuestro objetivo era reducir ese ruido.

Después de la limpieza, queríamos que Google encontrase con mayor frecuencia:

  • categorías importantes;
  • productos activos;
  • nuevas referencias;
  • páginas comerciales estratégicas.

No significa que Google tenga un número fijo de URLs que pueda rastrear y, cuando se acaba, se marche.

La realidad es bastante más compleja.

Pero sí sabemos que en sitios grandes conviene evitar exponer cantidades enormes de URLs duplicadas o de escaso valor.


Empezamos a descubrir productos que estaban demasiado escondidos

Este fue otro efecto interesante.

Al analizar cómo se generaban aquellas miles de URLs también apareció otro problema:

había páginas importantes recibiendo menos enlaces internos de los que deberían.

Mientras algunas combinaciones de filtros estaban enlazadas desde muchos lugares, determinados productos o categorías estratégicas apenas recibían enlaces.

Así que la limpieza de URLs terminó convirtiéndose también en una limpieza del enlazado interno.

El objetivo dejó de ser solamente:

evitar URLs inútiles.

Pasó a ser:

dirigir mejor la autoridad interna hacia las URLs importantes.


También simplificamos los sitemaps

Un sitemap debería ayudarnos a comunicar cuáles son las URLs que queremos que Google conozca.

Sin embargo, es frecuente encontrar sitemaps llenos de:

  • productos eliminados;
  • URLs redireccionadas;
  • páginas no indexables;
  • variantes;
  • categorías antiguas.

Después de la limpieza, revisar los sitemaps era imprescindible.

Queríamos que existiera coherencia.

Si una URL no queremos que forme parte de Google, no tiene demasiado sentido seguir presentándola constantemente como una página importante.


Pero eliminar URLs no hace subir el tráfico automáticamente

Este punto es importante.

Existe una idea bastante peligrosa:

Tenemos demasiadas URLs. Eliminamos 12.000 y Google nos premiará.

No funciona así.

Google no concede posiciones simplemente porque tengamos menos páginas.

La limpieza tiene sentido cuando elimina problemas reales.

Por ejemplo:

  • duplicidades;
  • arquitectura deficiente;
  • filtros ilimitados;
  • páginas vacías;
  • señales contradictorias;
  • enlazado desperdiciado.

Si las 12.000 páginas fueran útiles, eliminarlas sería un desastre.

Por eso el trabajo está en seleccionar correctamente cuáles sobran.


¿Qué queríamos ver después de la limpieza?

No evaluaríamos el proyecto mirando únicamente las posiciones de diez keywords.

Hay señales mucho más interesantes.

Menos URLs innecesarias descubiertas

Queremos que con el tiempo Google deje de dedicar atención a determinadas familias de URLs.


Mayor proporción de páginas importantes indexadas

No buscamos necesariamente aumentar el número total de URLs indexadas.

Podemos incluso reducirlo.

La pregunta es:

¿Está aumentando la proporción de páginas importantes que Google indexa?

Eso es mucho más relevante.


Mayor rastreo de productos y categorías estratégicas

Especialmente:

  • productos nuevos;
  • categorías nuevas;
  • páginas con stock;
  • categorías comerciales importantes.

Más impresiones concentradas en URLs válidas

Antes podíamos tener señales repartidas entre varias URLs parecidas.

Después queremos observar una mayor concentración.

En lugar de:

cinco URLs compitiendo para una misma intención,

queremos una página claramente reconocible.


Uno de los resultados más interesantes puede ser tener menos páginas indexadas

Puede parecer contradictorio.

Imaginemos:

Antes:

45.000 URLs indexadas

Después:

35.000 URLs indexadas

Podría parecer que el SEO ha empeorado.

Pero imaginemos ahora que ocurre esto:

Antes:

45.000 indexadas
8.000 reciben tráfico

Después:

35.000 indexadas
12.000 reciben tráfico

Ahora la lectura cambia completamente.

Tenemos menos páginas.

Pero una mayor proporción de ellas tiene utilidad real.

Para nosotros eso sería una mejora.


Indexar más no debería ser el objetivo

Este es uno de los errores que más vemos en ecommerce.

Se interpreta:

más URLs indexadas = más SEO.

Y no necesariamente.

Preferimos:

20.000 URLs útiles

que:

100.000 URLs de las que 80.000 no reciben nunca una sola visita.

Google no necesita conocer todas las combinaciones posibles de nuestro catálogo.

Necesita entender cuáles son nuestras mejores páginas para responder a cada búsqueda.


Lo más complicado no fue eliminar URLs

Lo más complicado fue decidir cuáles conservar.

Porque dentro de miles de filtros y combinaciones puede haber oportunidades.

Por ejemplo:

Un ecommerce puede tener:

/estufas/?combustible=pellets

Quizá técnicamente sea solamente un filtro.

Pero comercialmente responde perfectamente a una búsqueda como:

estufas de pellets

En ese caso no queremos eliminarlo.

Quizá queremos hacer exactamente lo contrario:

convertirlo en una categoría SEO real.

Por eso una limpieza de URLs también puede descubrir nuevas oportunidades.


Encontramos páginas que debían desaparecer…

Pero también páginas que debían mejorar.

Ese es uno de los mayores beneficios de hacer este análisis.

Las URLs normalmente terminan divididas en cuatro grandes grupos.

Mantener

Páginas útiles y correctamente planteadas.

Mejorar

Páginas con potencial pero contenido, catálogo o enlazado insuficiente.

Consolidar

Varias URLs que responden a la misma intención.

Eliminar

URLs sin utilidad SEO ni comercial.

La última categoría suele recibir toda la atención.

Pero muchas veces las mayores oportunidades están en las tres primeras.


La limpieza también afecta al futuro del ecommerce

Eliminar 12.000 URLs no sirve demasiado si seis meses después el sistema ha generado otras 20.000.

Por eso el trabajo realmente importante es entender:

por qué se generaron.

Puede ser necesario modificar:

  • reglas del CMS;
  • filtros;
  • parámetros;
  • canonicals;
  • enlaces;
  • robots;
  • sitemaps;
  • arquitectura;
  • lógica de generación de URLs.

La solución definitiva no es limpiar continuamente.

Es conseguir que el sistema deje de producir basura.


De 12.000 URLs eliminadas a una arquitectura más controlada

Al principio parece un problema puramente técnico.

Hay 12.000 URLs que sobran.

Las eliminamos.

Fin.

Pero cuando profundizas descubres que esas URLs son simplemente un síntoma.

Detrás puede haber problemas de:

  • arquitectura;
  • categorización;
  • indexación;
  • navegación;
  • generación automática;
  • enlazado interno;
  • estrategia SEO.

Y ahí está la verdadera oportunidad.


El objetivo nunca fue tener menos URLs

El objetivo era tener mejores URLs.

Páginas que:

  • respondiesen a búsquedas reales;
  • tuviesen productos;
  • recibiesen enlaces internos;
  • pudiesen posicionar;
  • generasen tráfico;
  • pudiesen terminar generando ventas.

Porque un ecommerce grande no necesita que Google rastree todo lo que técnicamente puede generar.

Necesita que Google entienda perfectamente qué parte de su catálogo merece aparecer en los resultados de búsqueda.

Y muchas veces, para conseguirlo, el primer paso no es crear más.

Es eliminar ruido.

Recent articles