El punto de partida
Una tienda PrestaShop con el catálogo en dos idiomas. Rastreamos una muestra de 400 URLs, hasta dos clics desde la portada y respetando su robots.txt. Mientras seguía enlaces, el rastreo descubrió 3.038 URLs y 2.024 de ellas llevaban parámetros: filtros, ordenaciones, vistas y resultados por página.
Son variaciones del mismo listado. Algunas pueden ser una página con sentido propio; la mayoría no.
Qué hace cada parámetro y qué proponemos
La auditoría clasifica cada parámetro por su función y propone una decisión de indexación:
ParámetroQué haceURLsDecisión
?q=Filtros (marca, categoría…)878Revisar
?resultsPerPage=Resultados por página1.027Descartar
?order=Ordenación del listado848Descartar
?productListView=Vista en cuadrícula o lista212Descartar
?page=Paginación79Mantener
Ordenación, vista y resultados por página no cambian lo que el usuario encuentra, solo cómo se muestra: la propuesta es que apunten con canonical a la URL sin parámetro y no se indexen. La paginación sí conviene mantenerla rastreable, con un canonical a sí misma en cada página.
Lo que estaba bien
También contamos lo que funciona. En la muestra, ninguna página quedaba a más de dos clics de la portada, no había páginas sin enlaces internos y las URLs de producto y de categoría seguían una estructura coherente (idioma, categoría e identificador). Con una base así, el trabajo está en decidir, no en reparar.
La decisión que importa: los filtros
El parámetro ?q= concentra los filtros por marca, categoría y otros atributos: 878 URLs. Indexarlas todas generaría páginas casi iguales; no indexar ninguna deja fuera las pocas que sí responden a una búsqueda real. Por eso su decisión es «revisar»: se resuelve con datos de demanda y con el catálogo, combinación a combinación.
Ese es el paso siguiente del servicio: cruzar el catálogo con la demanda, clasificar cada combinación como crear, revisar o descartar, y construir solo las que cumplen una regla de calidad.
Cómo leer este caso
- Es una muestra de 400 URLs: los recuentos describen las URLs descubiertas durante ese rastreo, no todo el sitio.
- No mide tráfico, posiciones ni demanda de búsqueda. Las decisiones son una propuesta por reglas que un especialista revisa.
- Los datos son reales y están anonimizados: no se indica el nombre de la tienda ni su dominio.