Ayuda con problema contenido duplicado

  • Autor Autor manuelpererive
  • Fecha de inicio Fecha de inicio
M

manuelpererive

Beta
Verificación en dos pasos activada
¡Usuario con pocos negocios! ¡Utiliza siempre saldo de Forobeta!
Hola a todos! tengo una web de eventos en la que utilizo el plugin All In One Event. El problema que tengo es que search console me detecta contenido duplicado en cada evento ya que el plugin fabrica dos urls por cada evento de la siguiente forma:

https://miweb.com/evento/nombre-evento/
https://miweb.com/evento/nombre-evento/?instance_id=39

¿cómo podría reparar este problema para que solo indexe la primera url? en caso de hacerlo con robots.txt, qué tendría que poner en el archivo?

Muchas gracias!
 
Primero tendrías que indicarle a esa url que sea no index y después bloquear el acceso a las arañas quizás poniendo en robots.txt Disallow: /?instance_id=

El problema es que si ya están idexadas ambas url, y haces ambas cosas al mismo tiempo (poner no index y bloquear con robots.txt), estarías evitando que Google entre y vea que ahora tiene la etiqueta no index ya que de antemano lo estás bloqueando.

Creo que primero tendrías que poner no index a esas url, esperar tal vez un par de semanas hasta que Google las desindexe y ahí si bloquearlas con robots.txt
 
Primero tendrías que indicarle a esa url que sea no index y después bloquear el acceso a las arañas quizás poniendo en robots.txt Disallow: /?instance_id=

El problema es que si ya están idexadas ambas url, y haces ambas cosas al mismo tiempo (poner no index y bloquear con robots.txt), estarías evitando que Google entre y vea que ahora tiene la etiqueta no index ya que de antemano lo estás bloqueando.

Creo que primero tendrías que poner no index a esas url, esperar tal vez un par de semanas hasta que Google las desindexe y ahí si bloquearlas con robots.txt

Muchísimas gracias por la respuesta, cómo puedo hacer para poner la etiqueta de no index, qué código tendría que poner y dónde?
 
Buenas, lo que comenta@jccg28 es correcto pero entiendo tu pregunta, seguro que tienes un CMS que quizás no te permite configurar páginas noindex para este tipo de parámetro.

Otra opción que tienes es la de configurar en Google Search Console la opción de parámetros en urls para decirle a Google que ignore las urls con el parámetro instance_id. Deberías decirle a Google que las urls con ese parámetro no influyen en el contenido para que las ignore.

Aquí tienes información donde puedes ver donde encontrar esta opción: Estructura web y patrones de urls - Posicionamiento Web

La otra opción que también tienes es configurar el parámetro rel canonical en las páginas para que le indiquen a Google (y otros buscadores, que siempre hablamos de Google 🙂 ) cual es la página original.

Aquí tienes información sobre como usar el metatag canonical: Contenido Duplicado - Posicionamiento Web

Espero te sirva de complemento esta respuesta.
Javier
 
Buenas, lo que comenta@jccg28 es correcto pero entiendo tu pregunta, seguro que tienes un CMS que quizás no te permite configurar páginas noindex para este tipo de parámetro.

Otra opción que tienes es la de configurar en Google Search Console la opción de parámetros en urls para decirle a Google que ignore las urls con el parámetro instance_id. Deberías decirle a Google que las urls con ese parámetro no influyen en el contenido para que las ignore.

Aquí tienes información donde puedes ver donde encontrar esta opción: Estructura web y patrones de urls - Posicionamiento Web

La otra opción que también tienes es configurar el parámetro rel canonical en las páginas para que le indiquen a Google (y otros buscadores, que siempre hablamos de Google 🙂 ) cual es la página original.

Aquí tienes información sobre como usar el metatag canonical: Contenido Duplicado - Posicionamiento Web

Espero te sirva de complemento esta respuesta.
Javier

Muchas gracias por la respuesta Javier, le echaré un vistazo a los enlaces que me dices y seguro que me sirven de ayuda. Saludos!
 
Atrás
Arriba