Una duda sobre el scraping

  • Autor Autor alfbueno
  • Fecha de inicio Fecha de inicio
alfbueno

alfbueno

Beta
¡Usuario con pocos negocios! ¡Utiliza siempre saldo de Forobeta!
Hola, a ver si me podéis ayudar, estoy haciendo por curiosidad unas pruebas de scraping con un par de webs mias, ya sea usando CURL u otra librería.

El tema es que las webs se actualizan diariamente... ¿Cómo puedo controlar que solo mire lo que no tengo? Es que no tengo ni idea de como plantearlo.

Gracias!
 
hola , cual es el link de tu sitio?
 
Depende mucho de como sea el sitio a scrapear y de la información que quieres scrapear, si simplemente tiene fechas que puedes comprobar, si tienes que llevar una bd con todo lo extraído, sin con guardar el último objeto scrapeado te llega etc.
 
Hola, a ver si me podéis ayudar, estoy haciendo por curiosidad unas pruebas de scraping con un par de webs mias, ya sea usando CURL u otra librería.

El tema es que las webs se actualizan diariamente... ¿Cómo puedo controlar que solo mire lo que no tengo? Es que no tengo ni idea de como plantearlo.

Gracias!
Crea una base de datos con el contenido ya extraido.

Luego compruebas el contenido extraido con el contenido de la base de datos.

Si existe en la base de datos es contenido viejo. Si no es contenido nuevo.


Saludos

Enviado desde mi SM-J106B mediante Tapatalk
 
Atrás
Arriba