Parte 4 de nuestro último proyecto de Scrapy / Tutorial de Web Scraping. Analizando los detalles.
Web Scraping de un sitio grande con "scroll infinito" también conocido como "AJAX cargar más".
(Esto se basa en un proyecto real de Upwork).
*** PARTE 4 de 7 ***
Este video cubre la función "parse_detail", utilizada para extraer las recetas.
Una vez más podemos usar :
res = response.xpath("//script[@type='application/ld+json']/text()").get();
Esto extrae json y nos permite analizar el diccionario que obtenemos de él.
También obtenemos el número de diccionarios en una lista e iteramos a través de cada diccionario para extraer el valor de la CLAVE 'text' que necesitamos agregar a nuestra lista - ¡la misma lista que almacena la receta!
Por favor comenta, suscríbete, dale like, ya que esto requiere mucho esfuerzo y cuantas más opiniones/comentarios tengamos, mejor podremos adaptar futuros videos para ti.
Código en GitHub
Saludos,
Dr. Pi.
#scrapy #scrollinfinito #cargarmás