Scrapy es un potente, conciso y todo en uno marco de web scraping en Python. Se puede utilizar para extraer datos de cualquier sitio web. En esta demostración, discuto cómo instalar el marco de Scrapy en Mac y en Windows. Cómo analizar un sitio web para scraping. Finalmente, mostré cómo usar el marco de Scrapy para extraer datos del sitio goodreads.com con fines educativos. Consulta el curso completo de Web Scraping en Python en Udemy:
https://www.udemy.com/web-scraping-in-python/🚀 Temas Haz clic para ir directamente
⌨️ 0:00 | Introducción
⌨️ 1:04 | Configuración de Scrapy en Mac
⌨️ 4:07 | Configuración de Scrapy en Windows
⌨️ 9:49 | Análisis de Sitios Web
⌨️ 15:22 | Programación
Python es un lenguaje interpretado de alto nivel para programación de propósito general. Fue iniciado por Guido Van Rossum y lanzado por primera vez en 1991. Es un lenguaje de tipo pato, fácil de entender, y ahora muy popular tanto en el mundo académico como en el profesional.
Usando Python se puede escribir un script simple para el desarrollo de aplicaciones web. También en aprendizaje automático o en aprendizaje profundo, Python es muy popular ya que tiene algunas bibliotecas de código abierto sobresalientes.
Python 3 tiene un IDLE incorporado – Entorno de Desarrollo Interactivo instalado automáticamente. Si lo ejecutas, puedes ver la siguiente ventana. En la parte superior izquierda, puedes ver el número de versión instalada, aquí estamos viendo Python 3.7
El web scraping es una técnica para extraer datos de la página web utilizando un programa informático. Python es un lenguaje muy popular para web scraping. La biblioteca urllib incorporada de Python para conectar sitios web y recuperar datos y la biblioteca de terceros BeautifulSoup para analizar datos HTML son una combinación muy popular en el web scraping con Python.
A veces también queremos extraer información de alguna página web que está completamente cargada por el marco de JavaScript. En las técnicas normales de scraping, no es posible extraer datos ya que los datos se cargan de manera perezosa. Podemos resolver tanto la prueba de páginas web como el scraping de páginas web dinámicas ejecutando código JavaScript utilizando la biblioteca Selenium.
http://bit.ly/2PLLlud#python_web_scraping #python #scrapy