Apprenez à faire du web scraping avec Python en utilisant la bibliothèque Beautiful Soup 4.
Bonjour ! Je m'appelle Anna, je suis analyste de données. Dans cette vidéo, je montre comment extraire des données d'un site web en utilisant Python. Dans ce tutoriel, je collecte des données du site Zappos.
Pour extraire des données d'un marketplace, j'utilise les bibliothèques Beautiful Soup et Requests, ainsi que le module d'expressions régulières. Je recueille la description de chaque article, le nom, la couleur et le prix. En résultat, nous obtenons un DataFrame prêt pour l'analyse des données.
Mon script :
Si vous êtes intéressé par l'analyse de données ou les sujets de science des données, veuillez vous abonner à ma chaîne.
Veuillez écrire vos questions ou sujets pour les prochaines vidéos dans les commentaires.
Codes temporels :
00:00 - Bonjour
00:20 - Qu'est-ce que le web scraping
00:31 - Pourquoi le web scraping est important
01:08 - Tâches pour le web scraping
01:33 - Début (importer les bibliothèques)
02:20 - Données de chaque page
03:19 - utilisation de Requests
03:46 - Sauvegarder le HTML
06:05 - find_all
06:34 - obtenir le lien à partir de la balise
07:39 - obtenir le texte à partir de la balise
08:34 - RegEx
10:15 - code final
11:01 - DataFrame
11:49 - Merci
Chansons créditées :
#dataanalyst #webscraping #datascience