Dans cette vidéo, nous allons voir comment vous pouvez extraire des données de pages web complexes, y compris celles qui utilisent l'hydratation (c'est-à-dire qui chargent leurs données dans le navigateur à l'aide de JavaScript), en Python en utilisant le framework Playwright.
Cela vous permet d'extraire des données de sites web qui ne peuvent pas être scrappés avec des outils plus simples comme la bibliothèque requests.
Avec Playwright, vous pouvez également prendre des captures d'écran, extraire des sites web nécessitant une authentification, et bien plus encore. Playwright est une alternative moderne à Selenium. Il est comparable à Puppeteer, avec la différence que Playwright n'est pas uniquement JavaScript, il fournit des liaisons officielles pour Python.
👍 Merci de liker si vous avez trouvé cette vidéo utile, et abonnez-vous pour rester informé de mes derniers tutoriels. 🔔
🔖 Chapitres :
00:00 Intro
02:17 Extraction avec Requests
05:16 Extraction avec Playwright
09:13 Conversion de Table en DataFrame
10:46 Capture d'écran
12:12 Autres Fonctionnalités
🔗 Liens vidéo :
🐍 Plus de Vincent Codes Finance :
#scraping #python #playwright #programmation #code #nlp #opensource #pandas #puppeteer #selenium #bigdata #recherche #conseilsderecherche #vscode #professeur #datascience #dataanalytics #dataanalysis #webscraping