In diesem Video zeigen wir, wie man komplexe Webseiten scrapen kann, einschließlich Seiten, die Hydration verwenden (d.h. ihre Daten im Browser mit JavaScript laden), in Python mit dem Playwright-Framework.
Damit können Sie Webseiten scrapen, die mit einfacheren Tools wie der Requests-Bibliothek nicht gescraped werden können.
Mit Playwright können Sie auch Screenshots erstellen, Webseiten scrapen, die eine Authentifizierung erfordern, und vieles mehr. Playwright ist eine moderne Alternative zu Selenium. Es ist vergleichbar mit Puppeteer, mit dem Unterschied, dass Playwright nicht nur JavaScript ist, sondern offizielle Python-Bindings bietet.
👍 Bitte liken Sie, wenn Sie dieses Video hilfreich fanden, und abonnieren Sie, um über meine neuesten Tutorials auf dem Laufenden zu bleiben. 🔔
🔖 Kapitel:
00:00 Einführung
02:17 Scraping mit Requests
05:16 Scraping mit Playwright
09:13 Tabelle in DataFrame umwandeln
10:46 Screenshot
12:12 Weitere Funktionen
🔗 Video-Links:
🐍 Mehr von Vincent Codes Finance:
#scraping #python #playwright #programmierung #code #nlp #opensource #pandas #puppeteer #selenium #bigdata #forschung #forschungstipps #vscode #professor #datenwissenschaft #datenanalyse #datenanalytik #webscraping