Web Scraping ist ein sehr mächtiges Werkzeug, das jeder Datenprofi lernen sollte. Mit Web Scraping wird das gesamte Internet zu deiner Datenbank. In diesem Tutorial zeigen wir dir, wie du eine Webseite in eine Datendatei (CSV) mit einem Python-Paket namens BeautifulSoup parsen kannst.
In diesem Beispiel scrapen wir Grafikkarten von NewEgg.com.
Python-Code:
Sublime:
Anaconda:
JavaScript Beautifier:
Wenn du die Eingabeaufforderung nicht siehst, folge diesem Tutorial:
Inhaltsverzeichnis:
0:00 - Einführung
1:28 - Anaconda einrichten
3:00 - Beautiful Soup installieren
3:43 - urllib einrichten
6:07 - Webseite abrufen
10:47 - Webseite bewerten
11:27 - Listings in Einzelposten umwandeln
16:13 - jsbeautiful verwenden
16:31 - Roh-HTML für zu scrapende Elemente lesen
18:34 - Den Scraper erstellen
22:11 - Die "findAll"-Funktion verwenden
27:26 - Den Scraper testen
29:07 - Die .csv-Datei erstellen
32:18 - Endergebnis
--
Bei Data Science Dojo glauben wir, dass Data Science für alle da ist. Unsere Data Science Schulungen wurden von mehr als 10.000 Mitarbeitern aus über 2.500 Unternehmen weltweit besucht, darunter viele führende Unternehmen in der Technologie wie Microsoft, Google und Facebook. Für weitere Informationen besuche bitte:
https://hubs.la/Q01Z-13k0💼 Lerne, LLM-gestützte Apps in nur 40 Stunden mit unserem Bootcamp für große Sprachmodelle zu erstellen:
https://hubs.la/Q01ZZGL-0--
Entfalte dein Data Science Potenzial kostenlos! Tauche heute in unsere Tutorials, Veranstaltungen und Kurse ein!
📚 Bleibe am Puls der Zeit mit den neuesten Inhalten zur Data Science, abonniere jetzt unseren Newsletter:
https://hubs.la/Q01ZZBy10 --
📱 Social Media Links
--
Tritt auch unseren Communities bei:
_
Möchtest du dein Wissen über Data Science teilen? Steigere dein Profil und teile dein Wissen mit unserer Community:
https://hubs.la/Q01ZZNCn0#webscraping #python #beautifulsoup