In diesem Tutorial lernen wir, was Cookies und Sessions sind, ihre Bedeutung beim Scraping und wie man sie mit der Python-Request-Bibliothek verwendet.
Ein HTTP-Cookie ist eine spezielle Art von Anfrage-Header, der ein kleines Stück Daten darstellt, das von einer Website gesendet und auf dem Computer des Benutzers gespeichert wird. Es unterscheidet sich von anderen Headern, da wir es nicht selbst auswählen – die Website gibt vor, wie dieses Feld gesetzt werden soll. Dann kann das Cookie zusammen mit nachfolgenden Client-Anfragen gesendet werden.
Cookies wurden entwickelt, um einen zuverlässigen Mechanismus für Websites bereitzustellen, um zustandsbezogene Informationen zu speichern, wie z.B. Artikel, die in den Warenkorb eines Online-Shops gelegt wurden, oder um die Browsing-Aktivitäten des Benutzers aufzuzeichnen.
Sie können auch verwendet werden, um beliebige Informationen zu speichern, die der Benutzer zuvor in Formularfelder eingegeben hat, wie z.B. Namen, Adressen, Passwörter und Kreditkartennummern.
Jedes Mal, wenn der Webbrowser des Benutzers mit einem Webserver interagiert, überträgt er die Cookie-Informationen an den Webserver. Nur die Cookies, die vom Browser gespeichert wurden und die sich auf die Domain der angeforderten URL beziehen, werden an den Server gesendet.