Neste tutorial, aprenderemos o que são Cookies e Sessões, sua importância no scraping e maneiras de usá-los com a biblioteca requests do Python.
Um cookie HTTP é um tipo especial de cabeçalho de requisição que representa um pequeno pedaço de dados enviado de um site e armazenado no computador do usuário. Ele é diferente de outros cabeçalhos, pois não somos nós que o escolhemos – é o site que nos diz como configurar esse campo. Então, o cookie pode ser enviado junto com requisições subsequentes do cliente.
Os cookies foram projetados para serem um mecanismo confiável para que os sites lembrem informações com estado, como itens adicionados ao carrinho de compras em uma loja online, ou para registrar a atividade de navegação do usuário.
Eles também podem ser usados para lembrar pedaços arbitrários de informações que o usuário inseriu anteriormente em campos de formulários, como nomes, endereços, senhas e números de cartões de crédito.
Cada vez que o navegador da web do usuário interage com um servidor web, ele passará as informações do cookie para o servidor web. Apenas os cookies armazenados pelo navegador que se relacionam ao domínio na URL solicitada serão enviados ao servidor.