Dans cette vidéo, je traite de la manière de scraper des sites web nécessitant une authentification. Nous gérons les cookies, les sessions, les tokens CSRF et les flux de connexion en plusieurs étapes.
Sujets abordés :
- Pourquoi certaines données nécessitent une authentification pour y accéder
- Gestion des sessions avec Python requests
- Gestion des cookies et des tokens CSRF
- Flux de connexion en plusieurs étapes et soumissions de formulaires
- Utilisation de l'automatisation du navigateur pour des pages de connexion complexes
- Maintien des sessions à travers plusieurs requêtes
- Considérations sur les proxies pour le scraping authentifié