Dans cette vidéo, nous allons approfondir le scraping en utilisant l'API d'ingénierie inversée
00:00:00 - Introduction
00:01:05 - Scénario de scraping (Étude de cas)
00:02:11 - Explication de la manière dont les données sont affichées sur un site web (Front-End et Back-End)
00:04:21 - La plus grande erreur en scraping
00:05:49 - Aperçu du code
00:06:15 - Éthique du scraping
00:06:45 - Trouver l'API cachée
00:08:57 - Récupération des données en utilisant la bibliothèque de requêtes de base
00:09:46 - Empreinte TLS
00:10:46 - Configuration des en-têtes de requête
00:12:41 - Traitement des données avec Pydantic
00:14:38 - Introduction à Camoufox
00:15:59 - Création d'un scraper synchrone
00:22:27 - Explication : Sync vs Async
00:23:57 - I/O Bound vs CPU Bound
00:25:06 - Optimisation du scraper en utilisant le traitement asynchrone et parallèle
00:28:26 - Conclusion
#scraping #python #data