À l'ère numérique, toutes les données ont de la valeur. En pleine pandémie mondiale, les scientifiques, chercheurs et organisations rassemblent d'énormes ensembles de données pour aider à lutter contre la propagation du COVID19.
Mais avec si peu de données fournies par la recherche organisationnelle, il n'y a pas de plus grand coffre-fort pour les big data que l'internet. Mon atelier couvrira les fondamentaux du web scraping, de la recherche de motifs dans la sélection des balises HTML, à la nettoyage et l'exportation de vos données.
Merci pour cette incroyable présentation Wyatt 🥳 Nous serions ravis de vous accueillir à nouveau pour une autre ❗
Liens :
Horodatages :
0:37 - Début
1:27 - Qui suis-je ?
2:30 - Extraction des données
4:30 - Récupération des données sur internet
5:32 - Scraping de l'internet
6:12 - Code en direct (Colab)
39:20 - Web scraping avancé
43:03 - Remerciements et conclusion
43:50 - Questions du discord