"Scrapy est un outil polyvalent pour extraire des pages web avec Python. Grâce à son architecture de pipeline, il est facile d'ajouter de nouveaux consommateurs pour travailler sur les données extraites. Un de ces pipelines nous permet d'indexer les données extraites avec Elasticsearch. Avec Elasticsearch, nous pouvons rendre les données extraites consultables de manière très efficace. Dans cette présentation, nous allons non seulement vous montrer les bases de l'interaction entre Scrapy et Elasticsearch, mais aussi une démonstration pratique où nous utilisons ces outils pour collecter les résultats sportifs des événements de course en Suisse et répondre à des questions intéressantes liées à ces données."
Présentation enregistrée au Swiss Python Summit le 5 février 2016.
Licencié sous Creative Commons Attribution 4.0 International.