"Scrapy es una herramienta versátil para extraer datos de páginas web con Python. Gracias a su arquitectura de pipeline, es fácil añadir nuevos consumidores para trabajar con los datos extraídos. Uno de estos pipelines nos permite indexar los datos extraídos con Elasticsearch. Con Elasticsearch, podemos hacer que los datos extraídos sean buscables de manera muy eficiente. En esta charla, no solo te mostraremos los conceptos básicos de la interacción entre Scrapy y Elasticsearch, sino también una demostración práctica donde utilizamos estas herramientas para recopilar resultados deportivos de eventos de carreras en Suiza y responder preguntas interesantes relacionadas con estos datos."
Charla grabada en el Swiss Python Summit el 5 de febrero de 2016.
Licenciado bajo Creative Commons Attribution 4.0 International.