El web scraping es una herramienta muy poderosa que cualquier profesional de datos debería aprender. Con el web scraping, todo internet se convierte en tu base de datos. En este tutorial, te mostramos cómo analizar una página web en un archivo de datos (CSV) utilizando un paquete de Python llamado BeautifulSoup.
En este ejemplo, realizamos web scraping de tarjetas gráficas de NewEgg.com.
Código de Python:
Sublime:
Anaconda:
JavaScript beautifier:
Si no ves la línea de comandos, sigue este tutorial:
Tabla de Contenidos:
0:00 - Introducción
1:28 - Configurando Anaconda
3:00 - Instalando Beautiful Soup
3:43 - Configurando urllib
6:07 - Recuperando la Página Web
10:47 - Evaluando la Página Web
11:27 - Convirtiendo Listados en Ítems
16:13 - Usando jsbeautiful
16:31 - Leyendo HTML Crudo para Ítems a Scraper
18:34 - Construyendo el Scraper
22:11 - Usando la Función "findAll"
27:26 - Probando el Scraper
29:07 - Creando el Archivo .csv
32:18 - Resultado Final
--
En Data Science Dojo, creemos que la ciencia de datos es para todos. Nuestros entrenamientos en ciencia de datos han sido asistidos por más de 10,000 empleados de más de 2,500 empresas a nivel global, incluyendo muchos líderes en tecnología como Microsoft, Google y Facebook. Para más información, visita:
https://hubs.la/Q01Z-13k0💼 Aprende a construir aplicaciones impulsadas por LLM en solo 40 horas con nuestro bootcamp de Modelos de Lenguaje Grande:
https://hubs.la/Q01ZZGL-0--
¡Desata tu potencial en ciencia de datos GRATIS! Sumérgete en nuestros tutoriales, eventos y cursos hoy mismo.
📚 Aprende lo esencial de la ciencia de datos y análisis con nuestros tutoriales de ciencia de datos:
https://hubs.la/Q01ZZJJK0📚 Mantente a la vanguardia con el contenido más reciente en ciencia de datos, suscríbete a nuestro boletín ahora:
https://hubs.la/Q01ZZBy10 --
📱 Enlaces de redes sociales
--
Además, únete a nuestras comunidades:
_
¿Quieres compartir tu conocimiento en ciencia de datos? Mejora tu perfil y comparte tu conocimiento con nuestra comunidad:
https://hubs.la/Q01ZZNCn0#webscraping #python #beautifulsoup