Web scraping é uma ferramenta muito poderosa para qualquer profissional de dados. Com web scraping, toda a internet se torna seu banco de dados. Neste tutorial, mostramos como analisar uma página da web em um arquivo de dados (CSV) usando um pacote Python chamado BeautifulSoup.
Neste exemplo, fazemos web scraping de placas gráficas do NewEgg.com.
Código Python:
Sublime:
Anaconda:
JavaScript beautifier:
Se você não está vendo o prompt de comando, siga este tutorial:
Tabela de Conteúdos:
0:00 - Introdução
1:28 - Configurando o Anaconda
3:00 - Instalando o Beautiful Soup
3:43 - Configurando o urllib
6:07 - Recuperando a Página da Web
10:47 - Avaliando a Página da Web
11:27 - Convertendo Listagens em Itens
16:13 - Usando jsbeautiful
16:31 - Lendo HTML Bruto para Itens a Serem Scrapeados
18:34 - Construindo o Scraper
22:11 - Usando a Função "findAll"
27:26 - Testando o Scraper
29:07 - Criando o Arquivo .csv
32:18 - Resultado Final
--
Na Data Science Dojo, acreditamos que a ciência de dados é para todos. Nossos treinamentos em ciência de dados foram frequentados por mais de 10.000 funcionários de mais de 2.500 empresas globalmente, incluindo muitos líderes em tecnologia como Microsoft, Google e Facebook. Para mais informações, visite:
https://hubs.la/Q01Z-13k0💼 Aprenda a construir aplicativos com LLM em apenas 40 horas com nosso bootcamp de Modelos de Linguagem Grande:
https://hubs.la/Q01ZZGL-0--
Liberte seu potencial em ciência de dados GRÁTIS! Mergulhe em nossos tutoriais, eventos e cursos hoje!
📚 Mantenha-se à frente com o conteúdo mais recente em ciência de dados, inscreva-se em nossa newsletter agora:
https://hubs.la/Q01ZZBy10--
📱 Links de redes sociais
--
Além disso, junte-se às nossas comunidades:
_
Quer compartilhar seu conhecimento em ciência de dados? Aumente seu perfil e compartilhe seu conhecimento com nossa comunidade:
https://hubs.la/Q01ZZNCn0#webscraping #python #beautifulsoup