Para satisfazer a necessidade de dados em IA generativa e tradicional, em um ambiente em rápida evolução, a capacidade de extrair dados da web de forma eficiente tornou-se indispensável para empresas e desenvolvedores. Esta apresentação explora a metodologia e as ferramentas de web crawling e web scraping, com uma visão geral do lado ético e legal do processo, incluindo as melhores práticas sobre como rastrear de forma educada e eficiente e usar os dados sem violar leis de privacidade ou propriedade intelectual.
www.pydata.org
PyData é um programa educacional da NumFOCUS, uma organização sem fins lucrativos 501(c)3 nos Estados Unidos. PyData fornece um fórum para a comunidade internacional de usuários e desenvolvedores de ferramentas de análise de dados para compartilhar ideias e aprender uns com os outros. A rede global PyData promove a discussão de melhores práticas, novas abordagens e tecnologias emergentes para gerenciamento, processamento, análise e visualização de dados. As comunidades PyData abordam a ciência de dados usando várias linguagens, incluindo (mas não se limitando a) Python, Julia e R.
As conferências PyData visam ser acessíveis e orientadas pela comunidade, com apresentações de nível iniciante a avançado. Os tutoriais e palestras do PyData trazem aos participantes os recursos mais recentes dos projetos, juntamente com casos de uso inovadores.
00:00 Bem-vindo!
00:10 Ajude-nos a adicionar marcas de tempo ou legendas a este vídeo! Veja a descrição para detalhes.