NLP (Processamento de Linguagem Natural) e Modelagem de Tópicos são subdomínios de Aprendizado de Máquina que são tecnologias essenciais para cientistas de dados em Python; e a coleta automatizada de dados por meio de Scraping (de forma ética e em conformidade com os TOS) é uma prática raramente discutida.