En este video, veremos cómo puedes extraer datos de páginas web complejas, incluyendo páginas que utilizan hidratación (es decir, cargan sus datos en el navegador usando JavaScript), en Python utilizando el framework Playwright.
Esto te permite raspar sitios web que no pueden ser extraídos usando herramientas más simples como la biblioteca requests.
Usando Playwright, también puedes tomar capturas de pantalla, raspar sitios web que requieren autenticación, y mucho más. Playwright es una alternativa moderna a Selenium. Es comparable a Puppeteer, con la diferencia de que Playwright no es solo para JavaScript, proporciona enlaces oficiales para Python.
👍 Por favor, dale like si encontraste útil este video, y suscríbete para mantenerte actualizado con mis últimos tutoriales. 🔔
🔖 Capítulos:
00:00 Introducción
02:17 Extracción Usando Requests
05:16 Extracción Usando Playwright
09:13 Convirtiendo Tabla a DataFrame
10:46 Captura de Pantalla
12:12 Otras Características
🔗 Enlaces del video:
🐍 Más de Vincent Codes Finance:
#scraping #python #playwright #programación #código #nlp #opensource #pandas #puppeteer #selenium #bigdata #investigación #consejosdeinvestigación #vscode #profesor #cienciadedatos #analíticadedatos #análisisdedatos #webscraping