En este video te enseñaré cómo iniciar sesión en tu cuenta segura y extraer datos de esa cuenta.
WebScraping parece muy fácil si estás extrayendo datos de páginas estáticas y sin contraseña. Pero en caso de que el propietario del sitio web no quiera que alguien robe sus datos, comienza el verdadero desafío.
Para la página de inicio de sesión se utiliza el método POST, en el que todos los datos van dentro del cuerpo y ya han sido probados para bloquear bots, así que actúa como un humano mientras raspas datos.
Facebook y algunos sitios web importantes utilizan contraseñas encriptadas. Así que para ellos no podemos eludir la página de inicio de sesión proporcionando correo electrónico y contraseña. Pero para la mayoría de los sitios web que son manejados por desarrolladores comunes, podemos obtener datos. Lo haremos utilizando la biblioteca Requests.
¿Qué es Requests?
Requests es Http para humanos, es una biblioteca desarrollada por Keneth Reitz. Él resuelve casi todos los problemas que un desarrollador puede enfrentar al manejar http. Afortunadamente, está escrita en Python, así que podemos usarla fácilmente.
Una de las cosas hermosas de Python que lo hace mejor que otros lenguajes comunes es que tiene una comunidad muy grande. Es rica en bibliotecas. Puedes encontrar todo tipo de bibliotecas en ella. Solo tienes que importarla y comenzar a trabajar. ¡Disfruta tu viaje hacia el éxito y nunca pienses en rendirte!
#XProgrammer
#LearnCodeBuildFuture