Extracción de datos utilizando Beautiful Soup La extracción de datos estructurados utilizando Beautiful Soup es un proceso fundamental en el web scraping. Beautiful Soup proporciona una forma sencilla y flexible de analizar y extraer datos de documentos HTML o XML. A continuación, se presenta un desarrollo del proceso de extracción…
Página de inicio
Herramientas y Librerías para Web Scraping
Herramientas y Librerías para Web Scraping a. Introducción a las librerías más utilizadas (Beautiful Soup, Scrapy, Selenium) Para relizar el web scraping se usan una serie de herramientas y librerías para extraer datos de sitios web de manera automatizada. Te indicamos algunas de las herramientas y librerías populares para…
Identificación de elementos en HTML
Identificación y selección de elementos en HTML (XPath, CSS selectors La identificación y selección de elementos en HTML es una parte fundamental del desarrollo web. Permite a los desarrolladores acceder y manipular elementos específicos en una página web. Dos métodos populares para identificar y seleccionar elementos en HTML son XPath…
Protocolo HTTP y solicitudes web
Protocolo HTTP y solicitudes web El Protocolo de Transferencia de Hipertexto (HTTP, por sus siglas en inglés) es un protocolo de comunicación utilizado en la web para el intercambio de datos entre clientes y servidores. HTTP define la forma en que los mensajes son estructurados y transmitidos, permitiendo que los…
Fundamentos del Web Scraping
Fundamentos del Web Scraping a. Arquitectura de la web y estructura HTML En este módulo, se profundizará en la arquitectura de la web y se proporcionará una comprensión sólida de la estructura HTML. Los participantes aprenderán cómo funciona la web en términos de la interacción entre el navegador y…