Descripción del curso
Una realidad de la mayoría de los proyectos de visualización de datos es que generalmente se enfrentará a la tarea de obtener o crear algunos de los datos que necesita. En estas lecciones nos centramos en dos de las técnicas automatizadas más comunes para obtener datos y haremos hincapié en cómo siempre puede teclear los datos que necesita. Aprenderá que un sitio web es todo HTML, con muchas etiquetas que se pueden usar para identificar y obtener datos. En nuestro ejemplo, usaremos la biblioteca Beautiful Soup para interrogar a un sitio web en busca de una palabra clave y luego extraer todos los enlaces web asociados con esa palabra clave, haciendo que los enlaces estén disponibles mediante programación.
A continuación, utilizaremos una API RESTful para obtener datos de un enfoque cada vez más común para el intercambio de datos. Representational State Transfer (transferencia de estado representacional) o REST, es una interfaz de programa de aplicación que viaja por Internet y permite el acceso programático a un repositorio de información. También exploraremos varias APIs y extraeremos datos en un modelo que podamos trazar. Finalmente, combinaremos varias de las mejores prácticas en un solo ejercicio y exploraremos los datos de un marco de datos Pandas con longitud, latitud y magnitud de eventos que podemos trazar en un mapa del mundo.
Lo que aprenderás
- Obtener datos mediante scraping de datos de sitios web usando etiquetas HTML
- Usar la biblioteca Beautiful Soup y la biblioteca requests para encontrar una palabra clave y extraer enlaces web asociados de forma programática
- Obtener datos a través de APIs RESTful para acceder a un repositorio de información por Internet
- Extraer datos de varias API en un modelo que pueda graficar
- Graficar datos de longitud, latitud y magnitud de un marco de datos Pandas en un mapa mundial
- Reconocer datos geocéntricos
Puntos clave
- La mayoría de los proyectos de visualización de datos requieren obtener o crear algunos de los datos usted mismo, y los datos siempre se pueden ingresar manualmente cuando sea necesario.
- Un sitio web es todo HTML, con muchas etiquetas que se pueden usar para identificar y obtener datos.
- Beautiful Soup puede interrogar un sitio web para encontrar una palabra clave y hacer que los enlaces web asociados estén disponibles de forma programática.
- REST (Transferencia de Estado Representacional) es una interfaz de programa de aplicación que funciona en Internet y permite el acceso programático a un repositorio de información.
- Los datos de un marco de datos Pandas que contiene longitud, latitud y magnitud de eventos pueden graficarse en un mapa mundial.
Preguntas frecuentes
¿Qué técnicas de recopilación de datos cubre este curso?
Se enfoca en dos técnicas automatizadas comunes para obtener datos: scraping de datos de sitios web usando la biblioteca Beautiful Soup y obtención de datos a través de APIs RESTful. También enfatiza que siempre puede ingresar manualmente los datos que necesita.
¿Con qué bibliotecas y herramientas voy a trabajar?
Utilizará la biblioteca Beautiful Soup y la biblioteca requests para hacer scraping de sitios web, APIs RESTful para obtener datos y un marco de datos Pandas para graficar datos en un mapa mundial.
¿Qué podré hacer al final del curso?
Podrá obtener datos mediante scraping y mediante APIs RESTful, entender Beautiful Soup y la biblioteca requests, reconocer datos geocéntricos y graficar longitud, latitud y magnitud de eventos en un mapa mundial.
¿Qué lecciones se incluyen en este curso?
El curso incluye tres lecciones: Scraping de Datos Usando la Web, Scraping de Datos Usando una API y Graficación de Datos en Mapas Geográficos.
¿Qué habilidades ayuda a desarrollar este curso?
Desarrolla habilidades en mapeo de datos, visualización de datos, mapas de datos, visualización de información, visualización científica y visualización.









