Descripción del curso
Para procesar Big Data necesita una aplicación centralizada que le permita enviar y luego almacenar datos en una base de datos relacional. En este curso de Sistemas y análisis de Big Data aprenderá los sistemas de almacenamiento diseñados para Big Data como Hadoop y su arquitectura, que incluye Hadoop Distributed File System, MapReduce y diferentes tipos de nodos disponibles.
El sistema de archivos distribuido de Hadoop proporciona confiabilidad, escalabilidad y disponibilidad. Con MapReduce, Hadoop ejecuta el trabajo utilizando los datos almacenados en el sistema de archivos distribuido y ayuda a los usuarios a realizar cálculos. Apache Pig está construido sobre algoritmos MapReduce. Ayuda a los usuarios a crear el programa de análisis de datos y analizar grandes conjuntos de datos. Este curso explicará el proceso para ejecutar análisis de Big Data en Hadoop.
Lo que aprenderás
- Identificar las funciones de los algoritmos MapReduce
- Explicar qué es el Hadoop Distributed File System (HDFS) y su relación con Big Data
- Enumerar los usos más comunes de Apache Pig
- Recordar los nodos en la arquitectura HDFS
- Explicar los pasos para crear archivos en HDFS
- Describir cómo ejecutar análisis de Big Data en Hadoop
Puntos clave
- El procesamiento de Big Data requiere una aplicación centralizada que te permita enviar y almacenar datos en una base de datos relacional.
- Hadoop es un sistema de almacenamiento diseñado para Big Data, con una arquitectura que incluye el Hadoop Distributed File System, MapReduce y diferentes tipos de nodos disponibles.
- El Hadoop Distributed File System proporciona confiabilidad, escalabilidad y disponibilidad.
- Con MapReduce, Hadoop ejecuta trabajos utilizando datos almacenados en el Distributed File System y ayuda a los usuarios a realizar cálculos.
- Apache Pig se construye sobre algoritmos MapReduce y ayuda a los usuarios a crear programas de análisis de datos y analizar grandes conjuntos de datos.
Preguntas frecuentes
¿Qué cubre este curso?
El curso cubre sistemas de almacenamiento diseñados para Big Data como Hadoop y su arquitectura, incluyendo el Hadoop Distributed File System, MapReduce y diferentes tipos de nodos disponibles, así como Apache Pig y el proceso de ejecutar análisis de Big Data en Hadoop.
¿Qué es el Hadoop Distributed File System y por qué importa para Big Data?
El Hadoop Distributed File System proporciona confiabilidad, escalabilidad y disponibilidad, y el curso explica qué es y su relación con Big Data.
¿Para qué se utiliza Apache Pig según este curso?
Apache Pig se construye sobre algoritmos MapReduce y ayuda a los usuarios a crear programas de análisis de datos y analizar grandes conjuntos de datos; el curso también enumera sus usos más comunes.
¿Qué habilidades ganaré de este curso?
Ganaras habilidades en Big Data, Big Data Analytics, Data Processing Systems, Database Systems, el Hadoop Distributed File System (HDFS) y Oracle Big Data.
¿Qué temas se enseñan en las lecciones?
Las lecciones incluyen Introducción a Hadoop, Arquitectura Hadoop, Cómo Ejecutar Análisis de Big Data en Hadoop y HDFS, y el Algoritmo MapReduce.










