Kursbeschreibung
Um Big Data zu verarbeiten, benötigen Sie eine zentralisierte Anwendung, die es Ihnen ermöglicht, Daten zu übermitteln und dann in einer relationalen Datenbank zu speichern. In diesem Kurs über Big-Data-Systeme und -Analytik lernen Sie Speichersysteme für Big Data wie Hadoop und seine Architektur kennen, die das Hadoop Distributed File System, MapReduce und verschiedene Arten von verfügbaren Knoten umfasst.
Das verteilte Dateisystem von Hadoop bietet Zuverlässigkeit, Skalierbarkeit und Verfügbarkeit. Mit MapReduce führt Hadoop den Auftrag unter Verwendung der im Distributed File System gespeicherten Daten aus und unterstützt die Benutzer bei der Durchführung von Berechnungen. Apache Pig baut auf den MapReduce-Algorithmen auf. Es hilft den Benutzern bei der Erstellung von Datenanalyseprogrammen und der Analyse großer Datenmengen. In diesem Kurs wird erklärt, wie man Big Data-Analytik auf Hadoop ausführt.
Was Sie lernen werden
- Identifizieren Sie die Funktionen von MapReduce-Algorithmen
- Erklären Sie, was das Hadoop Distributed File System (HDFS) ist und seine Beziehung zu Big Data
- Führen Sie die häufigsten Verwendungen von Apache Pig auf
- Erinnern Sie sich an die Knoten in der HDFS-Architektur
- Erklären Sie die Schritte zum Erstellen von Dateien in HDFS
- Beschreiben Sie, wie Big Data-Analysen auf Hadoop durchgeführt werden
Wichtige Erkenntnisse
- Die Verarbeitung von Big Data erfordert eine zentralisierte Anwendung, mit der Sie Daten in eine relationale Datenbank einreichen und speichern können.
- Hadoop ist ein für Big Data konzipiertes Speichersystem mit einer Architektur, die das Hadoop Distributed File System, MapReduce und verschiedene Arten von verfügbaren Knoten umfasst.
- Das Hadoop Distributed File System bietet Zuverlässigkeit, Skalierbarkeit und Verfügbarkeit.
- Mit MapReduce führt Hadoop Jobs mit den im Distributed File System gespeicherten Daten aus und hilft Benutzern, Berechnungen durchzuführen.
- Apache Pig wird auf MapReduce-Algorithmen aufgebaut und hilft Benutzern, Datenanalyseprogramme zu erstellen und große Datensätze zu analysieren.
Häufig gestellte Fragen
Was behandelt dieser Kurs?
Der Kurs behandelt Speichersysteme für Big Data wie Hadoop und seine Architektur, einschließlich des Hadoop Distributed File System, MapReduce und verschiedener Arten von verfügbaren Knoten, sowie Apache Pig und den Prozess der Durchführung von Big Data-Analysen auf Hadoop.
Was ist das Hadoop Distributed File System und warum ist es für Big Data wichtig?
Das Hadoop Distributed File System bietet Zuverlässigkeit, Skalierbarkeit und Verfügbarkeit, und der Kurs erklärt, was es ist und seine Beziehung zu Big Data.
Wofür wird Apache Pig nach diesem Kurs verwendet?
Apache Pig wird auf MapReduce-Algorithmen aufgebaut und hilft Benutzern, Datenanalyseprogramme zu erstellen und große Datensätze zu analysieren; der Kurs führt auch seine häufigsten Verwendungen auf.
Welche Fähigkeiten werde ich aus diesem Kurs gewinnen?
Sie werden Fähigkeiten in Big Data, Big Data Analytics, Data Processing Systems, Database Systems, dem Hadoop Distributed File System (HDFS) und Oracle Big Data gewinnen.
Welche Themen werden in den Lektionen unterrichtet?
Die Lektionen umfassen Einführung in Hadoop, Hadoop-Architektur, Durchführung von Big Data-Analysen auf Hadoop und HDFS sowie den MapReduce-Algorithmus.










