Schedule FrOSCon

Lecture

Schweine-Latein

Big Data Verarbeitung mit Apache Pig

August 25, 2012 – HS5 de Big Data

Mit Hilfe von Apache Pig lassen sich große Datenmengen analysieren. Ermöglicht wird dies durch eine einfache Skriptsprachen-Syntax welche Datenrelationen und deren Verarbeitung beschreiben kann. Pig-Skripte werden automatisch in eine Anzahl Mapper- und Reducer-Prozesse des Hadoop-Frameworks übersetzt und ausgeführt. Auf diese Weise erhält man ein einfaches Werkzeug um AdHoc-Abfragen auf große Datenbestände innerhalb einer Hadoop-Umgebung auszuführen. Der Vortrag soll eine Einführung in die unterschiedlichen Konstrukte von Pig Latin geben und die Erweiterbarkeit anhand konkreter Beispiele aufzeigen.