Data & IT
Pocket
Untersuchung der Migration einer MySQL basierten Monitoring & Data-Warehouse Loesung nach Hadoop
Jonas Kress
1159:-
Uppskattad leveranstid 3-8 arbetsdagar
Fri frakt för medlemmar vid köp för minst 249:-
Masterarbeit aus dem Jahr 2012 im Fachbereich Informatik - Angewandte Informatik, Note: 1.0, Hochschule für Technik und Wirtschaft Berlin, Sprache: Deutsch, Abstract: Die escape GmbH betreibt ein MySQL basiertes Dataware-House in das Daten ausverschiedenen Webpräsenzen fließen, um dort ausgewertet zu werden. Nach Jahren deserfolgreichen Betriebs nimmt mit der ständig steigenden Menge an gespeicherten Datendie Leistung des Systems allerdings ab. Die Laufzeiten für Auswertungen steigen unddie Agilität sinkt. Kleine Optimierungen und Veränderungen des Systems können dasUnbrauchbarwerden hinauszögern, als aber aus Gründen der Leistung auf einen Teilder Abfragen verzichtet werden muss, wird schließlich klar, dass nur eine grundlegendeVeränderung des Systems den langfristigen Betrieb sicherstellen kann. Aus diesem Grundwurde nach Technologien gesucht, deren Fähigkeiten die Leistung des bestehendenDataware-Houses verbessern können. Dies führte zu Hadoop [Fouc][Whi10a], einem OpenSource Framework, welches die Verarbeitung von riesigen Datenmengen in einem Clustererlaubt.Diese Arbeit untersucht, wie Komponenten des bisherigen Systems durch Dienste vonHadoop ersetzt werden können. Sie wertet die Möglichkeiten zur Strukturierung vonDaten in einer spaltenbasierten Datenbank aus, evaluiert in einem Benchmark, wie sichdie Zeit von Abfragen im Verhältnis zu einer stetig steigenden Datenmenge verhält undanalysiert detailliert den Ressourcenverbrauch des Clusters und dessen Knoten.Die Implementierung zeigt, dass sich die spaltenbasierten Datenbank HBase sehr gutzum Speichern von einer sehr großen Menge an semistrukturierten Daten eignet und dieDataware-House Komponente Hive durch die Unterstützung eines SQL ähnlichen Syntaxdas Erstellen von Abfragen komfortabel ermöglicht. Die Literatur beschreibt, dass HBaseautomatisch linear mit dem Hinzufügen von neuen Knoten skaliert. Der durchgeführteBenchmark zeigt, dass
- Format: Pocket/Paperback
- ISBN: 9783656440475
- Språk: Tyska
- Antal sidor: 106
- Utgivningsdatum: 2013-07-25
- Förlag: Grin Verlag