Definition

Was ist Big Data?

| Autor / Redakteur: Michael Radtke / Nico Litzel

(Bild: © aga7ta - stock.adobe.com)

Der im Internet und in den Unternehmen verfügbare Datenberg – diese Tatsache wird als Big Data umschrieben – wird immer größer, unübersichtlicher und lässt sich nur schwer verarbeiten. Immer technologisch anspruchsvollere Tools und Programme sollen die Datenflut zähmen.

Der Begriff Big Data stammt aus dem englischen Sprachraum. Erst als Phänomen oder als Hype wahrgenommen, fassen die Experten mittlerweile unter diesem Begriff zwei Aspekte zusammen. Demnach umschreibt er zum einen die immer rasanter wachsenden Datenmengen; zum anderen aber geht es auch um neue und explizit leistungsstarke IT-Lösungen und Systeme, mit denen Unternehmen die Informationsflut vorteilhaft verarbeiten können – Stichwort Machine Learning. Insbesondere unstrukturierte Daten – zum Beispiel aus den sozialen Netzwerken – machen dabei einen nicht unerheblichen Teil der Massendaten aus. Mit dem Grid Computing steht diesbezüglich jetzt eine spezielle Form des verteilten Rechnens zur Verfügung, womit eine rechen- und datenintensive Datenverarbeitung ermöglicht wird.

Eine neue Ära digitaler Kommunikation

In Deutschland wird die Wortschöpfung Big Data oft als Sammelbegriff für die moderne digitale Technologie verwendet. Aber nicht nur die digitalen Datenmengen an sich stehen im Fokus. Vielmehr nimmt Big Data und die damit einhergehende Digitalisierung auch nachhaltig Einfluss auf die Sammlung, Nutzung, Verwertung, Vermarktung und vor allem Analyse der digitalen Daten. Inzwischen steht dieser Name diesbezüglich für eine vollkommen neue Ära digitaler Kommunikation und entsprechender Verarbeitungspraktiken. In sozialer Hinsicht wird dieser Umstand sogar für einen grundlegenden gesellschaftlichen Wandel – respektive Umbruch – verantwortlich gemacht.

Wettbewerbsvorteile mit Big Data Analytics generieren

Diese Entwicklung hat aber gerade Auswirkungen auf die Unternehmenslandschaft. Die Firmen erhalten nämlich durch die großen Mengen an Daten, die zur Verfügung stehen, ganz neue Einblicke in die Interessen, das Kaufverhalten und auch das Risikopotenzial von Kunden sowie von potenziellen

Interessenten. Damit die Information auch entsprechend gefiltert, untersucht, beurteilt und entsprechend eingeordnet werden können, greifen Unternehmen gezielt zu Analytics-Methoden. Hinter dem Begriff Analytics verbergen sich dabei explizite Maßnahmen, um in dem Datenbergen unbekannte Korrelationen, versteckte Muster und andere nützliche Informationen zu identifizieren. Diese Erkenntnisse können dann für Wettbewerbsvorteile gegenüber Konkurrenten sorgen oder auch anderweitige geschäftliche Vorteile – wie etwa ein effektiveres Marketing oder auch Umsatzsteigerungen – bringen.

Software Tools für eine fortschrittliche Analytik

Die Unternehmen verfolgen mit der komplexen Datenanalyse dabei in erster Linie das Ziel, bessere Entscheidungsgrundlagen für die eigene Geschäftstätigkeit zu schaffen. Um dieses Hauptziel zu realisieren, wertet ein Data Scientist – die Experten für Big Data – die riesigen Mengen an entsprechenden Transaktionsdaten sowie zusätzlich an anderweitigen Informationen aus den unterschiedlichsten Datenquellen aus.

Zu diesen Quellen zählen zum Beispiel Internet-Clickstreams, Protokolle von Webservern, Einzelverbindungsnachweise für Mobiltelefone, Informationen von Sensoren oder vor allem auch Berichte über Social-Media-Aktivitäten der User. Für die Verarbeitung und Analyse dieser Massendaten greifen Unternehmen auf Software Tools zurück, die sowohl Big als auch Small Data Analytics umfassend ermöglichen.

Quelloffene Software Frameworks

In den vergangenen Jahren ist eine ganz neue Klasse von extrem leistungsstarken Technologien und Programmen entstanden. Dabei rücken gerade quelloffene Software Frameworks wie Apache Hadoop, Spark, NoSQL-Datenbanken sowie zum Beispiel Map Reduce in den Fokus. Gerade Spark und vor allem Hadoop erfreuen sich dabei einer ungemein großen Beliebtheit. Hadoop basiert auf dem von Google generierten MapReduce-Algorithmus in Kombination mit Vorschlägen des Google-Dateisystems. Anwender können mit diesem Programm große Datenmengen im Rahmen intensiver Rechenprozesse auf so bezeichneten Computerclustern verarbeiten; dieser Vorgang wird auch als Cluster Computing bezeichnet. Die Entwicklung in diesem Bereich wird stetig durch Software-Unternehmen vorangetrieben, etwa von den Anbietern Cloudera oder Hortonworks.

Big Table, Graphdatenbanken und Distributed File Systems

Immer mehr an Bedeutung gewinnt dabei zum Beispiel Big Table, das von Google entwickelte Hochleistungs-Datenbanksystem. Auch das einfach strukturierte, verteilte Datenbankverwaltungssystem Cassandra rückt als explizite Lösung für sehr große strukturierte Datenbanken verstärkt in den Vordergrund. Dabei ist Cassandra insbesondere auf Ausfallsicherheit und eine hohe Skalierbarkeit ausgelegt.

Eine weitere Lösungsalternative stellen zum Beispiel Graphdatenbanken dar. Hierbei werden stark vernetzte Informationen als Graphen dargestellt, wobei die spezialisierten Graphalgorithmen komplexe bzw. komplizierte Datenbankanfragen erheblich vereinfachen. Zudem ist es ratsam, ein verteiltes Dateisystem – ein Distributed File System – zu nutzen. Ein solches Netzwerk-Dateisystem optimiert die Zugriffs- und Speicherungsmöglichkeiten deutlich.

Optimierte Speichertechnik

Neben moderner und hoch funktioneller Software spielt auch die Hardware – explizit die Speichertechnologie – bei Big Data eine entscheidende Rolle. Mittlerweile macht es die Speichertechnologie möglich, Datenvolumen im Rahmen des sogenannten In-Memory Computing direkt im Hauptspeicher eines Rechners zu halten. Früher mussten diese Daten gewöhnlich auf langsamere Speichermedien wie Festplatten oder Datenbanken ausgelagert werden. Dank In-Memory Computing wird jetzt die Rechengeschwindigkeit deutlich erhöht und die Echtzeitanalyse umfangreicher Datenbestände ermöglicht.

Was ist Big Data? Analytics, Definition, Bedeutung & Beispiele

Logistiksoftware

Was ist Big Data? Analytics, Definition, Bedeutung & Beispiele

16.01.19 - An Big Data führt kein Weg mehr vorbei. Trotzdem sehen viele Betriebe das Thema noch skeptisch. Hier erfahren Sie, was Big Data bedeutet, welche konkreten Anwendungsszenarien es gibt und welche Trends Experten Big-Data-Technologien prognostizieren – Praxisbeispiele inklusive! lesen

Kommentare werden geladen....

Kommentar zu diesem Artikel abgeben

Der Kommentar wird durch einen Redakteur geprüft und in Kürze freigeschaltet.

Anonym mitdiskutieren oder einloggen Anmelden

Avatar
Zur Wahrung unserer Interessen speichern wir zusätzlich zu den o.g. Informationen die IP-Adresse. Dies dient ausschließlich dem Zweck, dass Sie als Urheber des Kommentars identifiziert werden können. Rechtliche Grundlage ist die Wahrung berechtigter Interessen gem. Art 6 Abs 1 lit. f) DSGVO.
  1. Avatar
    Avatar
    Bearbeitet von am
    Bearbeitet von am
    1. Avatar
      Avatar
      Bearbeitet von am
      Bearbeitet von am

Kommentare werden geladen....

Kommentar melden

Melden Sie diesen Kommentar, wenn dieser nicht den Richtlinien entspricht.

Kommentar Freigeben

Der untenstehende Text wird an den Kommentator gesendet, falls dieser eine Email-hinterlegt hat.

Freigabe entfernen

Der untenstehende Text wird an den Kommentator gesendet, falls dieser eine Email-hinterlegt hat.

Aktuelle Beiträge zu diesem Thema

Wie Big Data Navigationssysteme verändert

Moderne Verkehrsinformationen

Wie Big Data Navigationssysteme verändert

Der Navigationsspezialist Infoware wagt einen Ausblick in die Zukunft der Routenführer. Speziell die große und weiter zunehmende Menge an verfügbaren Daten wird die Qualität der Systeme stetig verbessern. lesen

Universelle Analytik für alle Daten in Echtzeit

Nachbericht Splunk .conf19 Las Vegas

Universelle Analytik für alle Daten in Echtzeit

Splunk, ein Spezialist für IT-Betriebs-Analytik und Security, hat in Las Vegas auf seiner zehnten Anwenderkonferenz .conf19 vor rund 11.000 Besuchern eine Reihe von neuen und aktualisierten Analytik- und KI-Werkzeugen vorgestellt: „Data to everything“. Neben neuen Angeboten für IT-, AI- und DevOps stieß vor allem die Erweiterung des Preismodells auf großes Interesse. lesen

Die größten Herausforderungen beim Outsourcen von Big-Data-Projekten

Kommentar von Dr. Robert Grünwald, Novustat

Die größten Herausforderungen beim Outsourcen von Big-Data-Projekten

Die Notwendigkeit von Data Science für Unternehmen ist unumstritten. Gleichwohl können Auswertungen oft nicht vom Anwender durchgeführt werden: Sei es aufgrund fehlender zeitlicher oder personeller Ressourcen, ungenügender Ausstattung oder dem Fehlen tiefergreifender Kenntnisse von Data Analytics. Viele Anwender suchen daher professionelle Unterstützung bei einer Data-Science-Beratung lesen

Die besten Big-Data-Consulting-Anbieter 2019

Big Data Consulting

Die besten Big-Data-Consulting-Anbieter 2019

Die riesigen Datenmengen in Unternehmen bieten unzählige Möglichkeiten, wertvolle Erkenntnisse und fundierte Geschäftsentscheidungen zu treffen. Um dieses Potenzial zu nutzen, ist allerdings umfangreiches Fachwissen notwendig. Viele Unternehmen können das entsprechende Know-how nicht mit vorhandenem Personal abdecken. Ein externer Partner kann helfen. lesen

Altmaier startet Projekt zu einer europäischen Cloud

Digitalgipfel 2019

Altmaier startet Projekt zu einer europäischen Cloud

Auf dem Digitalgipfel mehren sich die Anzeichen, dass das Thema digitale Infrastruktur in der Politik angekommen ist. So hat der Staatssekretär im Bundesinnenministerium in seinem Einführungsvortrag eine föderale Cloud für Deutschland gefordert. Und Bundeswirtschaftsminister Peter Altmaier hat auf dem Gipfel das GAIA-X Papier über eine europäische Dateninfrastruktur vorgestellt. lesen

Künstliche Intelligenz oder emotionale Intelligenz ist hier die Frage

Führen im KI-Zeitalter

Künstliche Intelligenz oder emotionale Intelligenz ist hier die Frage

Eine neue Studie von Oracle und Future Workplace zeigt, dass KI-basierte Geschäftsanwendungen einen beträchtlichen Einfluss auf das Verhältnis zwischen Mensch und Technik im Job haben. So vertrauen 64 Prozent der Beschäftigten mittlerweile einer KI-Entscheidung mehr als ihrem Chef. Doch ist das wirklich berechtigt? lesen

So gelingt der Start in die KI ohne zusätzliche Ausgaben

[Gesponsert]

Maschinelles Lernen auf bestehenden Infrastrukturen

So gelingt der Start in die KI ohne zusätzliche Ausgaben

IT-Manager benötigen keine neue Infrastruktur, um das volle Potential der KI auszuschöpfen. Sie können ohne zusätzliche Ausgaben sinnvolle Szenarien aufbauen und testen, gewinnbringend nutzen und bei Bedarf unkompliziert skalieren. lesen

So gelingt eine DSGVO-konforme Data Analytics

Kommentar von Sebastian Weyer, Statice

So gelingt eine DSGVO-konforme Data Analytics

Die Datenschutzgrundverordnung stellt viele Unternehmen vor die Herausforderung, den Spagat zwischen Datenschutz und der Notwendigkeit, Daten-getriebene Innovationen auf den Weg zu bringen, zu meistern. Wie vertragen sich Datenschutz und Datennutzung in einem auf Fortschritt bedachten Unternehmen? lesen

KI – vom ersten Projekt zum datengetriebenen Unternehmen

Kommentar von Dr. Nicolai Erbs und Julian Kling, Infomotion

KI – vom ersten Projekt zum datengetriebenen Unternehmen

Wenn Mitarbeiter heute nach den Trends mit dem größten Einfluss auf ihr Unternehmen gefragt werden, fallen häufig die Begriffe Digitalisierung und Künstliche Intelligenz (KI). Insbesondere zum Einsatz letzterer wird in vielen Fällen jedoch Bedenken geäußert. Diesen gegenüber stehen die Chancen, auch komplexe Prozesse durch KI automatisieren und neue Services anbieten zu können. lesen

copyright

Dieser Beitrag ist urheberrechtlich geschützt. Sie wollen ihn für Ihre Zwecke verwenden? Kontaktieren Sie uns über: support.vogel.de/ (ID: 44399329 / Definitionen)