- Big Data: Datensätze, die so groß oder komplex sind, dass sie die Kapazitäten herkömmlicher Management- und Analysetools übersteigen.
- Die vier Vs – Volumen, Vielfalt, Geschwindigkeit und Verlässlichkeit – beschreiben die Größe, die Art, die Änderungsrate und die Zuverlässigkeit der Daten.
- Dazu gehören strukturierte Daten (numerische Datenbanken) und unstrukturierte Daten (Web, E-Mails, soziale Netzwerke), wodurch sich die Datenquellen und die Komplexität der Analyse erweitern.
- Anwendungsgebiete: Gesundheitswesen, Serviceverbesserung, öffentliche Sicherheit und Geschäftsoptimierung; die Cloud ermöglicht im Vergleich zu traditionellen RDBMS Speicherung und Skalierbarkeit.
„Big Data“ ist ein weit gefasster Begriff für Datensätze, die so groß oder komplex sind, dass herkömmliche Datenverarbeitungsanwendungen nicht ausreichen. Big Data kann jede Art von Informationen umfassen, sowohl strukturierte als auch unstrukturierte.
Beispiele und Definition von Big Data
Große Datensätze
„Big Data“ ist ein weit gefasster Begriff für Datensätze, die so groß oder komplex sind, dass herkömmliche Datenverarbeitungsanwendungen nicht ausreichen. Der Umfang von Big Data kann beliebig groß sein, vom Terabyte bis zum Petabyte (1 Billion Byte) und darüber hinaus. Im Allgemeinen umfasst der Umfang von Big Data sowohl strukturierte als auch unstrukturierte Arten von Informationen.
Big Data bezeichnet die enormen Informationsmengen, die durch das Internet, soziale Medien und andere Quellen generiert werden . Big Data umfasst Datensätze, deren Größe die Kapazität herkömmlicher Datenbankmanagementsysteme (RDBMS) zur effektiven Erfassung, Speicherung, Verwaltung und Analyse übersteigt.
Schätzungsweise 98 % aller Daten weltweit wurden allein in den letzten zwei Jahren erstellt.
Die Datenmenge wächst exponentiell. Schätzungen zufolge wurden 98 % aller Daten weltweit allein in den letzten zwei Jahren erstellt. Und wenn Sie sich fragen, was mit den restlichen 2 % passiert ist: Nun, das wissen wir auch nicht.
Wie können wir mit diesem exponentiellen Wachstum umgehen? Nun, wir brauchen ein neues Datenspeichermodell , das es uns ermöglicht, all unsere Informationen zu speichern und dann später zu entscheiden , was wir damit anfangen (oder auch nicht).
Aus diesem Grund nutzen die meisten Organisationen Cloud-Speicherdienste wie Amazon Web Services (AWS), Google Cloud Platform (GCP) oder Microsoft Azure, anstatt ihre eigene Infrastruktur von Grund auf neu aufzubauen oder traditionelle relationale Datenbanken wie Oracle DBMS oder Microsoft SQL Server DBMS zu verwenden, für die jedes Jahr teure Lizenzen bezahlt werden müssen, nur um all diese Gigabytes und Gigabytes an digitalen Assets speichern zu können.
Die vier Vs von Big Data
Die vier Vs von Big Data sind Volumen, Vielfalt, Geschwindigkeit und Richtigkeit.
Das Datenvolumen bezeichnet die Größe der von Ihrem Unternehmen verarbeiteten Daten. Die Datenvielfalt umfasst alle Datentypen: strukturierte Daten (wie Tabellenkalkulationen) und unstrukturierte Daten (wie Bilder). Die Änderungsgeschwindigkeit beschreibt, wie schnell sich die Informationen im Laufe der Zeit ändern: Ändern sich beispielsweise die Umsatzzahlen eines Online-Shops stündlich, benötigen Sie ein System, das diese Änderungen schnell genug verarbeiten kann, damit sie die Geschäftsentscheidungen nicht wesentlich beeinträchtigen.
Schließlich ist da noch die Wahrhaftigkeit, also die Genauigkeit: Inwieweit sind die Informationen zuverlässig? Stammen die Informationen aus einer externen Quelle, etwa aus sozialen Netzwerken wie Twitter oder Facebook, wo jeder jederzeit und ohne vorherige Überprüfung alles posten kann, sind sie möglicherweise nicht so zuverlässig.
Strukturierte und unstrukturierte Daten.
Big Data kann jede Art von Informationen umfassen, sowohl strukturierte als auch unstrukturierte.
Beispiele für strukturierte Daten: Sozialversicherungsnummern, Kreditkartennummern und Telefonnummern.
Beispiele für unstrukturierte Daten: Webseiten, E-Mails, Tweets und andere Social-Media-Inhalte.
Mithilfe von Big-Data-Technologien lässt sich das menschliche Genom analysieren und genetische Marker für Krankheiten finden.
Big-Data-Technologien ermöglichen die Analyse des menschlichen Genoms und die Identifizierung genetischer Marker für Krankheiten. Die DNA-Sequenzierung ist ein Beispiel für eine solche Technologie, die seit ihren Anfängen Anfang der 2000er-Jahre in der medizinischen Forschung Anwendung findet. Durch die Identifizierung einzelner Gene und ihrer Varianten können Forscher genetische Faktoren aufspüren, die zu Krankheiten wie Krebs oder Diabetes beitragen.
Bei genomweiten Assoziationsstudien (GWAS) kommt eine Technik namens Microarrays zum Einsatz, mit der Wissenschaftler Tausende von Proben gleichzeitig analysieren und nach bestimmten Mustern in den Genexpressionsniveaus suchen können. Dieses Verfahren ermöglicht es ihnen, genetische Varianten zu identifizieren, die mit Krankheiten wie Alzheimer oder Schizophrenie in Verbindung stehen. Die meisten GWAS-Ergebnisse bleiben jedoch vor allem deshalb nicht schlüssig, weil sie auf kleinen Stichproben basieren (in vielen Fällen weniger als 100 Personen).
Da immer mehr Menschen an solchen Studien teilnehmen und insbesondere wenn diese Teilnehmer zusätzlichen Tests zustimmen, können wir mit höheren Genauigkeitsraten und einem besseren Verständnis der Wechselwirkung bestimmter Umweltfaktoren mit unseren Genen in Entwicklungsstadien später im Leben rechnen.
Einsatzmöglichkeiten für Big Data
Heutzutage gibt es viele Einsatzmöglichkeiten für Big Data, die unsere Lebens- und Arbeitsweise verändern.
Big Data kann zur Verbesserung des Gesundheitswesens, des Kundenservice und des Bildungswesens eingesetzt werden . Es kann auch Behörden für öffentliche Sicherheit dabei helfen, ihre Gemeinden besser zu schützen, und Unternehmen können durch die Nutzung von Big Data zur Verbesserung von Geschäftsprozessen neue Möglichkeiten erschließen.
Gesundheitswesen : Ärzte und Pflegekräfte nutzen Patientenakten für Behandlungsentscheidungen. Angesichts der Fülle an Informationen zu jedem Patienten ist es jedoch schwierig, die benötigten Daten schnell und einfach zu finden. Mithilfe von Big-Data-Analysetools erhalten Ärzte Zugriff auf ein breiteres Spektrum an Informationen zur Krankengeschichte ihrer Patienten als je zuvor. Dazu gehören auch Informationen über Nebenwirkungen von Medikamenten oder mögliche Wechselwirkungen mit anderen Medikamenten (z. B. Blutdrucksenker). Dies kann Leben retten, da Ärzte aufgrund ihrer Erfahrung sofort wissen, welche Behandlungen am besten wirken, anstatt Zeit mit dem Ausprobieren verschiedener Kombinationen zu verschwenden.
Big Data hat heute viele Einsatzmöglichkeiten, die Ihnen vielleicht nicht bewusst sind.
Big Data wird auf vielfältige Weise zur Analyse menschlichen Verhaltens eingesetzt. Damit lässt sich analysieren, wie Menschen ihre Mobilgeräte verwenden, wie sie miteinander interagieren und sogar wie sie ihr Geld ausgeben.
Hier einige Beispiele für Big Data-Anwendungen:
- Analysieren Sie soziale Medien, um herauszufinden, was in der Welt um Sie herum passiert, ohne dass Sie sich dessen bewusst sind (beispielsweise Trends in Mode oder Technologie).
- Durch den Einsatz von Sensoren und Kameras in Städten wird der Verkehr überwacht, sodass Regierungen öffentliche Arbeiten besser planen oder den öffentlichen Nahverkehr verbessern können.
Fazit
Der Begriff „Big Data“ beschreibt die riesigen Datenmengen, die wir in unserem täglichen Leben sammeln, analysieren und nutzen können. Diese Informationen können für viele verschiedene Zwecke verwendet werden, etwa zum Auffinden genetischer Marker für Krankheiten oder zum Analysieren des menschlichen Genoms, um seine Funktionsweise besser zu verstehen. Es ist wichtig, sich daran zu erinnern, dass diese Technologie auch negative Folgen hat, wie etwa Bedenken hinsichtlich der Privatsphäre der Personen, die Zugriff auf Ihre persönlichen Daten haben.