Datenstrom: Unterschied zwischen den Versionen

Aktuelle Version vom 18. Juni 2026, 09:49 Uhr

Datenstrom - kontinuierlicher Datenfluss dessen Ende meist nicht im Voraus abzusehen ist

Beschreibung

Mit Datenströmen (data streams) bezeichnet man in der Informatik einen kontinuierlichen Datenfluss von Datensätzen, dessen Ende meist nicht im Voraus abzusehen ist; die Datensätze werden fortlaufend verarbeitet, sobald jeweils ein neuer Datensatz eingetroffen ist.

Die einzelnen Datensätze sind dabei von beliebigem, aber festem Typ.
Die Menge der Datensätze pro Zeitspanne (Datenrate) kann variieren und evtl. so groß werden, dass die begrenzten Ressourcen zur Weiterverarbeitung nicht ausreichen und der Empfänger entsprechend reagieren muss (beispielsweise verwerfen von Datensätzen).
Im Gegensatz zu anderen Datenquellen können Datenströme nur Satz um Satz fortlaufend verarbeitet werden - insbesondere ist im Gegensatz zu Datenstrukturen mit wahlfreiem Zugriff (wie beispielsweise Arrays) meist nur ein sequentieller Zugriff auf die einzelnen Datensätze möglich.

Datenströme werden häufig zur Interprozesskommunikation verwendet (Kommunikation zwischen Prozessen auf einem Rechner) sowie zur Übertragung von Daten über Netzwerke, insbesondere für Streaming Media.

Sie sind im Rahmen des Programmierparadigmas Pipes und Filter vielseitig einsetzbar; in Unix-Shells ist dies ein gängiges Arbeitsmittel.
Beispiele für Datenströme sind Wetterdaten sowie Audio- und Videoströme (Streaming Media).
Die kontinuierliche Übertragung von Daten über ein Netzwerk wird auch als Streaming bezeichnet.

Abweichend von der Bedeutung im Zusammenhang mit dem "Streaming" wird der Ausdruck ‚Datenstrom‘ im Sprachgebrauch auch allgemeiner als "elektronisch kodierte Daten im Stadium der Übermittlung"^[1] verwendet; hierbei ist der Aspekt der fortlaufenden Verarbeitung unwichtig, dafür wird betont, dass die Übermittlung noch nicht abgeschlossen ist.

Beispiele dafür sind: Up-/Downloads; beim elektronischen Datenaustausch gesendete Daten; Datenbestände zum Import oder Export bei SAP.

Datenströme vs. statische Daten

Nicht strömende, das heißt statische Daten liegen in der Regel strukturiert abgespeichert vor, oft als Tupel von Werten in Relationen in einer Datenbank.

Sie sind begrenzt und nicht zeitlich geordnet.
Die Daten in Datenströmen besitzen dagegen eine geordnete zeitliche Reihenfolge und können praktisch unbegrenzt auftreten.
Während Daten in Relationen auch gezielt aktualisiert und gelöscht werden können, ist in Datenströmen nur das Einfügen von neuen Daten möglich, da nicht mit wahlfreiem Zugriff auf einzelne Elemente zugegriffen werden kann.
Es können allerdings mittels spezieller Datenstromalgorithmen einzelne Tupel eines Datenstroms, basierend auf ihren Eigenschaften, ausgewählt und ggf. zu einem neuen Datenstrom umgewandelt werden.

Das (umkehrbare) Umformen strukturierter Daten in eine datenstromartige Aneinanderreihung bezeichnet man auch als Serialisierung.

Geschichte

Das Konzept von Datenströmen in der Datenverarbeitung lässt sich unter anderem auf die von Douglas McIlroy vorgeschlagenen Pipes zur Verknüpfung von Makros zurückführen, die 1964 als "communication files" im Dartmouth Time-Sharing System implementiert waren und 1972 in das Betriebssystem Unix integriert wurden.

Dabei handelt es sich um eine Datenverbindung zwischen zwei Prozessen nach dem FIFO-Prinzip.
Inzwischen findet sich das Prinzip von Streams in den meisten modernen Programmiersprachen.

Verarbeitung

[[Datei:DSMS-Prinzip.svg|mini|400px|Verarbeitung von Datenströmen in einem DSMS

Die meisten Datenströme werden mittels speziell auf eine Anwendung zugeschnittener Programme verarbeitet.

Beispielsweise können Audio/Videoströme mit speziellen Wiedergabeprogrammen abgespielt werden.
Zur allgemeinen Verwaltung beliebiger Datenströme werden seit Anfang des 21. Jahrhunderts in der Informatik sogenannte Data Stream Management Systeme (DSMS) entwickelt.
Diese Systeme, die noch ein relativ neues Forschungsgebiet darstellen, sind vergleichbar mit herkömmlichen Datenbankverwaltungssystemen (DBMS) für statische Daten.
Ein Beispiel eines solchen DSMS ist der Stanford Stream Data Manager.
Als Anfragesprache wurde in Erweiterung zur SQL im Rahmen dieses Projekts die Continuous Query Language (CQL) entwickelt.

Typische Probleme bei der Verarbeitung von Datenströmen sind große Datenmengen in kurzer Zeit und die begrenzten Ressourcen, die zu ihrer Verarbeitung zur Verfügung stehen, da die eingehenden Daten nicht alle zwischengespeichert werden können und immer nur ein Ausschnitt der Daten bekannt ist.

Damit sind auch nur bestimmte Algorithmen möglich.
Auch die zur Auswertung zur Verfügung stehende Zeit ist oft beschränkt, da zeitkritische Anwendungen schnelle Ergebnisse erwarten.
Bei Systemen, die innerhalb einer garantierten Zeitspanne ein Ergebnis liefern, spricht man auch von Echtzeitsystemen.

Da die eingehenden Datenströme praktisch unbegrenzt sind, sind die daraus berechneten Ergebnisse einer Verarbeitung von Datenströmen oft selbst wiederum Datenströme.

Deshalb wird zwischen eingehenden Datenströmen (ingoing stream, instream oder downstream) und ausgehenden Datenströmen (outgoing stream, upstream) unterschieden.

Dateien

Anhang

Siehe auch

==

Sicherheit

Dokumentation

RFC

Man-Page
Info-Page

Links

Einzelnachweise

↑ Federal Standard 1037C data stream

Projekt

Weblinks

https://de.wikipedia.org/wiki/Datenstrom

Testfragen

Testfrage 1

Antwort1

Testfrage 2

Antwort2

Testfrage 3

Antwort3

Testfrage 4

Antwort4

Testfrage 5

Antwort5

]

[1] Federal Standard 1037C data stream

[1]

@@ Zeile 1: / Zeile 1: @@
-'''topic''' - Kurzbeschreibung
+'''Datenstrom''' - kontinuierlicher [[Datenfluss]] dessen Ende meist nicht im Voraus abzusehen ist
 == Beschreibung ==
 Mit '''Datenströmen''' ('''data streams''') bezeichnet man in der [[Informatik]] einen kontinuierlichen [[Datenfluss]] von [[Datensatz|Datensätzen]], dessen Ende meist nicht im Voraus abzusehen ist; die Datensätze werden fortlaufend verarbeitet, sobald jeweils ein neuer Datensatz eingetroffen ist.
 * Die einzelnen Datensätze sind dabei von beliebigem, aber festem [[Datentyp|Typ]].
-* Die Menge der Datensätze pro Zeitspanne ([[Datenrate]]) kann variieren und evtl. so groß werden, dass die begrenzten Ressourcen zur Weiterverarbeitung nicht ausreichen und der Empfänger entsprechend reagieren muss (z.&nbsp;B. verwerfen von Datensätzen).
+* Die Menge der Datensätze pro Zeitspanne ([[Datenrate]]) kann variieren und evtl. so groß werden, dass die begrenzten Ressourcen zur Weiterverarbeitung nicht ausreichen und der Empfänger entsprechend reagieren muss (beispielsweise verwerfen von Datensätzen).
-* Im Gegensatz zu anderen [[Datenquelle]]n können Datenströme nur Satz um Satz fortlaufend verarbeitet werden – insbesondere ist im Gegensatz zu [[Datenstruktur]]en mit [[Wahlfreier Zugriff|wahlfreiem Zugriff]] (wie z.&nbsp;B. [[Feld (Datentyp)|Arrays]]) meist nur ein [[sequentieller Zugriff]] auf die einzelnen Datensätze möglich.
+* Im Gegensatz zu anderen [[Datenquelle]]n können Datenströme nur Satz um Satz fortlaufend verarbeitet werden - insbesondere ist im Gegensatz zu [[Datenstruktur]]en mit [[Wahlfreier Zugriff|wahlfreiem Zugriff]] (wie beispielsweise [[Feld (Datentyp)|Arrays]]) meist nur ein [[sequentieller Zugriff]] auf die einzelnen Datensätze möglich.
 Datenströme werden häufig zur [[Interprozesskommunikation]] verwendet (Kommunikation zwischen [[Prozess (Informatik)|Prozessen]] auf einem [[Computer|Rechner]]) sowie zur Übertragung von Daten über [[Rechnernetz|Netzwerke]], insbesondere für [[Streaming Media]].
@@ Zeile 11: / Zeile 12: @@
 * Die kontinuierliche [[Datenübertragung|Übertragung von Daten]] über ein Netzwerk wird auch als Streaming bezeichnet.
-'''Abweichend''' von der Bedeutung im Zusammenhang mit dem „Streaming“ wird der Ausdruck ‚Datenstrom‘ im Sprachgebrauch auch allgemeiner als „elektronisch kodierte Daten im Stadium der Übermittlung“<ref>[http://www.its.bldrdoc.gov/fs-1037/dir-010/_1451.htm Federal Standard 1037C ''data stream'']</ref> verwendet; hierbei ist der Aspekt der fortlaufenden Verarbeitung unwichtig, dafür wird betont, dass die Übermittlung noch nicht abgeschlossen ist.
+'''Abweichend''' von der Bedeutung im Zusammenhang mit dem "Streaming" wird der Ausdruck ‚Datenstrom‘ im Sprachgebrauch auch allgemeiner als "elektronisch kodierte Daten im Stadium der Übermittlung"<ref>[https://www.its.bldrdoc.gov/fs-1037/dir-010/_1451.htm Federal Standard 1037C ''data stream'']</ref> verwendet; hierbei ist der Aspekt der fortlaufenden Verarbeitung unwichtig, dafür wird betont, dass die Übermittlung noch nicht abgeschlossen ist.
 * Beispiele dafür sind: Up-/Downloads; beim [[Elektronischer Datenaustausch|elektronischen Datenaustausch]] gesendete Daten; [[Datenbestand|Datenbestände]] zum Import oder Export bei [[SAP]].
@@ Zeile 23: / Zeile 24: @@
 == Geschichte ==
-Das Konzept von Datenströmen in der Datenverarbeitung lässt sich unter anderem auf die von [[Douglas McIlroy]] vorgeschlagenen [[Pipe (Informatik)|Pipes]] zur Verknüpfung von [[Makro]]s zurückführen, die 1964 als „communication files“ im [[Dartmouth Time-Sharing System]] implementiert waren und 1972 in das Betriebssystem [[Unix]] integriert wurden.
+Das Konzept von Datenströmen in der Datenverarbeitung lässt sich unter anderem auf die von [[Douglas McIlroy]] vorgeschlagenen [[Pipe (Informatik)|Pipes]] zur Verknüpfung von [[Makro]]s zurückführen, die 1964 als "communication files" im [[Dartmouth Time-Sharing System]] implementiert waren und 1972 in das Betriebssystem [[Unix]] integriert wurden.
-* Dabei handelt es sich um eine Datenverbindung zwischen zwei Prozessen nach dem [[First In – First Out|FIFO]]-Prinzip.
+* Dabei handelt es sich um eine Datenverbindung zwischen zwei Prozessen nach dem [[First In - First Out|FIFO]]-Prinzip.
 * Inzwischen findet sich das Prinzip von Streams in den meisten modernen [[Programmiersprache]]n.
 == Verarbeitung ==
-[[Datei:DSMS-Prinzip.svg|mini|400px|Verarbeitung von Datenströmen in einem [[Data Stream Management System|DSMS]]]]
+[[Datei:DSMS-Prinzip.svg|mini|400px|Verarbeitung von Datenströmen in einem [[Data Stream Management System|DSMS]]
 Die meisten Datenströme werden mittels speziell auf eine [[Anwendungssoftware|Anwendung]] zugeschnittener Programme verarbeitet.
@@ Zeile 45: / Zeile 46: @@
 * Deshalb wird zwischen eingehenden Datenströmen (''ingoing stream'', ''instream'' oder ''downstream'') und ausgehenden Datenströmen (''outgoing stream'', ''upstream'') unterschieden.
-== Siehe auch ==
+=== Dateien ===
+== Anhang ==
-=== Unterseiten ===
+=== Siehe auch ===
-{{Special:PrefixIndex/Datenstrom}}
+==
+{{Special:PrefixIndex/{{BASEPAGENAME}}/}}
-=== Sicherheit ===
+==== Sicherheit ====
 === Dokumentation ===
-==== RFC ====
+===== RFC =====
-==== Man-Pages ====
+; Man-Page
-==== Info-Pages ====
+;Info-Page
 === Links ===
-==== Einzelnachweise ====
+===== Einzelnachweise =====
 <references />
 ==== Projekt ====
@@ Zeile 64: / Zeile 65: @@
 <noinclude>
-== Testfragen ==
+=== Testfragen ===
 <div class="toccolours mw-collapsible mw-collapsed">
 ''Testfrage 1''
@@ Zeile 88: / Zeile 89: @@
 [[Kategorie:Streaming]]
 [[Kategorie:Datenübertragung]]
+[[Kategorie:Netzwerktopologie]]]
 </noinclude>

Dirkwagner (Diskussion | Beiträge)