Datenintegration bezeichnet Prozesse, Werkzeuge und Konzepte zum Zusammenführen heterogener Datenquellen in konsistente, nutzbare Datensichten. Sie umfasst Extraktion, Transformation, Harmonisierung und Konsolidierung für Analyse, Betriebsprozesse und Entscheidungsunterstützung. Implementierungsstrategien variieren je nach Architektur, Governance und Perform…
Nutze diesen Steckbrief, um den Baustein kurz zu verstehen, ihn im Modell einzuordnen und bei Bedarf in die 360°-Bewertung zu wechseln.
Theoretisches Gebilde: erklärt einen Begriff, ein Prinzip oder ein Denkmodell.
Was du verstehen musst, um ein Themenfeld sinnvoll zu denken.
Datenintegration führt heterogene Quellen zu einer gemeinsamen, verlässlichen Datensicht zusammen, damit Analyse- und Betriebsprozesse auf konsistente Informationen zugreifen.
Datenintegration entstand aus dem praktischen Problem, Informationen aus getrennten Datenbanken, Dateien und später Web- und Betriebsquellen gemeinsam nutzbar zu machen. Seit den frühen 1980er Jahren wurden dafür Interoperabilität und gemeinsame Zugriffsschichten entwickelt; 1991 zeigte IPUMS mit ETL und einem einheitlichen Sichtschema, wie sich große heterogene Bestände zusammenführen lassen. Das W3C bündelt heute Best Practices für Webdaten, die auffindbar, verständlich und wiederverwendbar sein sollen.
Stell dir Datenintegration als Schicht zwischen Quelle und Nutzung vor. Unten liefern Fachsysteme, Sensoren oder APIs Daten in eigenen Formaten und Bedeutungen. Die Integrationsschicht ordnet Felder per Mapping zu, wandelt Werte um, prüft Qualität und löst Bedeutungsunterschiede. Oben entsteht entweder ein physisch konsolidierter Bestand, etwa ein Warehouse oder Hub, oder eine virtuelle Sicht, die mehrere Quellen zur Anfragezeit verbindet.
Die verbundenen Systeme unterscheiden sich in Struktur, Format, Aktualität und fachlicher Bedeutung.
Felder, Codes und Entitäten werden systematisch zwischen Quellschema und Zielsicht abgebildet.
Unterschiedliche Formate, Einheiten und Begriffe werden auf eine gemeinsame Bedeutung gebracht.
Daten werden physisch in einem gemeinsamen Bestand zusammengeführt und dort verwaltet.
Gleiche Begriffe können in verschiedenen Quellen Unterschiedliches bedeuten und müssen aufgelöst werden.
Virtuelle Integration verbindet Quellen zur Anfragezeit; physische Integration lädt Daten vorab in einen Zielbestand.
Datenintegration ist wichtig, wenn Fachbereiche dieselben Kennzahlen aus mehreren Systemen brauchen, wenn Silo-Daten zusammengeführt werden sollen oder wenn operative Prozesse auf Stamm- und Fremddaten zugreifen müssen. Sie hilft in ERP-, Plattform- und Sensorumgebungen, verlangt aber laufende Pflege für Mappings, Datenqualität und Governance. Physische Integration verbessert oft Stabilität und Abfrageleistung; virtuelle Integration vermeidet zusätzliche Kopien, kann aber von erreichbaren Quellsystemen und höherer Laufzeitkomplexität abhängen.
Wo dieser Baustein im Themenmodell verortet ist.
Keine Strukturpfade verfügbar.
Erkunde, wie dieser Wissensbaustein mit Konzepten, Methoden, Technologien und Tools verbunden ist.
Diese Quellen belegen den Begriff und seine fachliche Bedeutung.
Alle direkten Verbindungen des aktuellen Wissensbausteins in einer kompakten, textuellen Darstellung.
Diese Einordnung zeigt, in welchem Kontext der Baustein typischerweise relevant wird, wie anspruchsvoll er ist und welche Wirkung er im Modell hat.
Die Ebene innerhalb der Organisation (Unternehmen, Domäne, Team), auf der der AssetBlock angewendet wird.