Zusammenfassung

  • Datenintegrität bedeutet, dass Daten während ihres gesamten Lebenszyklus korrekt, konsistent, vollständig und zuverlässig bleiben.
  • Sie umfasst zwei Hauptaspekte: die physische Integrität, die Daten vor Hardwareausfällen, Unfällen und Angriffen schützt, und die logische Integrität, die die Korrektheit der Daten bei der Verwendung gewährleistet.
  • Die logische Integrität umfasst die Entitätsintegrität, die referenzielle Integrität, die Domänenintegrität und die Nutzer Integrität.
  • Die Datenintegrität ist sowohl für die Einhaltung gesetzlicher Vorschriften als auch für die vertrauenswürdige Nutzung von Daten im Alltag von entscheidender Bedeutung.
  • Datensicherheit schützt Daten vor unbefugtem Zugriff, während Datenintegrität gewährleistet, dass die Daten selbst korrekt und zuverlässig bleiben.

Da wir uns heute in einer Welt befinden, in der Daten das wertvollste Kapital Ihres Unternehmens sind, sind Qualität, Sicherheit und Integrität Ihrer Daten von entscheidender Bedeutung. Um dies zu gewährleisten, müssen Sie deren Integrität jederzeit sicherstellen. Möchten Sie die grundlegenden Regeln der Datenintegrität verstehen, um Ihr Unternehmen auf den Weg zu einer reibungslosen und zuverlässigen Datennutzung zu bringen? Dann folgen Sie diesem Leitfaden.

Der Begriff der Integrität wird zwar häufig erwähnt, wenn es um Sicherheit und Datenkompromittierung geht, sollte aber nicht mit der Datenintegrität verwechselt werden, die in der komplexen und anspruchsvollen Welt der Datenverwertung eine eigene Disziplin darstellt.

Die genaue Definition von Datenintegrität lautet: die Aufrechterhaltung und Gewährleistung der Richtigkeit und Beständigkeit der Daten während ihres gesamten Lebenszyklus.

Die Gewährleistung der Datenintegrität bedeutet, sicherzustellen, dass die in einer Datenbank gespeicherten Informationen vollständig, korrekt und zuverlässig bleiben. Und zwar unabhängig davon, wie lange sie gespeichert werden, wie oft auf sie zugegriffen wird oder wie sie verarbeitet werden.

Die verschiedenen Arten der Datenintegrität

Das Konzept der Datenintegrität ist komplex, da es vielfältige Formen und Bedeutungen annimmt. Über einen allgemeinen Ansatz zur Datenintegrität hinaus ist es wichtig zu verstehen, dass es verschiedene Arten von Datenintegrität gibt. Diese verschiedenen Arten stehen nicht im Widerspruch zueinander, sondern ergänzen und verbinden sich miteinander, um die Qualität und Sicherheit Ihrer Datenbestände zu gewährleisten.

Die Gewährleistung der Datenintegrität in all ihren Dimensionen ist nicht nur eine Frage der Einhaltung von Vorschriften, sondern auch der optimalen Nutzung der verfügbaren Informationen. Es gibt zwei Hauptarten der Datenintegrität: zum einen die physische Integrität und zum anderen die logische Integrität.

Physische Integrität

Der Schutz der physischen Integrität von Daten bedeutet, dass sie nicht durch menschlichen Fehlern und Hardwareausfällen (wie z. B. Fehlfunktionen von Speicherservern).

Es muss auch sichergestellt werden, dass die Daten nicht beispielsweise von Systemprogrammierern verfälscht werden können. Ebenso wird die physische Integrität der Daten in Frage gestellt, wenn ein Stromausfall oder ein Brand eine Datenbank beeinträchtigt.

Schließlich ist auch die physische Integrität gefährdet, wenn es einem Hacker gelingt, auf die Daten zuzugreifen.

Logische Integrität

Die Sicherstellung der logischen Integrität Ihrer Daten bedeutet, dass die Daten unter allen Umständen unverändert bleiben. Während die logische Integrität wie die physische Integrität dazu dient, Daten vor menschlicher Manipulation und Fehlern zu schützen, wird sie auf eine andere Art und Weise und auf vier verschiedenen Achsen ausgeübt:

Integrität der Entität

Entitätsintegrität ist das Prinzip der Primärschlüssel mit den gesammelten Daten zu verknüpfen. Diese eindeutigen Werte identifizieren alle Ihre Datenelemente. Dies ist eine wirksame Garantie gegen Duplikate, weil zum Beispiel jedes Datenelement nur einmal aufgeführt wird.

Referentielle Integrität

Das Prinzip der referentiellen Integrität beschreibt eine Reihe von Prozessen, die sicherstellen, dass Daten auf einheitliche und konsistente Weise gespeichert und verwendet werden. Der Lager ist die beste Garantie dafür, dass nur angemessene und autorisierte Datenänderungen, Ergänzungen oder Löschungen vorgenommen werden. Referentielle Integrität ermöglicht es Ihnen Regeln zu definieren um doppelte Einträge zu beseitigen oder die Richtigkeit der eingegebenen Daten in Echtzeit zu überprüfen.

Integrität des Bereichs

Domänenintegrität bezieht sich auf eine Reihe von Prozessen, die die Genauigkeit der Daten sicherstellen die einer Domäne zugeordnet sind. Ein Bereich ist durch eine Reihe von Werten gekennzeichnet, die als akzeptabel gelten und die eine Spalte enthalten kann. Sie kann verschiedene Regeln enthalten, die entweder das Format oder den Typ der Daten oder die Menge der Informationen, die eingegeben werden können, festlegen.

Nutzer Integrität

Nutzer-definierte Integrität umfasst Regeln, die von den Nutzer , um ihren Anforderungen hinsichtlich der jeweiligen Nutzung gerecht zu werden. Durch die Ergänzung von Maßnahmen zur Datenintegrität um eine Reihe spezifischer Geschäftsregeln lässt sich die Verwaltung der Entitätsintegrität, der referenziellen Integrität und der Domänenintegrität vervollständigen.

Warum ist es wichtig, die Datenintegrität zu gewährleisten?

Die Datenintegrität ist aus zwei Gründen wichtig:

Der erste betrifft die Datenkonformität. Da die Datenschutz-Grundverordnung strenge Regeln aufstellt und schwere Strafen vorsieht, ist die Gewährleistung der Datenintegrität zu jeder Zeit ein wichtiges Thema.

Der zweite Punkt betrifft die Verwendung Ihrer Daten. Wenn die Integrität gewahrt bleibt, haben Sie die Gewissheit, dass die verfügbaren Informationen zuverlässig und qualitativ hochwertig sind und vor allem der Realität entsprechen.

So gewährleisten Sie die Datenintegrität

Gewährleistung der Datenintegrität erfordert mehr als nur den Schutz einer Datenbank vor unbefugten Änderungen. Unternehmen benötigen Kontrollmechanismen, die dazu beitragen, dass Informationen beim Austausch zwischen Anwendungen, Pipelines, Datenbanken und Analysesystemen korrekt, vollständig, konsistent und zuverlässig bleiben.

Beginnen Sie mit klaren Validierungsregeln. Pflichtfelder, zulässige Formate, Wertebereiche und Beziehungsregeln können von vornherein verhindern, dass fehlerhafte Daten in die Systeme gelangen. Datenbankbeschränkungen wie Primärschlüssel, Fremdschlüssel und eindeutige Werte bieten eine weitere Schutzebene, indem sie die Beziehungen zwischen den Datensätzen festlegen.

Zugriffskontrollen sind ebenso wichtig. Indem eingeschränkt wird, wer vertrauliche Informationen anlegen, ändern oder löschen darf, wird das Risiko versehentlicher oder unbefugter Änderungen verringert. Unternehmen sollten zudem ein Protokoll der Änderungen ( Protokolle ) führen, damit die Teams nachvollziehen können, wann sich Informationen geändert haben, wer die Änderung vorgenommen hat und welches System oder welcher Prozess dafür verantwortlich war.

Eine automatisierte Überwachung der Datenqualität kann dabei helfen, Probleme aufzudecken, die bei herkömmlichen Datenbankkontrollen möglicherweise unentdeckt bleiben. Veränderungen bei den Nullwerten, der Aufzeichnung en Datenmengen, der Verteilung, der Aktualität oder dem Schema können darauf hindeuten, dass weiter oben in der Kette etwas schiefgelaufen ist. Die frühzeitige Erkennung dieser Veränderungen trägt dazu bei, zu verhindern, dass unzuverlässige Informationen in Berichte, Anwendungen oder KI-Systeme gelangen.

Schließlich benötigen Teams einen Überblick darüber, wie Daten fließen. Anhand der Datenherkunft lässt sich nachvollziehen, woher Informationen stammen, wie sie transformiert wurden und welche nachgelagerten Systeme davon abhängig sind. Wenn ein Problem auftritt, erleichtert dieser Kontext die Identifizierung der Ursache und das Verständnis der potenziellen geschäftlichen Auswirkungen.

Datenintegrität vs. Datenqualität

Datenintegrität und Datenqualität hängen eng miteinander zusammen, sind jedoch nicht identisch.

Bei der Datenintegrität geht es darum, ob Informationen während ihres gesamten Lebenszyklus korrekt, konsistent und vertrauenswürdig bleiben. Dazu gehören die Regeln und Kontrollmechanismen, die dafür sorgen, dass Beziehungen, Formate und Datensätze nicht beschädigt werden oder inkonsistent werden.

Bei der Datenqualität geht es im weiteren Sinne darum, ob Informationen für den vorgesehenen Verwendungszweck geeignet sind. Zu den gängigen Aspekten der Datenqualität zählen Richtigkeit, Vollständigkeit, Beständigkeit, Aktualität, Gültigkeit und Eindeutigkeit.

Beispielsweise könnte eine Kunden Aufzeichnung , die Datenbankintegritätsregeln erfüllen, da sie einen gültigen Primärschlüssel enthält und dem vorgeschriebenen Format entspricht. Ist die Adresse jedoch bereits fünf Jahre alt, kann die Qualität der Informationen dennoch mangelhaft sein.

Unternehmen benötigen beides. Integrität schafft die strukturellen und operativen Kontrollmechanismen, die Informationen schützen, während die Datenqualität dazu beiträgt, festzustellen, ob diese Informationen für Analysen, den operativen Betrieb, die aufsichtsrechtliche Berichterstattung und KI geeignet sind.

Die Unterschiede zwischen Datenintegrität und Datensicherheit

Datensicherheit ist ein Fachgebiet, das alle Maßnahmen umfasst, die zur Verhinderung von Datenbeschädigungen ergriffen werden. Sie basiert auf dem Einsatz von Systemen, Prozessen und Verfahren, die den unbefugten Zugriff auf Ihre Daten einschränken.

Die Datenintegrität hingegen umfasst alle Techniken und Lösungen, die die Wahrung der Integrität und Genauigkeit der Informationen während ihres gesamten Lebenszyklus gewährleisten.

Mit anderen Worten: Die Datensicherheit ist einer der Faktoren, die zur Datenintegrität beitragen.