Data & More ist eine mandantenfähige DSGVO- und Data-Governance-Plattform. Sie verbindet sich mit den E-Mail-, Dateispeicher- und Chat-Systemen einer Organisation, liest alle gefundenen Inhalte, klassifiziert jedes Dokument hinsichtlich personenbezogener und sensibler Daten und unterstützt die verantwortliche Person dabei, entsprechende Maßnahmen zu ergreifen. Diese Seite ist die Karte: was die Plattform leistet, wie die Komponenten zusammenwirken und wo Sie die Details nachlesen können.
Was Sie nicht zuerst gelesen, klassifiziert und verstanden haben, können Sie nicht verwalten.
~42Microservices
2Kernsprachen: Python, Java
7Pipeline-Stufen, von der Quelle bis zum Bericht
1Gemeinsamer Datenspeicher: Elasticsearch
Abschnitt 01Funktionsweise
Klassifizieren, Prüfen, Löschen –kontinuierlich aktiv
Die Plattform läuft kontinuierlich und nicht in einem festen vierteljährlichen Rhythmus. Der Prozess trägt einen Namen,Klassifizieren, Prüfen, Löschen: Die Plattform klassifiziert, was im Archiv vorhanden ist, die verantwortliche Person prüft die Ergebnisse an ihrem eigenen Standort, und das Resultat ist eine Löschung (oder Archivierung, Bearbeitung bzw. Einschränkung), die im Quellsystem durchgeführt wird. Quellen und Ausnahmen sind die einmalige Konfiguration, die den Kreislauf speist.
Klassifizieren – Aufgabe der PlattformPrüfen – Aufgabe der verantwortlichen PersonLöschen – das kontinuierliche Ziel
Woher die Daten stammen
Verbundene Quellen
Jede Quelle ist über einen der Ingestion-Konnektoren der Plattform angebunden. Der Zyklus beginnt hier und schreibt die Ergebnisse ebenfalls hierher zurück.
Eine Löschung erfolgt niemals automatisch. Die verantwortliche Person prüft jeden Befund lokal und wählt eine von drei Maßnahmen, die im Prüfprotokoll festgehalten wird.
Einschränken– der Datensatz verbleibt an seinem Ort, wird jedoch für eingeschränkten Zugriff markiert.
Archivieren (Aufbewahrung)– der Datensatz wird in ein Archiv mit einer definierten Aufbewahrungsregel verschoben.
Löschen– der Datensatz wird dauerhaft aus dem Quellsystem entfernt.
Abschnitt 02Konzeptionelles Modell
Wie die Komponentenzusammenwirken
Jede Anfrage gelangt über einen TLS-terminierenden NGINX-Proxy und wird an die Anwendungsebene weitergeleitet: den Vue-Client, die zentrale Flask-API sowie die IAM-, Analytics- und LLM-Dienste. Die API übergibt zeitintensive Aufgaben an ein asynchrones System aus Celery-Workern über RabbitMQ, das auch die Scan-, Ingest- und Enforce-Ereignisse für die Java-Ebene transportiert. Die rechenintensiven Aufgaben – das Crawlen von Quellen, die Textextraktion und die Durchsetzung von Richtlinien – laufen in dieser Java-Ebene. Als Fundament dient die Datenschicht mit Elasticsearch als gemeinsamem Dokumentenspeicher für alle Dienste.
Anfrage- und DatenpfadPersistenter Speicher / AusgabeUnterkomponente innerhalb einer Ebene
Die vollständige Dienstlandschaft, das Gateway, die Mandantenverwaltung und das Bereitstellungsmodell werden in Plattformarchitektur beschrieben.
Abschnitt 03Ende zu Ende
Von einer Rohdatenquelle bis zur Durchsetzung einer Richtlinie
Ein Dokument durchläuft jedes Mal denselben Prozess. Eine Quelle wird einmalig konfiguriert; anschließend durchsucht die Plattform sie automatisch, extrahiert den enthaltenen Text, erstellt ein Profil hinsichtlich personenbezogener Daten, prüft dieses anhand der Mandantenrichtlinien, handelt entsprechend dem Ergebnis und erstellt einen Bericht. Kostengünstige, deterministische Schritte werden zuerst ausgeführt; die aufwendigen KI- und Durchsetzungsschritte werden nur auf die Daten angewendet, die diese Stufe erreichen.
Hauptpfad der PipelineGemeinsamer Speicher, der in jeder Stufe verwendet wirdAusgabe an den Benutzer
Was die Plattform leistet – in sechs Verben
01 · Verbinden
Verbinden
Binden Sie E-Mail, Dateispeicher und Chat über einen Connector pro Quelle ein.
02 · Scannen
Scannen & Lesen
Durchsuchen Sie jede Quelle und extrahieren Sie Text, einschließlich OCR für Bilder und Scans.
03 · Klassifizieren
Klassifizieren
Analysieren Sie jedes Dokument auf persönliche und sensible Daten anhand der Taxonomie.
04 · Entscheiden
Entscheiden
Prüfen Sie die Ergebnisse anhand der Aufbewahrungs- und Vertraulichkeitsrichtlinien des Mandanten.
05 · Handeln
Handeln
Bearbeiten, archivieren, einschränken oder löschen – stets durch den Dateneigentümer bestätigt.
06 · Berichten
Berichten
Dashboards, Warnmeldungen und exportierbare Berichte für Nachweise und Audits.
Abschnitt 04Details lesen
In diesem Deep Dive
Die obige Übersicht bleibt bewusst oberflächlich. Die nachfolgenden Feldhandbücher enthalten die Details – jedes deckt eine eigene Plattformschicht ab, ohne Überschneidungen mit den anderen.
Diese Übersicht ist der Einstiegspunkt in den Deep-Dive-Bereich. Lesen Sie sie, um ein Gesamtbild der Plattform zu erhalten, und folgen Sie anschließend einem der obigen Links zur gewünschten Schicht. Jeder Deep Dive ist in sich geschlossen und setzt ausschließlich das voraus, was auf dieser Seite beschrieben wird.