Data & MoreEngineeringIndex der Detailübersichten

Die gesamte Plattform, auf einerKarte.

Data & More ist eine mandantenfähige DSGVO- und Data-Governance-Plattform. Sie verbindet sich mit den E-Mail-, Dateispeicher- und Chat-Systemen einer Organisation, liest alle gefundenen Inhalte, klassifiziert jedes Dokument hinsichtlich personenbezogener und sensibler Daten und unterstützt die verantwortliche Person dabei, entsprechende Maßnahmen zu ergreifen. Diese Seite ist die Karte: was die Plattform leistet, wie die Komponenten zusammenwirken und wo Sie die Details nachlesen können.

Was Sie nicht zuerst gelesen, klassifiziert und verstanden haben, können Sie nicht verwalten.

~42Microservices
2Kernsprachen: Python, Java
7Pipeline-Stufen, von der Quelle bis zum Bericht
1Gemeinsamer Datenspeicher: Elasticsearch
Abschnitt 01Funktionsweise

Klassifizieren, Prüfen, Löschen –kontinuierlich aktiv

Die Plattform läuft kontinuierlich und nicht in einem festen vierteljährlichen Rhythmus. Der Prozess trägt einen Namen,Klassifizieren, Prüfen, Löschen: Die Plattform klassifiziert, was im Archiv vorhanden ist, die verantwortliche Person prüft die Ergebnisse an ihrem eigenen Standort, und das Resultat ist eine Löschung (oder Archivierung, Bearbeitung bzw. Einschränkung), die im Quellsystem durchgeführt wird. Quellen und Ausnahmen sind die einmalige Konfiguration, die den Kreislauf speist.

KONTINUIERLICH AKTIV PRÜFEN KLASSIFIZIEREN LÖSCHEN
Klassifizieren – Aufgabe der Plattform Prüfen – Aufgabe der verantwortlichen Person Löschen – das kontinuierliche Ziel
Woher die Daten stammen

Verbundene Quellen

Jede Quelle ist über einen der Ingestion-Konnektoren der Plattform angebunden. Der Zyklus beginnt hier und schreibt die Ergebnisse ebenfalls hierher zurück.

Office 365ExchangeSharePointOneDrive TeamsOutlookGmailGoogle DriveDateifreigaben
Was Löschen in der Praxis bedeutet

Drei Möglichkeiten zum Löschen

Eine Löschung erfolgt niemals automatisch. Die verantwortliche Person prüft jeden Befund lokal und wählt eine von drei Maßnahmen, die im Prüfprotokoll festgehalten wird.

  • Einschränken– der Datensatz verbleibt an seinem Ort, wird jedoch für eingeschränkten Zugriff markiert.
  • Archivieren (Aufbewahrung)– der Datensatz wird in ein Archiv mit einer definierten Aufbewahrungsregel verschoben.
  • Löschen– der Datensatz wird dauerhaft aus dem Quellsystem entfernt.
Abschnitt 02Konzeptionelles Modell

Wie die Komponentenzusammenwirken

Jede Anfrage gelangt über einen TLS-terminierenden NGINX-Proxy und wird an die Anwendungsebene weitergeleitet: den Vue-Client, die zentrale Flask-API sowie die IAM-, Analytics- und LLM-Dienste. Die API übergibt zeitintensive Aufgaben an ein asynchrones System aus Celery-Workern über RabbitMQ, das auch die Scan-, Ingest- und Enforce-Ereignisse für die Java-Ebene transportiert. Die rechenintensiven Aufgaben – das Crawlen von Quellen, die Textextraktion und die Durchsetzung von Richtlinien – laufen in dieser Java-Ebene. Als Fundament dient die Datenschicht mit Elasticsearch als gemeinsamem Dokumentenspeicher für alle Dienste.

EDGE ANWENDUNGSEBENE MESSAGING DATENSPEICHER DIENSTE INGESTION KONZEPTIONELLES MODELL nicht zu 100 % exakt NGINX TLS 1.2/1.3 · Reverse Proxy · Rate Limit · IP-Allowlist Client Vue 3 SPA 281 Komponenten · 24+ Sprachen API Flask 3 · Celery · :8000 der zentrale Knotenpunkt IAM Flask · JWT · :5000 LDAP / Active Directory Analytics Flask · pandas · :6000 Berichte, Diagramme, PDF asynchrone Aufgaben Synchrones HTTP Celery-Worker Neu-Indexierung · Massenoperationen · Benachrichtigungen RabbitMQ Task-Broker · v4.2 Task-Worker Asynchrone Job-Ausführung Schreibt Ergebnisse Elasticsearch 9.x · Gemeinsamer Dokumentenspeicher PostgreSQL 17.x · IAM · pgvector Sicherung Tägliche Sicherungen · 180 Tage Lesen · Schreiben Schreiben Schreiben Dienste java_core Scannen · Erfassen · Durchsetzen java_profiler Regex · NER · FastText Enforcer Richtlinienaktionen OCR Bild · Text · MRZ Data Subject Mgr Personensuche Datenfeeds Erfassung Graph-Erfassung Microsoft Graph EWS-Erfassung Exchange Web Services SP-Erfassung SharePoint Google-Erfassung Workspace · Drive Web-Erfassung URLs · Scraping
Anfrage- und Datenpfad Persistenter Speicher / Ausgabe Unterkomponente innerhalb einer Ebene

Die vollständige Dienstlandschaft, das Gateway, die Mandantenverwaltung und das Bereitstellungsmodell werden in Plattformarchitektur beschrieben.

Abschnitt 03Ende zu Ende

Von einer Rohdatenquelle bis zur Durchsetzung einer Richtlinie

Ein Dokument durchläuft jedes Mal denselben Prozess. Eine Quelle wird einmalig konfiguriert; anschließend durchsucht die Plattform sie automatisch, extrahiert den enthaltenen Text, erstellt ein Profil hinsichtlich personenbezogener Daten, prüft dieses anhand der Mandantenrichtlinien, handelt entsprechend dem Ergebnis und erstellt einen Bericht. Kostengünstige, deterministische Schritte werden zuerst ausgeführt; die aufwendigen KI- und Durchsetzungsschritte werden nur auf die Daten angewendet, die diese Stufe erreichen.

ERFASSEN PROFILIEREN VALIDIEREN DURCHSETZEN BERICHTEN 1 · Erfassen java_core SCAN + INGEST Kollektor · Graph ews · google Apache Tika · OCR 2 · Profilieren Inhalt klassifizieren Logik-Profil java_profiler KI-Profil ai-profiler (spaCy) 3 · Validieren PolicyValidator Aufbewahrungsregeln Vertraulichkeitsklasse Aktion festlegen 4 · Durchsetzen PolicyEnforcer Löschen Verschieben · Archivieren Markieren · Keine Aktion 5 · Berichten Analysen Dashboards Warnmeldungen · Benachrichtigen PDF / Excel alle Stufen lesen und schreiben Elasticsearch
Hauptpfad der Pipeline Gemeinsamer Speicher, der in jeder Stufe verwendet wird Ausgabe an den Benutzer

Was die Plattform leistet – in sechs Verben

01 · Verbinden

Verbinden

Binden Sie E-Mail, Dateispeicher und Chat über einen Connector pro Quelle ein.

02 · Scannen

Scannen & Lesen

Durchsuchen Sie jede Quelle und extrahieren Sie Text, einschließlich OCR für Bilder und Scans.

03 · Klassifizieren

Klassifizieren

Analysieren Sie jedes Dokument auf persönliche und sensible Daten anhand der Taxonomie.

04 · Entscheiden

Entscheiden

Prüfen Sie die Ergebnisse anhand der Aufbewahrungs- und Vertraulichkeitsrichtlinien des Mandanten.

05 · Handeln

Handeln

Bearbeiten, archivieren, einschränken oder löschen – stets durch den Dateneigentümer bestätigt.

06 · Berichten

Berichten

Dashboards, Warnmeldungen und exportierbare Berichte für Nachweise und Audits.

Abschnitt 04Details lesen

In diesem Deep Dive

Die obige Übersicht bleibt bewusst oberflächlich. Die nachfolgenden Feldhandbücher enthalten die Details – jedes deckt eine eigene Plattformschicht ab, ohne Überschneidungen mit den anderen.

EinordnungHier beginnen

Eine Übersicht, dann die Feldhandbücher.

Diese Übersicht ist der Einstiegspunkt in den Deep-Dive-Bereich. Lesen Sie sie, um ein Gesamtbild der Plattform zu erhalten, und folgen Sie anschließend einem der obigen Links zur gewünschten Schicht. Jeder Deep Dive ist in sich geschlossen und setzt ausschließlich das voraus, was auf dieser Seite beschrieben wird.

deep-dive · support.dataandmore.com/en/knowledge/deep-dive