Datenschutz

Klar eingeordnet - Google Analytics Duplikate Entfernen

Taras Shynkarenko
Taras Shynkarenko
•Aktualisiert: •7 Min. Lesezeit
Klar eingeordnet - Google Analytics Duplikate EntfernenKlar eingeordnet - Google Analytics Duplikate Entfernen

TL;DR, Kurzantwort

7 Min. Lesezeit

Google Analytics Aufbewahrungseinstellungen und die Datenspeicherung in den USA führen zu zusätzlichen GDPR Compliance-Risiken, die Unternehmen aktiv verwalten oder ganz vermeiden müssen.

Hier wird das Thema Google Analytics Duplikate Entfernen mit praktischen Beispielen erklärt. Die Aufbewahrungseinstellung in Google Analytics wird häufig missverstanden: Sie wirkt auf Daten der Nutzer- und Ereignisebene in Explorations- und Trichterberichten, nicht auf die aggregierten Standardberichte.

Die Datenaufbewahrung Google Analytics kann leicht missverstanden werden. In GA4 wirken sich Aufbewahrungseinstellungen auf Daten auf Benutzerebene und Ereignisebene aus, die in Explorations- und Trichterberichten verwendet werden, nicht auf standardmäßige aggregierte Berichte. In der Dokumentation von Google werden 2 Monate und 14 Monate für Standardeigenschaften aufgeführt, mit längeren Optionen für Google Analytics 360, und es heißt, dass Daten automatisch gelöscht werden, wenn das Ende des Aufbewahrungszeitraums erreicht ist (GA4 Datenaufbewahrung).

Diese Einstellung dient nicht nur der Analyse. Es handelt sich um eine Datenschutzkontrolle.

Warum die Aufbewahrung unter GDPR wichtig ist

Der Grundsatz der Speicherbeschränkung des GDPR verlangt, dass personenbezogene Daten nur so lange in identifizierbarer Form aufbewahrt werden, wie es für den Zweck erforderlich ist. Wenn rohe Ereignisdaten aufbewahrt werden, weil „wir sie vielleicht eines Tages brauchen“, ist der Zweck zu vage.

Analysedaten können personenbezogene Daten enthalten, auch wenn Namen fehlen. Gerätedaten, Cookie-IDs, Benutzer IDs, vollständiger URLs, IP-abgeleiteter Standort, Ereignisparameter und Verhaltenssequenzen können eine Person identifizieren oder herausgreifen. Eine längere Aufbewahrung erhöht die Auswirkungen von Sicherheitsverletzungen, das Zugriffsrisiko und die regulatorische Gefährdung.

Zwei Wege, Aufbewahrung zu begründen
Vage Begründung
  • Daten werden aufbewahrt, weil man sie „irgendwann vielleicht braucht“
  • Kein festgelegter Löschtermin
  • Rohdaten auf Ereignisebene bleiben unbegrenzt identifizierbar
Grundsatz der Speicherbegrenzung
  • Personenbezogene Daten nur so lange wie für den Zweck nötig
  • Aufbewahrungsfrist an einen definierten Zweck geknüpft
  • Löschung erfolgt, sobald der Zweck endet
Der Grundsatz der Speicherbegrenzung unter GDPR trennt eine Gewohnheit von einer Richtlinie.

Was die Aufbewahrung von GA4 bewirkt und was nicht

GA4 Aufbewahrungskontrollen können reduzieren, wie lange Daten auf Ereignisebene für bestimmte Analysefunktionen verfügbar bleiben. Sie beantworten jedoch nicht jede Datenschutzfrage:

  • Standardaggregierte Berichte sind nicht in gleicher Weise betroffen.
  • Der BigQuery-Export erstellt einen separaten Datensatz unter Ihrer Kontrolle.
  • Verlinkte Produkte können ein eigenes Aufbewahrungsverhalten aufweisen.
  • Für heruntergeladene Berichte und Lagerkopien ist eine eigene Richtlinie erforderlich.
  • Einwilligungs- und Übertragungsfragen bedürfen noch einer gesonderten Analyse.

Wenn Sie GA4-Daten nach BigQuery exportieren, sagt Google, dass Sie Eigentümer dieser exportierten Daten sind und den Zugriff über BigQuery-Steuerelemente verwalten (GA4 BigQuery-Export). Das bedeutet, dass die Verantwortung für die Aufbewahrung auf Sie übergeht.

Riskante Aufbewahrungsmuster

Zu den häufigsten Problemen gehören:

  • Belassen Sie die Standardaufbewahrung, ohne die Berichtsanforderungen zu verstehen.
  • Exportieren von Rohdaten in ein Lager ohne Löschplan.
  • Behalten der Benutzerkennungen in der Analyse nach der Kontolöschung.
  • Speichern ganzer Seiten URLs, die E-Mails, Token oder Suchbegriffe enthalten.
  • Ermöglichen eines breiten Personalzugriffs auf Daten auf Ereignisebene.
  • Speicherung von Daten zu Werbezwecken nach Abmeldung durch den Nutzer.

Beschriftete Archivboxen auf einem Regal, die zeigen, wie Daten in kurz- und langfristige Aufbewahrungsstufen sortiert werden können.

Ein besseres Aufbewahrungsmodell

Verwenden Sie Ebenen:

Echtzeit und Debugging: Stunden bis Tage. Nützlich für Bereitstellungsprüfungen und Vorfalluntersuchungen.

Rohe Ereignisanalyse: 30 bis 180 Tage, abhängig von Produktzyklen und Rechtsgrundlage.

Aggregierte Berichterstattung: 12 bis 36 Monate für Trendanalysen, ohne persönliche Identifikatoren.

Finanzielle oder vertragliche Aufzeichnungen: getrennt von der Webanalyse und im Rahmen buchhalterischer oder gesetzlicher Verpflichtungen aufbewahrt.

Dokumentieren Sie den Zweck für jede Ebene und automatisieren Sie die Löschung. Manuelle Löschrichtlinien scheitern stillschweigend.

Flowsery
Flowsery

Kostenlos testen

Echtzeit-Dashboard

Zielverfolgung

Cookie-freies Tracking

Privacy-First-Analytics-Vorteil

Eine datenschutzorientierte Analyseplattform, die Cookies, persistente IDs, Fingerabdrücke und Rohspeicherung IP vermeidet, reduziert das Aufbewahrungsrisiko von Anfang an. Aggregierte Messwerte können oft länger aufbewahrt werden, da sie weniger wahrscheinlich Einzelpersonen identifizieren. Rohe Ereignisse können nur von kurzer Dauer sein oder ganz vermieden werden.

Das Ziel besteht nicht darin, den nützlichen Verlauf zu löschen. Es geht darum, die nützlichste Form der Historie zu bewahren: Trends, Conversions, Kampagnen und Inhaltsleistung ohne unnötige persönliche Spuren.

Checkliste

  1. Überprüfen Sie die Aufbewahrungseinstellungen von GA4.
  2. Identifizieren Sie alle Exporte und verbundenen Produkte.
  3. Definieren Sie die Aufbewahrung für Rohereignisse, Berichte und Warehouse-Tabellen.
  4. Persönliche Daten aus Ereignisparametern entfernen.
  5. Beschränken Sie den Zugriff auf Daten auf Ereignisebene.
  6. Workflows zum Löschen von Dokumenten für Benutzeranfragen.
  7. Überprüfungsaufbewahrung nach größeren Produkt- oder Gesetzesänderungen.

Bei der Datenspeicherung werden Datenschutzversprechen wahr. Wenn Sie nicht sagen können, warum ein Datensatz noch vorhanden ist, ist es wahrscheinlich an der Zeit, ihn zu aggregieren oder zu löschen.

Aufbewahrung für Ereigniseigenschaften

Die Aufbewahrungsüberprüfung sollte Ereigniseigenschaften umfassen, nicht nur Ereigniszeitstempel. Eine Eigenschaft wie search_term, account_id, page_location oder checkout_step birgt möglicherweise ein größeres Datenschutzrisiko als der Ereignisname. Wenn Sie Suchanalysen benötigen, sollten Sie erwägen, Abfragen zu gruppieren, seltene Abfragen zu verwerfen oder Begriffe für sensible Inhalte zu überprüfen, bevor Sie sie speichern.

Eine Person, die sich mit einer Zugangskarte durch eine verschlossene Bürotür ausweist, als Sinnbild für den eingeschränkten Zugriff auf Rohdaten der Analyse.

Zugangskontrollen

Eine kurze Aufbewahrung hilft nicht, wenn zu viele Personen Daten exportieren können, während sie vorhanden sind. Beschränken Sie den Zugriff auf Rohanalysen auf Personen, die ihn benötigen, bevorzugen Sie aggregierte Dashboards für die meisten Beteiligten und protokollieren Sie Exporte aus Data Warehouses. Analysedaten wirken oft risikoarm, bis sie mit CRM-, Abrechnungs- oder Supportdaten kombiniert werden. Bei Zugriffsrichtlinien sollte davon ausgegangen werden, dass Verknüpfungen die Empfindlichkeit erhöhen können.

Vorlage für Aufbewahrungsrichtlinien

Schreiben Sie die Richtlinie in Geschäftssprache. Rohe Analyseereignisse werden für ein kurzes Diagnosefenster aufbewahrt. Aggregierte Berichte werden zur Trendanalyse länger aufbewahrt. Sensible Ereigniseigenschaften werden vor der Speicherung blockiert oder geschwärzt. Exporte erfordern einen benannten Zweck und verfallen. Die Einstellungen zur Lieferantenbindung werden nach Produkteinführungen, Kampagnenänderungen und Agenturübergaben überprüft. Googles eigene GA4-Dokumentation zu Datenaufbewahrung zeigt, dass sich Aufbewahrungseinstellungen unterschiedlich auf Daten auf Benutzer- und Ereignisebene auswirken. Daher sollten Teams nicht davon ausgehen, dass ein einziger Schalter jedes Risiko löst.

Für eine Einrichtung, bei der die Privatsphäre an erster Stelle steht, trennen Sie drei Ebenen. Erstens werden betriebliche Ereignisse in Echtzeit zur Überprüfung der Nachverfolgung verwendet. Zweitens, aktuelle Rohereignisse, die zum Debuggen von Formularen, Kampagnen und Trichtern verwendet werden. Drittens: Aggregierte historische Kennzahlen, die für die Strategie verwendet werden. Die meisten Teams benötigen die dritte Schicht viel länger als die ersten beiden. Dieses Design bewahrt den nützlichen Verlauf und verringert gleichzeitig die Wahrscheinlichkeit, dass alte Identifikatoren, URLs, Suchbegriffe oder versehentliche persönliche Daten noch Jahre nach Ablauf des ursprünglichen Zwecks verfügbar bleiben.

Drei Schichten von Analysedaten
Echtzeit-Betriebsereignisse
Aktuelle Rohereignisse
Aggregierte historische Kennzahlen
Die meisten Teams brauchen die dritte Schicht deutlich länger als die ersten beiden.

Aufbewahrungsüberwachungsaktionen

Erstellen Sie ein Aufbewahrungsinventar für GA4 und jedes verbundene Ziel. Erfassen Sie, ob erweiterte Messung, Google Signals, personalisierte Anzeigen, Benutzer-ID, BigQuery-Export, Einwilligungsmodus, domänenübergreifende Messung und regionsspezifische Einstellungen aktiviert sind.

Dann trennen Sie das, was roh bleiben muss, von dem, was zur aggregierten Geschichte werden kann. Bewahren Sie GA4-Daten nur dort auf, wo das Google-Berichts- oder Anzeigen-Ökosystem eine berechtigte Aufgabe hat; Verschieben Sie Basisseiten, Referrer, Kampagnen, Ziele und aggregierte Trichter nach Möglichkeit in ein Setup mit geringerem Risiko.

Häufig gestellte Fragen

Was steuert die GA4-Aufbewahrungseinstellung eigentlich?

Die GA4-Aufbewahrungseinstellung betrifft nutzer- und ereignisbezogene Daten, die in Explorationen und Trichterberichten verwendet werden, nicht die Standardberichte mit aggregierten Daten. Standardproperties bieten 2 oder 14 Monate, bei Google Analytics 360 sind längere Zeiträume möglich. Google löscht die Daten automatisch, sobald das Ende des gewählten Zeitraums erreicht ist.

Warum reicht eine kurze GA4-Aufbewahrungsfrist allein nicht aus?

Der BigQuery-Export erzeugt einen eigenen Datensatz, der komplett unter eigener Kontrolle liegt, sodass eine kürzere GA4-Frist an dieser Kopie nichts ändert. Heruntergeladene Berichte und verknüpfte Produkte können ihr eigenes Aufbewahrungsverhalten haben. Für jede dieser Kopien braucht es eine eigene Löschregel.

Wem gehören die nach BigQuery exportierten GA4-Daten?

Laut Googles eigener Dokumentation gehören die exportierten Daten dem Kunden, der den Zugriff über BigQuery-Kontrollen verwaltet. Damit verlagert sich die Verantwortung für die Aufbewahrung auf das eigene Team statt auf Googles Infrastruktur. Ein Löschplan für diese Warehouse-Kopie muss separat von den GA4-Einstellungen aufgebaut werden.

Können Analysedaten personenbezogen sein, auch ohne Namen?

Gerätedaten, Cookie-Kennungen, User-IDs, vollständige URLs, aus der IP abgeleitete Standorte, Ereignisparameter und Verhaltenssequenzen können eine Person auch ohne Namen identifizieren oder herausgreifen. Keiner dieser Werte braucht einen angehängten Namen, um dieses Risiko zu tragen. Eine längere Aufbewahrung vervielfacht nur die Angriffsfläche, falls etwas davon abfließt.

Wie lange sollten Rohdaten auf Ereignisebene aufbewahrt werden?

Das im Beitrag beschriebene Stufenmodell setzt für Rohereignisanalysen 30 bis 180 Tage an, je nach Produktzyklus und Rechtsgrundlage. Echtzeit- und Debugging-Daten brauchen nur Stunden bis Tage. Aggregierte Berichte ohne personenbezogene Kennungen können 12 bis 36 Monate laufen.

Flowsery
Flowsery

Kostenlos testen

Echtzeit-Dashboard

Zielverfolgung

Cookie-freies Tracking

Welche Ereigniseigenschaften bergen das größte Datenschutzrisiko?

Eigenschaften wie search_term, account_id, page_location oder checkout_step tragen oft mehr Risiko als der Ereignisname selbst. Suchanalysen sind dabei eine häufige Falle. Suchbegriffe zu gruppieren, seltene Anfragen zu verwerfen oder Begriffe vor der Speicherung auf sensible Inhalte zu prüfen, senkt dieses Risiko deutlich.

Warum ist eingeschränkter Zugriff auf Rohdaten wichtig, wenn die Aufbewahrung schon kurz ist?

Eine kurze Aufbewahrungsfrist bringt wenig, wenn währenddessen zu viele Personen die Daten exportieren können. Sicherer ist es, den Zugriff auf Rohdaten den Personen vorzubehalten, die ihn wirklich brauchen, und den meisten Stakeholdern stattdessen aggregierte Dashboards zu geben. Exporte aus Data-Warehouses sollten zusätzlich protokolliert werden.

Warum erhöht die Verknüpfung von Analysedaten mit CRM- oder Abrechnungsdaten das Risiko?

Analysedaten wirken isoliert oft harmlos, bis sie mit CRM-, Abrechnungs- oder Support-Daten zusammengeführt werden. Diese Verknüpfung kann aus einem einfachen Seitenaufruf Daten machen, die einen bestimmten Kunden identifizieren. Zugriffsrichtlinien sollten davon ausgehen, dass solche Verknüpfungen möglich sind, und entsprechend gestaltet sein.

Was sollte ein Aufbewahrungsaudit erfassen?

Eine Aufbewahrungsübersicht sollte GA4 und jedes verknüpfte Ziel abdecken und festhalten, ob Enhanced Measurement, Google Signals, Ads-Personalisierung, User-ID, BigQuery-Export, Consent Mode, geräteübergreifende Messung und regionsspezifische Einstellungen aktiviert sind. Darauf aufbauend lässt sich trennen, was roh bleiben muss und was in aggregierte Historie überführt werden kann. Basisseiten, Referrer, Kampagnen, Ziele und aggregierte Trichter lassen sich oft in eine risikoärmere Struktur verschieben.

Verändert eine Privacy-First-Analytics-Plattform die Rechnung bei der Aufbewahrung?

Eine Plattform, die auf Cookies, persistente IDs, Fingerprinting und die Speicherung roher IP-Adressen verzichtet, senkt das Aufbewahrungsrisiko von Anfang an. Ihre aggregierten Kennzahlen lassen sich oft länger aufbewahren, weil sie einzelne Personen seltener identifizieren. Rohereignisse können in diesem Modell kurzlebig bleiben oder ganz entfallen.

War dieser Artikel hilfreich?

Teilen Sie uns Ihre Meinung mit!

Sieh uns öfter bei Google

Ein Klick macht Flowsery zu einer bevorzugten Quelle. Unsere Artikel stehen dann weiter oben in deinen Top-Meldungen, im KI-Modus und in den KI-Übersichten.

Bevor Sie gehen...

Flowsery

Flowsery

Umsatzorientierte Analysen für Ihre Website

Verfolgen Sie jeden Besucher, jede Quelle und jede Conversion in Echtzeit. Einfach, leistungsstark und komplett ohne Cookies.

Echtzeit-Dashboard

Zielverfolgung

Cookie-freies Tracking

Verwandte Artikel