Longitudinale Daten auswerten: praxisnaher Leitfaden für Verlaufsstudien

Zwei Männer analysieren Längsschnittdaten in einer modernen Büroumgebung.

Herr Schwarz und Dr. Stankov diskutieren über Messwiederholungsmethoden

Wenn du dieselben Personen mehrfach untersuchst, entsteht ein Datensatz mit eigener Logik: Drei, fünf oder zehn Messzeitpunkte liefern nicht einfach mehr Beobachtungen, sondern miteinander verknüpfte Werte. Genau hier beginnt die eigentliche methodische Arbeit. Du musst klären, welche Veränderung deine Studie abbildet, wie du fehlende Werte behandelst und welche Schlüsse deine Daten tatsächlich tragen. Für Abschlussarbeiten, Promotionen und klinische Studien entscheidet das darüber, ob Ergebnisse überprüfbar und veröffentlichungsfähig sind.

Längsschnittdaten entstehen, wenn dieselben Einheiten wiederholt gemessen werden: der Blutdruck vor, während und nach einer Behandlung, die Lernmotivation über ein Semester oder der Umsatz von Betrieben über mehrere Jahre. Anders als in einer einmaligen Querschnittserhebung sind die Werte einer Person nicht unabhängig voneinander. Wer diese Abhängigkeit übergeht, unterschätzt die Unsicherheit der Ergebnisse und findet Effekte, die nicht belastbar sind.

Welche Fragen Verlaufsdaten beantworten

Selten geht es nur darum, ob sich ein Mittelwert verändert hat. Wichtiger sind Fragen wie: Wie stark verändert sich die Zielgröße über die Zeit? Verlaufen Gruppen unterschiedlich? Welche Merkmale erklären abweichende Entwicklungen? Und bleibt ein Effekt bestehen, wenn Ausgangswert, Alter oder weitere Einflussgrößen berücksichtigt werden?

Ein Beispiel: Zwei Behandlungsgruppen geben zu vier Zeitpunkten einen Schmerzwert an. Ein Vergleich nach sechs Monaten allein greift zu kurz; entscheidend ist, ob sich die Verläufe über den gesamten Beobachtungszeitraum unterscheiden. Diese Frage prüft die Wechselwirkung von Zeit und Gruppe. Welches Verfahren passt, hängt deshalb auch von Messniveau, Design, Verteilung der Zielgröße, Gruppenstruktur und Ausfällen ab.

Mann in einem Telefonat, lächelnd während der Analyse von Längsschnittstudien.

Zu allen Themen rund um Statistik erreichen Sie Dr. Stankov weiterhin persönlich

Schritt für Schritt zur passenden Analyse

Fragestellung und Zeitstruktur klären

Kläre zuerst, was Zeit in deiner Studie bedeutet: feste Wellen wie T0, T1 und T2 oder individuelle Abstände, etwa bei ambulanten Nachuntersuchungen. Bei ungleichen Abständen modellierst du besser die tatsächlich verstrichene Zeit in Tagen, Wochen oder Monaten. Formuliere Hypothesen präzise: Dass sich Werte über die Zeit ändern, beschreibt einen allgemeinen Zeiteffekt; dass sich eine Interventionsgruppe stärker verbessert als die Kontrollgruppe, beschreibt eine Erwartung an die Wechselwirkung. Prüfe außerdem, ob eine gleichmäßige Entwicklung plausibel ist: In Rehabilitationsverläufen verbessern sich Werte oft früh schnell und flachen später ab, sodass quadratische Zeitterme oder kategorial modellierte Zeitpunkte besser passen.

Daten sauber aufbauen

Die meisten Verfahren erwarten das lange Format: Jede Zeile enthält eine Messung zu einem Zeitpunkt, eine Person mit vier Messungen erscheint also viermal mit derselben Kennung. Ein einfacher Aufbau umfasst Personenkennung, Zeit, Gruppe, Zielgröße und Begleitmerkmale wie Alter oder Geschlecht. Häufige Fehlerquellen sind:

  • doppelt vergebene Personenkennungen
  • uneinheitlich codierte Zeitangaben
  • Zahlen, die versehentlich als Text eingelesen wurden
  • Sondercodes wie 99 als echte Messwerte

Halte vor der Auswertung fest, welcher Wertebereich fachlich möglich ist, sonst verzerren einzelne Codes Mittelwerte, Grafiken und Modelle.

Ein Mann mit Gedankenpause über Längsschnittdaten analysieren.

Nur mit sauberen Daten lassen sicher Messwiederholungsmethoden korrekt anwenden

Datenqualität und Ausfälle prüfen

Berechne je Zeitpunkt Fallzahl, Mittelwert oder Median, Streuung, Minimum und Maximum und ergänze eine Verlaufsgrafik mit Gruppenmittelwerten und Unsicherheitsbereichen. Fehlende Werte sind kein Randthema: Wer wegen einer Verschlechterung ausscheidet, fehlt nicht zufällig, und eine Analyse nur vollständiger Fälle fällt dann leicht zu optimistisch aus. Vereinfacht unterscheidet man Ausfälle, die rein zufällig entstehen, solche, die sich durch beobachtete Merkmale erklären lassen, und solche, die von unbeobachteten Werten abhängen. Berichte Ausfallmuster offen und begründe die Annahmen deines Verfahrens; Sensitivitätsanalysen oder multiple Imputation ergänzen, ersetzen aber keine fachliche Einordnung.

Modell auswählen

Bei zwei Zeitpunkten passen Veränderungswerte oder eine Kovarianzanalyse, die den Ausgangswert als Begleitvariable einbezieht; ab drei Zeitpunkten genügen einzelne Paarvergleiche selten. Die Varianzanalyse mit Messwiederholung funktioniert bei kleinen, vollständigen Datensätzen, setzt aber eine bestimmte Struktur der Zusammenhänge voraus und schließt Personen mit Lücken häufig ganz aus. Lineare gemischte Modelle sind für metrische Zielgrößen meist die bessere Wahl: Sie berücksichtigen die Abhängigkeit der Messungen innerhalb einer Person und können unvollständige Verläufe mitverwenden. Ein übliches Modell enthält feste Effekte für Zeit, Gruppe und deren Wechselwirkung sowie einen zufälligen Achsenabschnitt, der unterschiedliche Startniveaus abbildet; eine zufällige Steigung erlaubt individuelle Veränderungsraten, verlangt aber genügend Messungen pro Person. Ist die Zielgröße binär, etwa Rückfall ja oder nein, brauchst du ein verallgemeinertes gemischtes Modell; für Häufigkeiten oder Rangskalen gelten eigene Verteilungsannahmen und Linkfunktionen.

Annahmen und Modellgüte prüfen

Auch gemischte Modelle brauchen Diagnostik: Verteilung der Residuen, Konstanz der Streuung, auffällige Einzelfälle und die Form des Zeitverlaufs. Informationskriterien wie AIC oder BIC helfen beim Vergleich plausibler Varianten, ersetzen aber keine fachliche Begründung. Ist die Wechselwirkung aus Zeit und Gruppe bedeutsam, schätze vorab festgelegte Kontraste oder marginale Mittelwerte, korrigiere bei vielen Vergleichen und berichte Konfidenzintervalle. Weitere Einordnungen findest du im Ratgeber zu Statistik und Datenanalyse.

Ergebnisse klar berichten

Nenne zuerst Stichprobe, Messzeitpunkte und Ausfallquote, danach Modelltyp, Zielgröße, feste und zufällige Effekte sowie den Umgang mit fehlenden Werten. Berichte die zentrale Frage mit Effektgröße und 95 Prozent Konfidenzintervall statt nur mit dem Hinweis auf Signifikanz. Trenne dabei statistische von praktischer Bedeutung: In großen Stichproben können kleine Effekte signifikant werden, während relevante Effekte in kleinen Stichproben unsicher bleiben.

Fazit

Längsschnittanalysen gelingen, wenn Fragestellung, Zeitstruktur, Datenaufbau, Umgang mit Ausfällen und Modellwahl zusammenpassen. Wer diese Schritte dokumentiert und die Grenzen der eigenen Annahmen benennt, erhält Ergebnisse, die fachlich überprüfbar bleiben.

Diese Webseite verwendet Cookies

Diese Webseite nutzt Cookies, um Ihnen das bestmögliche Erlebnis zu gewährleisten. Cookies helfen uns, die Webseite mit Analysen zu verbessern. Mit einem Klick auf „Zustimmen“, stimmen Sie der Verwendung von Cookies zu. Sie können Ihre Einwilligung jederzeit ändern, indem Sie unter "Optionen verwalten" Ihre getroffenen Einstellungen selbst rückgängig machen. Weitere Informationen finden Sie in unserer Datenschutzerklärung.

Privatsphäre-Einstellungen

Wir verwenden Cookies und ähnliche Technologien auf unserer Website und verarbeiten personenbezogene Daten von dir (z.B. IP-Adresse), um z.B. Inhalte und Anzeigen zu personalisieren, Medien von Drittanbietern einzubinden oder Zugriffe auf unsere Website zu analysieren.

Die Datenverarbeitung kann auch erst in Folge gesetzter Cookies stattfinden. Wir teilen diese Daten mit Dritten, die wir in den Privatsphäre-Einstellungen benennen.

Einige Services verarbeiten personenbezogene Daten in den USA. Indem du der Nutzung dieser Services zustimmst, erklärst du dich auch mit der Verarbeitung deiner Daten in den USA gemäß Art. 49 (1) lit. a DSGVO einverstanden. Die USA werden vom EuGH als ein Land mit einem unzureichenden Datenschutzniveau nach EU-Standards angesehen. Insbesondere besteht das Risiko, dass deine Daten von US-Behörden zu Kontroll- und Überwachungszwecken verarbeitet werden, unter Umständen ohne die Möglichkeit eines Rechtsbehelfs.

Du bist unter 16 Jahre alt? Dann kannst du nicht in optionale Services einwilligen. Du kannst deine Eltern oder Erziehungsberechtigten bitten, mit dir in diese Services einzuwilligen.


Ihre Einstellungen für Einwilligungen

Hier haben Sie die Möglichkeit, Ihre Einwilligung für die Datenverarbeitung durch Cookies zu erteilen oder zu widerrufen. Sie können Ihre Einstellungen jederzeit ändern. Weitere Informationen finden Sie in unserer Datenschutzerklärung.