Individuelle Diagnostik – die Arbeit mit Einzelfällen

Die Einzelfalldiagnostik zielt darauf ab, für eine einzelne Person ein möglichst genaues diagnostisches Urteil zu fällen. Hierbei wird die Unsicherheit von Testergebnissen, die durch Messfehler entstehen können, besonders hervorgehoben.

Dies wird anhand eines Beispiels aus der Intelligenzdiagnostik verdeutlicht: Ein Schüler erzielt 75 IQ-Punkte, was eine Empfehlung für den Besuch einer Förderschule rechtfertigen könnte. Doch ohne Berücksichtigung des Messfehlers könnte das Urteil voreilig und potenziell ungenau sein.

Standardmessfehler (SEM)

Ein zentrales Konzept ist der Standardmessfehler (SEM), der die Unsicherheit eines Testergebnisses quantifiziert. Der SEM lässt sich anhand der Standardabweichung und der Reliabilität des Tests berechnen:

Diese Größe gibt Aufschluss darüber, wie stark der beobachtete Wert vom wahren Wert abweichen könnte.

Die Formel folgt aus dem Grundmodell der Klassischen Testtheorie. Ein beobachteter Wert setzt sich aus dem wahren Wert \tau und einem Fehler \varepsilon zusammen, und die Varianzen addieren sich: Var(X) = Var(\tau) + Var(\varepsilon). Die Reliabilität ist der Anteil der wahren Varianz, Rel(X) = Var(\tau) / Var(X). Daraus ergibt sich Var(\varepsilon) = (1 – Rel(X)) \cdot Var(X). Der SEM ist die Wurzel dieser Fehlervarianz, also die Standardabweichung des Fehleranteils.

Der SEM in Zahlen

Auf der IQ-Skala mit einer Standardabweichung von 15 ergeben sich diese Werte:

ReliabilitätStandardmessfehler
.806,7 Punkte
.904,7 Punkte
.953,4 Punkte
.991,5 Punkte

Je reliabler der Test, desto kleiner der Messfehler. Selbst bei einer Reliabilität von .99 bleibt eine Restunsicherheit von 1,5 Punkten.

Konfidenzintervall für einen Testwert

Konfidenzintervalle bieten eine Möglichkeit, die Unsicherheit zu visualisieren. Ein Konfidenzintervall zeigt den Bereich, in dem der wahre Wert mit einer bestimmten Wahrscheinlichkeit liegt. In der Diagnostik werden diese Intervalle genutzt, um die Interpretation von Testergebnissen abzusichern.

Für den Testwert einer einzelnen Person berechnen wir:

Erklärung der Formel:

  • X: beobachteter Testwert der Person
  • z: kritischer Wert aus der Standardnormalverteilung (für 95 % liegt z bei 1,96)
  • SEM: Standardmessfehler des Tests

Zur Interpretation: Würde man viele solche Intervalle berechnen, wäre bei 95 % davon der wahre Wert enthalten. Die Formel zentriert das Intervall um den beobachteten Wert, das ist die einfache Variante.

Davon zu unterscheiden ist das Intervall für einen Stichprobenmittelwert, \bar{X} \pm z \cdot s / \sqrt{n}. Es beschreibt, wie genau ein Mittelwert den Mittelwert der Population trifft, und hängt von der Stichprobengröße n ab. Die Messgenauigkeit des Testwerts einer einzelnen Person erfasst allein der SEM.

Beispiel: IQ 75

Der Schüler aus dem Einstieg erreicht 75 IQ-Punkte, die Standardabweichung des Tests beträgt 15.

ReliabilitätSEM95-%-Intervall
.953,468 bis 82
.904,766 bis 84

Bei einer Reliabilität von .95 liegt der wahre Wert mit 95 % Sicherheit zwischen 68 und 82, bei .90 zwischen 66 und 84. Der Wert 75 ist ein Punkt in dieser Spanne.

Wenn der Grenzwert im Intervall liegt

Angenommen, die Entscheidung hängt an einer Grenze bei IQ 70. Beide Intervalle enthalten Werte unter und über 70. Aus dem Testwert allein lässt sich dann nicht sagen, auf welcher Seite der Grenze der wahre Wert liegt. Wer um eine feste Grenze entscheidet, prüft deshalb, ob das Intervall die Grenze einschließt.

Ein extremer Einzelwert enthält außerdem einen Anteil zufälligen Fehlers. Bei einer Wiederholung liegt der Wert im Mittel näher am Durchschnitt (siehe den Beitrag „Diagnostische Entscheidungen, Fehler und Prognosen“).

Rechnen in R

sem <- 15 * sqrt(1 - .95)       # 3.35
sem
75 + c(-1, 1) * 1.96 * sem      # 68.4 81.6

Wie sich Prozentränge, T-Werte und IQ-Werte ineinander umrechnen und wie das Intervall auf diese Skalen übertragen wird, zeigt der Beitrag „Normierung und diagnostische Standardwerte“.

Praxisbezug

In der Praxis bedeutet dies, dass Diagnostiker*innen immer die Unsicherheit von Testergebnissen berücksichtigen sollten, insbesondere wenn die Ergebnisse wichtige Entscheidungen beeinflussen, wie z. B. die Schullaufbahn eines Kindes oder die Therapie eines Patienten. Ein einzelner Testwert ist kein exakter Befund, er ist eine Schätzung mit Spielraum.

Fragen zur Vertiefung

  1. Ein Test auf der T-Wert-Skala (Standardabweichung 10) hat eine Reliabilität von .90. Berechne den Standardmessfehler.
  2. Eine Person erreicht einen T-Wert von 62. Gib das 95-%-Intervall an. Schließt es den Wert 60 ein?
  3. Wie ändert sich das Intervall, wenn die Reliabilität auf .95 steigt?
  4. Warum darf man bei einem Wert knapp über einer Grenze nicht automatisch auf einen wahren Wert über der Grenze schließen?
  5. Wie erklärst du einer Lehrerin das Konfidenzintervall in einfachen Worten?