Vierfeldertafel-Rechner: Sensitivität, Spezifität, Odds Ratio und NNT
Tragen Sie die vier Felder Ihrer Kreuztabelle ein. Der Rechner liefert je nach Fragestellung die Gütekriterien eines diagnostischen Tests oder die Effektmaße eines Gruppenvergleichs, jeweils mit Konfidenzintervall. Alle Eingaben bleiben in Ihrem Browser und werden nicht übertragen.
| Summe | |||
|---|---|---|---|
| Summe |
So lesen Sie die Ergebnisse
- Sensitivität und Spezifität beschreiben den Test unabhängig davon, wie häufig die Erkrankung ist. Positiver und negativer prädiktiver Wert hängen dagegen von der Prävalenz in Ihrer Stichprobe ab und lassen sich nur übertragen, wenn die Stichprobe die Zielpopulation abbildet. In Fall-Kontroll-Studien sind sie nicht interpretierbar.
- Likelihood-Ratios zeigen, wie stark ein positives (LR+) oder negatives (LR−) Ergebnis die Wahrscheinlichkeit der Erkrankung verändert. Als grobe Orientierung gelten LR+ über 10 und LR− unter 0,1 als aussagekräftig.
- Odds Ratio und relatives Risiko sind nicht dasselbe. Bei seltenen Ereignissen liegen sie nahe beieinander, bei häufigen Ereignissen überschätzt das Odds Ratio den Effekt.
- NNT (number needed to treat) ist der Kehrwert der absoluten Risikoreduktion. Umfasst das Konfidenzintervall der Risikodifferenz die Null, ist das NNT-Intervall unbestimmt und wird als „NNT … bis ∞ bis NNH …“ angegeben.
- Fisher-Test oder Chi-Quadrat? Sind erwartete Häufigkeiten kleiner als 5, ist der exakte Test nach Fisher vorzuziehen.
- Leere Felder: Enthält eine Zelle den Wert 0, werden Odds Ratio, relatives Risiko und Likelihood-Ratios mit der Korrektur nach Haldane und Anscombe (0,5 in alle vier Zellen) berechnet. Der Rechner weist darauf hin.
Formeln und Quellen
- Konfidenzintervalle für Anteile: Wilson-Score-Intervall (Wilson 1927; Newcombe 1998, Stat Med 17:857) oder exaktes Intervall nach Clopper und Pearson (Biometrika 1934).
- Odds Ratio: Logit-Methode nach Woolf (Ann Hum Genet 1955). Relatives Risiko: logarithmische Methode nach Katz et al. (Biometrics 1978).
- Likelihood-Ratios: Intervalle nach Simel, Samsa und Matchar (J Clin Epidemiol 1991).
- Risikodifferenz: Hybrid-Score-Intervall nach Newcombe (Stat Med 1998;17:873). NNT-Intervall: Altman, BMJ 1998;317:1309.
- Tests: Chi-Quadrat nach Pearson ohne Kontinuitätskorrektur; Fisher-Test zweiseitig (Summe aller Tabellen mit nicht größerer Wahrscheinlichkeit als die beobachtete).
- Prüfung: Die Berechnungen wurden gegen Python (SciPy, statsmodels) verglichen, und zwar an rund 160 Zufallstabellen (je drei Konfidenzniveaus) sowie 600 Anteilen und 300 Mittelwertvergleichen; die Abweichungen liegen unter 10−10. Auch das Lehrbuchbeispiel eines Stuhltests (20/180/10/1820) wird reproduziert.
Haftungshinweis: Der Rechner dient der Orientierung und ersetzt keine Statistikberatung. Für Ergebnisse, die Sie in Arbeiten, Anträgen oder Publikationen verwenden, tragen Sie die Verantwortung; lassen Sie diese bei Fragen von Ihrer Biometrie- oder Statistikberatung gegenprüfen.