Analytik
Statistik für kleine Stichproben
Viele Versuchsaufbauten in der Grundlagenforschung liefern nur wenige Messwerte pro Bedingung — aus Kosten-, Zeit- oder Materialgründen. Für diese kleinen Stichproben gelten andere statistische Regeln als für die großen Kollektive, für die viele Standardverfahren ursprünglich entwickelt wurden.
Warum kleine Stichproben besondere Vorsicht erfordern
Viele gängige statistische Tests setzen implizit eine Normalverteilung der Daten voraus — bei großen Stichproben lässt sich diese Annahme meist gut prüfen, bei kleinen Stichproben von drei bis fünf Werten ist eine verlässliche Prüfung auf Normalverteilung praktisch nicht möglich.
Kleine Stichproben sind zudem deutlich anfälliger für den Einfluss einzelner Ausreißerwerte — ein einziger untypischer Messwert kann bei fünf Datenpunkten das Ergebnis stärker verzerren als bei fünfzig, wo sich ein Ausreißer eher in der Gesamtverteilung verliert.
Geeignete Testverfahren
Nichtparametrische Tests, die keine Normalverteilung voraussetzen — etwa der Mann-Whitney-U-Test für zwei unabhängige Gruppen —, sind bei kleinen Stichproben oft die robustere Wahl gegenüber parametrischen Tests wie dem t-Test, deren Voraussetzungen bei wenigen Datenpunkten nicht zuverlässig geprüft werden können.
Exakte Tests, die die tatsächliche Verteilung der möglichen Ergebnisse bei der gegebenen Stichprobengröße direkt berechnen statt sie durch eine Näherung abzuschätzen, sind bei sehr kleinen Stichproben präziser als asymptotische Verfahren, die für große Stichproben entwickelt wurden.
Warum Effektstärke wichtiger wird als reine Signifikanz
Bei kleinen Stichproben ist die statistische Power — die Fähigkeit, einen tatsächlich vorhandenen Effekt zu erkennen — begrenzt, weshalb ein nicht-signifikantes Ergebnis nicht automatisch bedeutet, dass kein Effekt vorliegt, sondern auch schlicht bedeuten kann, dass die Stichprobe zu klein war, um ihn zuverlässig nachzuweisen.
Die Angabe der Effektstärke zusätzlich zum reinen Signifikanzwert liefert deshalb bei kleinen Stichproben zusätzliche, wichtige Information — sie zeigt die Größenordnung eines beobachteten Unterschieds unabhängig davon, ob er die Signifikanzschwelle erreicht hat oder nicht.
Praktische Konsequenzen für die Versuchsplanung
Wo immer möglich, ist eine größere Stichprobe der statistisch robustere Weg — bei begrenztem Material oder Budget ist jedoch eine bewusste, transparente Entscheidung für ein geeignetes Verfahren wichtiger als der unreflektierte Einsatz eines Standardtests, dessen Voraussetzungen nicht erfüllt sind.
Eine vorab geplante Teststrategie, statt eine Methode nachträglich passend zum gewünschten Ergebnis auszuwählen, ist bei kleinen Stichproben besonders wichtig, weil die begrenzte Datenmenge wenig Spielraum für nachträgliche Anpassungen ohne Verzerrung des Ergebnisses lässt.
Woran sich das im Katalog ablesen lässt
Der Katalog führt derzeit 69 Referenzmaterialien in 9 Materialgruppen, mit 122 einzeln dokumentierten Chargen. Für jede dieser Chargen ist eine eigene Seite erreichbar, die Prüfmethode, Messwert, Spezifikation und Prüfdatum je Parameter ausweist — ohne Konto und vor der Kaufentscheidung einsehbar.
Bei 44 der 69 Materialien sind CAS-Nummer, Summenformel, Molekülmasse und Sequenz gegen öffentliche chemische Datenbanken abgeglichen. Die übrigen sind gekennzeichnet, weil sich mindestens ein Referenzwert dort nicht eindeutig belegen lässt — bei Gemischen, Polypeptidfraktionen und rekombinanten Proteinen ist das der Normalfall. Eine Kennzeichnung ist hier die ehrlichere Angabe als eine Zahl, die niemand nachprüfen kann.
Einordnung
Kleine Stichproben verlangen andere statistische Werkzeuge als große Kollektive — nichtparametrische und exakte Tests statt Standardverfahren, und Effektstärke als notwendige Ergänzung zur reinen Signifikanz.
Research Use Only. Alle im Katalog geführten Materialien sind ausschließlich für die wissenschaftliche Laborforschung bestimmt. Sie sind keine Arzneimittel, keine Lebensmittel und keine Kosmetika und nicht zur Anwendung am oder im menschlichen oder tierischen Körper bestimmt.
Häufige Fragen
Warum sind Standardtests bei kleinen Stichproben problematisch?
Weil sie oft eine Normalverteilung voraussetzen, die sich bei wenigen Datenpunkten nicht verlässlich prüfen lässt, und weil einzelne Ausreißer das Ergebnis stärker verzerren.
Welche Tests eignen sich besser für kleine Stichproben?
Nichtparametrische Tests wie der Mann-Whitney-U-Test sowie exakte Tests, die die tatsächliche Verteilung statt einer Näherung berechnen.
Warum ist Effektstärke bei kleinen Stichproben besonders wichtig?
Weil ein nicht-signifikantes Ergebnis bei begrenzter statistischer Power auch schlicht bedeuten kann, dass die Stichprobe zu klein war — die Effektstärke liefert zusätzliche Information dazu.