→ / Miary i rozkłady
Moda (dominanta)
Czym jest moda (dominanta)
Moda (inaczej dominanta) to wartość, która w zbiorze danych występuje najczęściej. Nie wymaga żadnych operacji arytmetycznych — wystarczy policzyć, która kategoria lub liczba ma największą częstość bezwzględną.
Moda jest jedyną miarą tendencji centralnej, którą można sensownie zastosować do danych nominalnych (np. płeć, wykształcenie, kolor oczu). Średnia i mediana wymagają przynajmniej skali porządkowej; moda nie stawia żadnych wymagań poziomowi pomiaru.
Kilka ważnych właściwości:
- Zbiór może nie mieć mody — jeśli każda wartość pojawia się tyle samo razy.
- Zbiór może mieć więcej niż jedną modę — bimodalne (dwie mody) lub multimodalne (wiele mód) rozkłady są możliwe i merytorycznie istotne (np. sugerują dwie podgrupy w badanej populacji).
- Moda nie musi leżeć w centrum rozkładu — przy skośnych rozkładach może być daleko od średniej i mediany.
Kiedy używać
| Poziom pomiaru | Czy moda jest odpowiednia? |
|---|---|
| Nominalny (np. kategorie, etykiety) | Tak — jedyna możliwa miara tendencji centralnej |
| Porządkowy (np. Likert 1–5) | Tak — uzupełnia medianę |
| Interwałowy / ilorazowy | Tak, ale rzadziej; średnia i mediana są zazwyczaj informatywniejsze |
Stosuj modę, gdy chcesz wskazać najczęstszą odpowiedź w kwestionariuszu, najpopularniejszą kategorię w danych demograficznych lub dominujący wariant w analizie jakościowej.
Dla danych ciągłych (np. wzrost w cm) moda traci praktyczny sens bez uprzedniego pogrupowania w przedziały (binning) — np. sprawdzamy, w którym przedziale (165–170 cm) jest najwięcej obserwacji.
Jak interpretować
Interpretacja mody jest prosta i bezpośrednia: „Najczęściej wskazywaną odpowiedzią było X (n = k, Y%)”. Podaj zawsze liczbę i procent obserwacji przypadających na modę — sama nazwa kategorii bez liczebności jest niepełna.
Przy rozkładzie bimodalnym sygnalizuj to explicite: może sugerować dwie odrębne subpopulacje lub pytanie, które respondenci rozumieli dwojako.
Przykład
Dane nominalne: W badaniu preferencji zawodowych (n = 40) uczestnicy wskazali preferowaną formę pracy:
| Forma pracy | Liczba wskazań |
|---|---|
| Praca zdalna | 18 |
| Praca hybrydowa | 15 |
| Praca stacjonarna | 7 |
Moda = praca zdalna (18 wskazań, 45%). Nie można tu policzyć średniej ani mediany — to dane nominalne.
Dane liczbowe (bimodalne): Wyniki krótkiego testu (10 pkt) w grupie 9 studentów:
3, 5, 5, 6, 7, 7, 8, 9, 9
Wartości 5, 7 i 9 pojawiają się po dwa razy. Rozkład jest trimodalny: mody = 5, 7, 9. Sugeruje to, że wyniki skupiły się w trzech skupiskach — warto sprawdzić, czy nie ma podgrup (np. osoby przygotowane vs. nieprzygotowane).
Typowe błędy
- Założenie, że jest zawsze jedna moda — sprawdź wszystkie częstości; rozkład multimodalny jest informatywną informacją, nie błędem.
- Stosowanie mody do ciągłych danych bez grupowania — przy 100 pomiarach wzrostu każda wartość może być unikalna i żadna „moda” nie ma sensu bez przedziałów.
- Pomijanie mody przy danych nominalnych — niektóre prace podają tylko liczebności tabelarycznie, nie wskazując explicite dominanty; recenzent może to uznać za przeoczenie.
- Mylenie mody z medianą — moda to najczęstsza wartość, mediana to środkowa; mogą być zupełnie różne.
Potrzebujesz pomocy z opisem statystycznym?
Pomogę opisać rozkłady, mody i częstości w sposób gotowy do wklejenia w pracę lub raport badawczy. Zobacz usługi →
▶ / Pobaw się