01 / Słownik statystyki
Statystyka,
wytłumaczona po ludzku.
Jasne, rzetelne wyjaśnienia pojęć statystycznych — z naciskiem na interpretację wyników. Najpierw rozumiesz, co liczba oznacza, potem sięgasz po test.
29
haseł uporządkowanych w 5 obszarach — od miar i rozkładów po rzetelność i trafność.
14 haseł
- Kurtoza Kurtoza to miara kształtu rozkładu opisująca grubość ogonów i wysmukłość szczytu — mówi, jak bardzo wartości skupiają się w centrum lub rozpraszają w ogonach w porównaniu z rozkładem normalnym.
- Kwartyle Kwartyle to trzy wartości (Q1, Q2, Q3) dzielące uporządkowany zbiór danych na cztery równoliczne części, przy czym Q2 jest równocześnie medianą, a różnica Q3 − Q1 tworzy rozstęp międzykwartylowy opisujący środkowe 50% obserwacji.
- Mediana Mediana to wartość środkowa w szeregu danych uporządkowanych rosnąco — połowa obserwacji jest od niej mniejsza, połowa większa.
- Moda (dominanta) Moda (dominanta) to wartość lub kategoria, która w zbiorze danych pojawia się najczęściej — jedyna miara tendencji centralnej możliwa do stosowania dla danych nominalnych.
- Odchylenie standardowe Odchylenie standardowe to miara rozproszenia wyników wokół średniej — im wyższe, tym bardziej zróżnicowana jest badana cecha w próbie.
- Przedział ufności Przedział ufności to zakres wartości wyznaczony z danych próby, który — przy wielokrotnym powtarzaniu badania tą samą procedurą — zawierałby prawdziwy parametr populacyjny w określonym odsetku przypadków (np. 95%).
- Rozkład normalny Rozkład normalny (Gaussa) to symetryczny, dzwonowaty rozkład prawdopodobieństwa w pełni opisywany przez średnią (μ) i odchylenie standardowe (σ), będący założeniem wielu testów statystycznych.
- Rozstęp Rozstęp to różnica między wartością maksymalną a minimalną w zbiorze danych — najprostsza miara rozproszenia, wysoce wrażliwa na wartości odstające.
- Skośność Skośność to miara asymetrii rozkładu — wartość dodatnia oznacza dłuższy ogon po prawej stronie (skośność prawostronna), ujemna po lewej (skośność lewostronna), a wartość bliska 0 wskazuje na rozkład symetryczny.
- Średnia (arytmetyczna) Średnia arytmetyczna to suma wszystkich wartości w zbiorze podzielona przez liczbę obserwacji — najczęściej stosowana miara tendencji centralnej, wrażliwa na wartości odstające.
- Wariancja Wariancja to średnia kwadratów odchyleń poszczególnych obserwacji od średniej arytmetycznej — miara rozproszenia danych, wyrażona w jednostkach podniesionych do kwadratu.
- Wartość oczekiwana Wartość oczekiwana E(X) zmiennej losowej to teoretyczna średnia jej rozkładu — dla zmiennej dyskretnej suma iloczynów możliwych wartości i ich prawdopodobieństw. Opisuje przeciętny wynik, jakiego należy się spodziewać w długiej serii powtórzeń.
- Współczynnik zmienności Współczynnik zmienności (CV) to względna miara rozproszenia: iloraz odchylenia standardowego i średniej, wyrażony w procentach. Jest bezwymiarowy, więc pozwala porównywać zróżnicowanie zmiennych mierzonych w różnych jednostkach lub skalach.
- Wykres skrzynkowy (boxplot) Wykres skrzynkowy (boxplot) to graficzne podsumowanie pięciu statystyk — minimum, Q1, mediany, Q3 i maksimum — w którym prostokąt obejmuje środkowe 50% danych, linia wewnątrz zaznacza medianę, a wąsy sięgają do granic wyznaczonych przez kryterium Tukeya.
7 haseł
- ANOVA ANOVA (analiza wariancji) to test statystyczny porównujący średnie w trzech lub więcej grupach poprzez stosunek wariancji między grupami do wariancji wewnątrz grup.
- Istotność statystyczna (p-value) Wartość p (p-value) to prawdopodobieństwo uzyskania wyników co najmniej tak skrajnych jak zaobserwowane, przy założeniu, że hipoteza zerowa jest prawdziwa.
- Test chi-kwadrat Test chi-kwadrat to test statystyczny sprawdzający, czy istnieje związek między dwiema zmiennymi kategorialnymi, poprzez porównanie częstości obserwowanych z częstościami oczekiwanymi przy założeniu niezależności.
- Test Kruskala-Wallisa Test Kruskala-Wallisa to nieparametryczny test statystyczny porównujący trzy lub więcej niezależnych grup na podstawie rang — stosowany zamiast jednoczynnikowej ANOVA, gdy dane nie spełniają założenia normalności lub mają charakter porządkowy.
- Test Shapiro-Wilka Test Shapiro-Wilka to test statystyczny sprawdzający, czy rozkład danych w próbie pochodzi z rozkładu normalnego — stosowany przed analizami parametrycznymi jako weryfikacja założenia normalności.
- Test t-Studenta Test t-Studenta to test statystyczny służący do porównania średnich w dwóch grupach lub do sprawdzenia, czy średnia próby różni się od określonej wartości teoretycznej.
- Test U Manna-Whitneya Test U Manna-Whitneya to nieparametryczny test statystyczny porównujący dwie niezależne grupy na podstawie rang — stosowany zamiast testu t-Studenta, gdy dane nie spełniają założenia normalności lub mają charakter porządkowy.
5 haseł
- Analiza czynnikowa Analiza czynnikowa to technika redukcji danych, która sprowadza wiele skorelowanych zmiennych do mniejszej liczby ukrytych (latentnych) czynników, wyjaśniających wspólne wzorce współzmienności. Służy do odkrywania lub potwierdzania struktury kwestionariuszy i skal.
- Korelacja Pearsona Korelacja Pearsona (r) mierzy siłę i kierunek liniowego związku między dwiema zmiennymi ciągłymi; przyjmuje wartości od −1 (doskonała zależność ujemna) do +1 (doskonała zależność dodatnia), a r = 0 oznacza brak związku liniowego — nie wyklucza jednak związków nieliniowych.
- Korelacja Spearmana Korelacja Spearmana (ρ lub r_s) to nieparametryczny miernik siły i kierunku monotonicznego związku między dwiema zmiennymi — oblicza się ją na rangach, a nie na surowych wartościach, przez co jest odporna na skrajne obserwacje i stosowana przy danych porządkowych lub nienormalnie rozłożonych.
- Regresja liniowa Regresja liniowa to metoda statystyczna opisująca liniową zależność między zmienną wynikową a jedną lub kilkoma zmiennymi predykcyjnymi za pomocą równania, które pozwala przewidywać wartości i oceniać siłę związku.
- Regresja logistyczna Regresja logistyczna to model przewidujący prawdopodobieństwo wyniku dwukategorialnego (0/1) na podstawie predyktorów. Modeluje logarytm szansy (logit), a jej współczynniki przeliczone przez funkcję wykładniczą dają iloraz szans (OR), opisujący zmianę szansy zdarzenia.
2 hasła
- Hipoteza badawcza Hipoteza badawcza to precyzyjne, testowalne i falsyfikowalne przewidywanie dotyczące związku między zmiennymi, wyprowadzone z teorii, które jest następnie przekładane na hipotezy statystyczne (H₀ i H₁) i weryfikowane za pomocą odpowiedniego testu statystycznego.
- Zmienna zależna i niezależna Zmienna niezależna (X) to czynnik, który badacz manipuluje lub obserwuje jako potencjalną przyczynę, a zmienna zależna (Y) to mierzony wynik, który ma odzwierciedlać efekt tego czynnika — rozróżnienie to jest fundamentem planowania badań i właściwego doboru analiz statystycznych.
→ / Wsparcie
Hasło to za mało?
Przejdźmy przez Twoje dane.
Gdy potrzebujesz nie definicji, a kogoś, kto pomoże dobrać test i zinterpretować wynik — napisz. Doradzam metodologicznie, krok po kroku.