Praktyki w poradni, trzeci tydzień. Opiekunka pokazuje Ci zanonimizowany raport z badania i pyta: „Co tu widzisz?”. Patrzysz na rząd liczb: wyniki T, steny, jakieś nawiasy z przedziałami. Wiesz, co oznaczają te skróty, ale nie wiesz, od czego zacząć czytanie. To bardzo częsta sytuacja i dobry moment, żeby uporządkować wiedzę. Jak interpretować wyniki testów psychologicznych? Nie zaczyna się od liczby, tylko od pytania, z kim tę liczbę porównujemy i jak dokładnie ją zmierzono. Ten tekst prowadzi przez normy, wyniki standaryzowane i przedział ufności na jednym fikcyjnym, szkoleniowym przykładzie. Uczy czytać raport ze zrozumieniem. Interpretacja wyników realnych osób należy do psychologa.
Dlaczego wynik surowy sam w sobie nic nie mówi?
Wynik surowy to liczba punktów albo poprawnych odpowiedzi. Sam w sobie nie mówi, czy to dużo, czy mało. Dwadzieścia punktów może być wynikiem wysokim w trudnym teście i niskim w łatwym. Dlatego wynik surowy przelicza się na wynik przeliczony, który pokazuje pozycję osoby na tle grupy normalizacyjnej, czyli osób, na których zebrano normy.
Kluczowe pytanie brzmi więc: jakie to są normy? Wyróżnia się:
- normy ogólne, dla szerokiej populacji w danym przedziale wieku,
- normy specyficzne, dla węższych grup, na przykład według wieku, płci czy wykształcenia,
- normy kliniczne, dla osób z określonym rozpoznaniem,
- normy lokalne, tworzone przez instytucję dla własnych potrzeb.
Ten sam wynik w kwestionariuszu objawów może być wysoki na tle populacji ogólnej i przeciętny na tle osób leczonych w poradni. Dlatego w każdym raporcie podaje się, jakimi normami się posłużono.
Jak ocenić, czy normy pasują do osoby badanej?
Zanim cokolwiek zinterpretujesz, zadaj trzy pytania o grupę normalizacyjną:
- Czy jest reprezentatywna? Czy odpowiada populacji, z której pochodzi osoba badana, pod względem wieku, wykształcenia, miejsca zamieszkania?
- Czy jest wystarczająco liczna w podgrupie, z którą porównujesz osobę, a nie tylko w całości?
- Czy jest aktualna? Normy się starzeją. W testach zdolności znany jest efekt Flynna: przeciętne wyniki rosły z pokolenia na pokolenie, więc zbyt stare normy zawyżają wyniki współczesnych badanych.
Do tego dochodzi adaptacja kulturowa. Testu z innego kraju nie wystarczy przetłumaczyć. Potrzebne są badania równoważności, rzetelności i trafności oraz nowe normy dla nowej populacji.
Właśnie tak, od norm do opisu wyniku, uczy moduł o normach i interpretacji w kursie „Psychometria dla studenta psychologii”. Wszystkie przykłady są tam fikcyjne i liczone krok po kroku.
Jak interpretować wyniki testów psychologicznych w skalach standardowych?
Skale standardowe różnią się średnią i odchyleniem standardowym, ale mówią o tym samym: o ile odchyleń standardowych wynik jest oddalony od średniej grupy normalizacyjnej. Warto znać je na pamięć:
- skala z: średnia 0, odchylenie standardowe 1,
- skala T: średnia 50, odchylenie standardowe 10,
- skala stenowa: średnia 5,5, odchylenie standardowe 2, dziesięć przedziałów,
- skala staninowa: średnia 5, odchylenie standardowe 2, dziewięć przedziałów,
- skala ilorazu dewiacyjnego: średnia 100, odchylenie standardowe 15,
- centyle: mówią, jaki odsetek osób z grupy odniesienia uzyskał wynik niższy.
Dwie pułapki, które często pojawiają się na egzaminie. Po pierwsze, centyl to pozycja wśród ludzi, a nie odsetek rozwiązanych zadań. Po drugie, centyle nie mają równych odstępów: w środku rozkładu niewielka zmiana wyniku przesuwa osobę o wiele centyli, a na krańcach o niewiele.
Opis słowny wyników jest umowny i zależy od podręcznika testu. Często spotyka się podział stenów na wyniki niskie, przeciętne i wysokie, na przykład od jednego do trzech, od czterech do siedmiu i od ośmiu do dziesięciu. Niektóre podręczniki stosują węższy zakres przeciętny. Zawsze więc trzymaj się zasad z podręcznika konkretnego narzędzia.
Czym jest przedział ufności dla wyniku i jak go policzyć?
Każdy pomiar zawiera błąd. Według klasycznej teorii testów wynik otrzymany to suma wyniku prawdziwego i błędu. Błąd standardowy pomiaru mówi, jak duży jest ten błąd przeciętnie. Liczy się go tak: odchylenie standardowe skali razy pierwiastek z jeden minus rzetelność.
Na tej podstawie buduje się przedział ufności dla wyniku, czyli zakres, w którym z określonym prawdopodobieństwem leży wynik prawdziwy osoby. Dla poziomu ufności 0,95 mnoży się błąd standardowy pomiaru przez 1,96 i odkłada w obie strony od wyniku.
Najważniejsze wnioski praktyczne:
- im niższa rzetelność, tym szerszy przedział i tym ostrożniejsza interpretacja,
- wynik bliski granicy kategorii, na przykład między przeciętnym a wysokim, może w rzeczywistości leżeć po każdej z jej stron,
- wąski przedział mówi o precyzji pomiaru, ale nie o tym, czy test mierzy właściwą cechę.
Jak interpretować wyniki testów psychologicznych krok po kroku na przykładzie?
Przykład jest fikcyjny i szkoleniowy. Kwestionariusz ma dwie skale wyrażone w skali T. Skala A ma rzetelność 0,96, skala B ma rzetelność 0,88. Osoba uzyskała w skali A wynik 58, a w skali B wynik 49.
Krok pierwszy: normy. Sprawdzamy, czy normy dotyczą osób w podobnym wieku i czy są aktualne. Bez tego nie idziemy dalej.
Krok drugi: pozycja wyniku. Wynik T równy 58 to wynik z równy 0,8, czyli osiem dziesiątych odchylenia standardowego powyżej średniej. W stenach daje to 5,5 plus 1,6, czyli 7,1, po zaokrągleniu sten 7. Przy rozkładzie normalnym to mniej więcej siedemdziesiąty dziewiąty centyl.
Krok trzeci: przedział ufności. Błąd standardowy pomiaru skali A to 10 razy pierwiastek z 0,04, czyli 10 razy 0,2, co daje 2. Przemnożony przez 1,96 daje 3,92. Przedział wynosi od 54,08 do 61,92, w zaokrągleniu od 54 do 62. Przedział obejmuje granicę między wynikami przeciętnymi a podwyższonymi, więc opis brzmiałby ostrożnie: wynik przeciętny lub nieco podwyższony.
Krok czwarty: porównanie skal. Czy różnica między skalami A i B jest większa, niż mógłby dać sam błąd pomiaru? Błąd standardowy różnicy to 10 razy pierwiastek z dwa minus obie rzetelności. Dwa minus 0,96 minus 0,88 daje 0,16, pierwiastek to 0,4, więc błąd różnicy wynosi 4. Próg dla poziomu ufności 0,95 to 1,96 razy 4, czyli 7,84. Różnica wyników to 58 minus 49, czyli 9. Jest większa od progu, więc można ją uznać za istotną statystycznie.
Krok piąty: integracja. Liczby nie zastępują rozmowy. Psycholog zestawia wynik z wywiadem, obserwacją i kontekstem zgłoszenia, a dopiero potem formułuje wnioski.
Krok szósty: przekazanie wyniku. Osoba badana ma prawo do informacji o wynikach w języku, który rozumie. Zamiast „sten 7 w skali A” psycholog powie raczej, że w tym obszarze osoba opisuje siebie podobnie jak większość ludzi albo nieco wyraźniej niż przeciętnie, i wyjaśni, co z tego wynika dla pytania, z którym przyszła. Dobra informacja zwrotna obejmuje też mocne strony, a nie tylko trudności. Sama liczba bez komentarza bywa źle rozumiana i może niepotrzebnie niepokoić.
Do takich przeliczeń przydaje się ściągawka skal standardowych z wzorami i przykładem przeliczenia, dołączona do kursu psychometrii. Błędowi standardowemu pomiaru i porównywaniu dwóch wyników poświęcona jest osobna lekcja w module o rzetelności. Zobacz program kursu psychometrii
Jakie błędy popełnia się najczęściej przy interpretacji wyników?
- Traktowanie wyniku jak dokładnej liczby. Każdy wynik to oszacowanie z przedziałem błędu.
- Pomijanie pytania o normy. Wynik porównany z niewłaściwą grupą może wprowadzić w błąd.
- Nadinterpretacja profilu. Różnice między podtestami bywają mniejsze niż błąd pomiaru, a wyniki podtestów są zwykle mniej rzetelne niż wynik ogólny.
- Mylenie centyla z odsetkiem poprawnych odpowiedzi.
- Opieranie decyzji na jednym wyniku. Test to jeden z elementów diagnozy.
- Etykietowanie. W komunikacji z osobą badaną mówi się opisowo i zrozumiale, bez samych liczb i bez żargonu.
Jeśli chcesz przećwiczyć same obliczenia, sięgnij po zadania i przykłady z psychometrii. Przegląd narzędzi, których wyniki się interpretuje, znajdziesz w tekście testy psychologiczne: rodzaje i zastosowanie, a podstawy jakości pomiaru w artykule o tym, czym różnią się rzetelność i trafność.
Co wolno studentowi w interpretacji wyników?
Student uczy się interpretacji na danych fikcyjnych, na zajęciach i na praktykach, pod opieką psychologa. Może omawiać zanonimizowane raporty z opiekunem i ćwiczyć opis wyników. Nie interpretuje samodzielnie wyników realnych osób i nie przekazuje ich badanym, bo interpretacja wyników testów psychologicznych w diagnozie to zadanie psychologa. Ustawa o zawodzie psychologa zalicza diagnozę psychologiczną do czynności zawodowych psychologa. Te granice nie umniejszają nauki, tylko pozwalają uczyć się bezpiecznie.
Gdzie nauczyć się interpretacji wyników na spokojnie?
Kurs prowadzi od klasycznej teorii testów do czytania podręcznika testu, więc interpretacja wyników testów psychologicznych przestaje być zbiorem wzorów, a staje się sposobem myślenia. Kurs jest dostępny w planie Student.
- 10 modułów i 40 lekcji, łącznie 30 godzin materiału,
- moduł o normach: rodzaje norm, skale standardowe, przeliczanie wyników, aktualność i adaptacja,
- lekcja o błędzie standardowym pomiaru i przedziale ufności dla wyniku liczonym krok po kroku,
- karta oceny podręcznika testu i zbiór pytań oraz zadań egzaminacyjnych z rozwiązaniami.
Zacznij naukę interpretacji wyników z kursem
Najczęściej zadawane pytania
Od czego zacząć interpretację wyniku testu?
Od sprawdzenia, z jaką grupą porównywany jest wynik, czyli jakie normy zastosowano. Dopiero potem odczytuje się pozycję wyniku, przedział ufności i porównuje skale.
Co oznacza wynik w skali T?
Pokazuje pozycję wyniku względem grupy normalizacyjnej, przy średniej 50 i odchyleniu standardowym 10. Wynik 60 oznacza więc wynik o jedno odchylenie standardowe powyżej średniej.
Czym różni się sten od centyla?
Sten to wynik w skali o średniej 5,5 i odchyleniu standardowym 2, podzielonej na dziesięć przedziałów. Centyl mówi, jaki odsetek osób z grupy odniesienia uzyskał wynik niższy.
Po co podaje się przedział ufności dla wyniku?
Bo każdy pomiar zawiera błąd. Przedział pokazuje, w jakim zakresie z dużym prawdopodobieństwem leży wynik prawdziwy, co chroni przed nadinterpretacją pojedynczej liczby.
Czy różnica między dwiema skalami zawsze coś znaczy?
Nie. Trzeba sprawdzić, czy jest większa niż próg wynikający z błędu standardowego różnicy. Małe różnice mogą wynikać z samego błędu pomiaru.
Czy student może interpretować wyniki testów psychologicznych?
Samodzielnie nie. Student ćwiczy interpretację na przykładach fikcyjnych i pod opieką psychologa, a interpretacja wyników realnych osób należy do psychologa.
Dlaczego stare normy są problemem?
Bo populacja się zmienia i normy przestają ją opisywać. W testach zdolności stare normy zwykle zawyżają wyniki współczesnych badanych.
Źródła
Ostatnia aktualizacja: 10 października 2026. Artykuł ma charakter edukacyjny.