CWPCentrum Wiedzy Psychologicznej
Wszystkie teksty
Specjalista9 września 20266 min czytania

Wynik testu psychologicznego to nie fakt, tylko oszacowanie — jak go czytać rzetelnie

Wynik liczbowy z testu wygląda na fakt, ale jest oszacowaniem z marginesem błędu. Rzetelność narzędzia, dobór norm i próg wiarygodnej zmiany decydują o tym, ile można mu zaufać w opinii.

Autor: Redakcja CWP

Wynik testu psychologicznego to nie fakt, tylko oszacowanie — jak go czytać rzetelnie

Wynik testowy podany jako pojedyncza liczba wygląda na fakt. W praktyce jest oszacowaniem obarczonym błędem pomiaru, a to, ile temu oszacowaniu można ufać, zależy od rzetelności narzędzia i grupy normalizacyjnej, do której porównujesz badanego. Pomijanie tego w interpretacji to jeden z najczęstszych błędów, jakie trafiają do opinii psychologicznych — i jeden z najłatwiejszych do wyeliminowania.

Wynik to przedział, nie punkt

Każdy pomiar psychometryczny ma błąd standardowy pomiaru (SEM), wynikający z tego, że test nigdy nie mierzy w pełni rzetelnie. Wynik 95. centyla przy SEM rzędu kilku punktów standardowych oznacza realnie przedział, w którym prawdziwy wynik badanego znajduje się z określonym prawdopodobieństwem — nie jedną, precyzyjną wartość. Podawanie w opinii samej liczby, bez przedziału ufności, sugeruje precyzję, której narzędzie fizycznie nie ma. Odbiorca opinii — sąd, szkoła, rodzic — czyta liczbę dosłownie, więc to psycholog odpowiada za to, żeby nie została odczytana jako coś więcej niż jest.

Rzetelność decyduje, ile możesz zaufać pojedynczemu pomiarowi

Współczynnik rzetelności (na przykład alfa Cronbacha czy rzetelność test-retest) mówi, jak bardzo wynik badanego zmieniłby się przy powtórnym badaniu tym samym narzędziem, gdyby nic się nie zmieniło. Niska rzetelność podskali w podręczniku testu to sygnał, żeby nie budować na niej mocnych wniosków klinicznych, nawet jeśli wynik liczbowy wygląda przekonująco. Warto sprawdzać rzetelność nie tylko dla całego testu, ale osobno dla podskal, których używasz — łączna rzetelność narzędzia bywa dobra, podczas gdy pojedyncza podskala, na której opierasz kluczowy wniosek, ma rzetelność wyraźnie niższą.

Normy: do kogo faktycznie porównujesz wynik

Wynik ma sens tylko względem grupy normalizacyjnej, do której badany rzeczywiście pasuje wiekiem, czasem także wykształceniem czy regionem. Test znormalizowany dziesięć czy piętnaście lat temu, na innej populacji niż ta, z której pochodzi badany, daje wynik liczbowy, ale nie daje pewności, że ten wynik znaczy to samo dziś. Efekt Flynna — systematyczny wzrost wyników w testach zdolności poznawczych w populacji na przestrzeni dekad — sprawia, że stare normy mogą zawyżać pozycję badanego względem realnej, aktualnej populacji. Sprawdzenie roku normalizacji i wielkości próby normalizacyjnej w podręczniku testu zajmuje kilka minut i realnie wpływa na to, jak bardzo można ufać porównaniu.

Kiedy różnica między dwoma wynikami jest realna, a kiedy to szum pomiaru

Przy badaniach powtórnych — na przykład ocenie postępu terapii albo efektów interwencji — pojawia się pytanie, czy różnica między pierwszym a drugim wynikiem to realna zmiana, czy tylko wahanie pomiaru. Do tego służy wskaźnik wiarygodnej zmiany (reliable change index), który łączy błąd pomiaru obu badań i wyznacza próg, powyżej którego różnicę można uznać za rzeczywistą. Bez tego przeliczenia łatwo o dwa przeciwstawne błędy: uznanie przypadkowej fluktuacji wyniku za realną poprawę albo, odwrotnie, przeoczenie faktycznej zmiany, bo różnica liczbowa wygląda na małą.

Najczęstsze błędy interpretacyjne w opiniach

Trzy wzorce powtarzają się najczęściej. Pierwszy to traktowanie wyniku surowego jak gotowej informacji, bez przeliczenia na normy odpowiednie dla wieku badanego. Drugi to porównywanie wyników z różnych testów, jakby były na tej samej skali, mimo że różne narzędzia mierzą to samo pojęcie w różny sposób i z różną rzetelnością. Trzeci to pomijanie wskaźników wiarygodności wykonania testu — jeśli badany pracował w sposób niestandardowy, zbyt szybko, z oznakami symulacji czy dysymulacji, sam wynik liczbowy przestaje być wiarygodny, niezależnie od tego, jak dobre jest narzędzie.

Krótka checklista przed wpisaniem wyniku do opinii

Zanim liczba trafi do dokumentu, warto zadać sobie kilka pytań: czy sprawdziłeś rok i wielkość próby normalizacyjnej dla tego wyniku, czy podałeś przedział ufności lub błąd pomiaru zamiast suchej liczby, czy porównanie z wcześniejszym badaniem uwzględnia próg wiarygodnej zmiany, i czy wskaźniki wiarygodności wykonania testu nie podważają samego pomiaru. Te cztery pytania nie wymagają zaawansowanej statystyki — wymagają tylko nawyku sięgania po podręcznik testu zamiast po samą tabelę norm.

Rzetelne czytanie wyniku testowego — z całym aparatem pojęciowym: błędem pomiaru, doborem norm, wskaźnikiem wiarygodnej zmiany i wskaźnikami wiarygodności wykonania — to temat kursu Psychometria w gabinecie, gdzie każde z tych pojęć jest przećwiczone na konkretnych przypadkach liczbowych z gabinetu.

Najczęściej zadawane pytania

Czym różni się rzetelność od trafności testu psychologicznego?

Rzetelność mówi o tym, jak dokładnie i powtarzalnie test mierzy to, co mierzy, czyli na ile wynik jest wolny od przypadkowego błędu. Trafność mówi o tym, czy test rzeczywiście mierzy to, co deklaruje, i czy wnioski z wyniku są uprawnione. Test może być bardzo rzetelny, a jednocześnie mało trafny w danym zastosowaniu. Rzetelność jest warunkiem koniecznym trafności, ale jej nie gwarantuje. W praktyce warto sprawdzać oba parametry w podręczniku narzędzia dla konkretnej grupy badanych.

Jak obliczyć przedział ufności dla wyniku testu?

Przedział ufności dla wyniku testu wyznacza się na podstawie błędu standardowego pomiaru, który zależy od odchylenia standardowego wyników i współczynnika rzetelności narzędzia. Błąd standardowy oblicza się, mnożąc odchylenie standardowe przez pierwiastek z różnicy jedności i rzetelności. Dla przedziału 95 procent wynik powiększa się i pomniejsza o około dwa błędy standardowe, dokładniej 1,96. Wiele podręczników testowych podaje gotowe przedziały, a w opinii warto je raportować obok wyniku punktowego.

Co oznaczają wyniki w stenach, skali tenowej i ilorazie inteligencji?

Steny, skala tenowa i skala ilorazu inteligencji to wyniki standaryzowane, które pokazują położenie badanego względem grupy normalizacyjnej. Skala stenowa ma średnią 5,5 i odchylenie standardowe 2, skala tenowa średnią 50 i odchylenie 10, a skala ilorazowa średnią 100 i odchylenie 15. Wynik przeciętny mieści się mniej więcej w zakresie jednego odchylenia standardowego od średniej. Porównując wyniki z różnych narzędzi, trzeba sprawdzić, na jakiej skali są wyrażone i jakie normy zastosowano.

Czy można stosować test ze starymi normami?

Stosowanie testu z przestarzałymi normami jest ryzykowne, bo populacja zmienia się z czasem, a wyniki badanych są wtedy porównywane z grupą, która już jej nie odzwierciedla. Szczególnie dotyczy to testów inteligencji, w których przez dekady obserwowano systematyczne zmiany przeciętnych wyników w kolejnych pokoleniach, przez co stare normy mogą zawyżać wyniki. Nie ma jednej granicy wieku norm, ale warto wybierać najnowsze dostępne wersje i opisywać w opinii ograniczenia zastosowanych norm.

Jak opisać wynik testu w opinii psychologicznej, żeby był zrozumiały?

Wynik testu w opinii psychologicznej warto opisać w trzech warstwach: podać wynik z przedziałem ufności, określić jego położenie względem norm słownie, na przykład jako przeciętny lub niski, i odnieść go do funkcjonowania badanego oraz pytania diagnostycznego. Odbiorca opinii, na przykład szkoła, sąd czy rodzic, często czyta liczby dosłownie, więc trzeba unikać sugerowania precyzji, której narzędzie nie ma. Wnioski powinny wynikać z całości danych, a nie z pojedynczego wyniku.

Gdzie psycholog może uporządkować wiedzę z psychometrii?

Wiedzę z psychometrii psycholog porządkuje przez lekturę podręczników testowych i podręczników akademickich z psychometrii, szkolenia z interpretacji wyników oraz konsultacje z bardziej doświadczonymi diagnostami. W CWP rzetelność, dobór norm, błąd pomiaru, próg wiarygodnej zmiany i najczęstsze błędy interpretacyjne w opiniach omawia szkolenie „Psychometria w praktyce psychologa”. Uzupełnieniem jest szkolenie „Opinia psychologiczna”, poświęcone strukturze opinii i formułowaniu wniosków.

Newsletter

Nowe teksty i nowości z biblioteki CWP

Jedna wiadomość, gdy pojawi się coś wartego uwagi: nowe szkolenia i ścieżki, nowe teksty na blogu, zmiany w regulacji zawodu. Bez ofert w każdym mailu.

Powiązane szkolenia

Szkolenia, które rozwijają ten temat

Dostęp w ramach subskrypcji — bez opłat za pojedyncze szkolenie.

Blog

Przeczytaj także