목차
서랍에서 종이 한 장이 나왔습니다
집 서랍을 정리하다가 학교 때 받은 검사 결과지가 한 장 나왔습니다. 종이가 누렇게 변해 있었습니다.
숫자 하나가 적혀 있고 그 옆에 등급 같은 게 붙어 있었습니다. 좋은 쪽도 나쁜 쪽도 아닌, 딱 어중간한 값이었습니다.
근데 그 숫자를 보자마자 알아봤습니다. 십 몇 년 동안 기억하고 있었더군요.
어떤 일을 잘 못할 때마다 그 숫자가 떠올랐습니다. 아 그래서 그런가 하는 식으로요. 한 번도 의심해본 적이 없습니다.
이상한 건 이겁니다. 숫자는 십 몇 년을 남았는데, 그게 무슨 문항에서 나온 건지는 한 번도 확인해본 적이 없었습니다.
측정과 순위 매기기를 갈라 봤습니다
이 문제를 역사적으로 파고든 책이 스티븐 제이 굴드의 「인간에 대한 오해」입니다. 1981년에 나왔고 1996년에 개정판이 나왔습니다. 우리말로도 번역돼 있습니다.
굴드가 다루는 것은 지능을 재려는 시도들의 역사입니다. 그리고 그는 거기서 두 가지가 반복됐다고 정리했습니다.
하나는 실체화입니다. 추상적인 개념을 물건처럼 다루는 일입니다. 지능은 여러 능력을 묶어 부르는 이름인데, 그것을 머릿속에 들어 있는 하나의 양처럼 취급하면 이야기가 달라집니다.
다른 하나는 서열화입니다. 그렇게 만들어진 하나의 양을 놓고 사람이나 집단을 한 줄로 세우는 일이요.
굴드가 짚은 것은 이 두 단계가 붙으면 측정이 판정으로 바뀐다는 점이었습니다. 그리고 그 판정이 실제로 이민 정책이나 교육 배치 같은 결정에 쓰인 사례들을 다룹니다.
그가 특히 문제로 본 것은 순서였습니다. 결론이 먼저 있고 숫자가 나중에 온 경우들이요. 어떤 집단이 못하다는 생각이 이미 있는 상태에서 측정을 시작하면, 그 측정이 그 생각을 확인해주는 쪽으로 정리됩니다. 굴드는 이것을 의도적인 조작과는 구분해서 다뤘습니다. 본인은 자기가 객관적으로 재고 있다고 믿는 경우가 더 많다는 쪽입니다.
굴드 자신의 사례가 반박됐습니다
여기서 정확히 적어둘 것이 있습니다. 이 책에서 가장 유명한 사례가 이후 논쟁의 대상이 됐습니다.
굴드는 19세기에 두개골 용적을 측정한 자료를 재검토하면서, 측정한 사람의 기대가 숫자에 섞여 들어갔다고 주장했습니다.
2011년에 다른 연구진이 실제 두개골들을 다시 측정했습니다. 그 결과 원래의 측정이 대체로 정확했고, 오히려 굴드 쪽의 재분석에 오류와 선택적 해석이 있었다는 보고가 나왔습니다.
그런데 여기서 끝나지 않았습니다. 이후 그 반박을 다시 검토한 논문들이 나왔고, 원래 자료의 표본 구성 방식에는 여전히 문제가 있다는 지적이 제기됐습니다. 이 논쟁은 정리되지 않은 상태입니다.
그래서 이 책을 인용할 때는 구분이 필요합니다. 특정 사례의 재분석은 다툼이 있고, 실체화와 서열화라는 지적은 그 사례 하나에 걸려 있지 않습니다. 저는 뒤쪽만 가져오는 게 맞다고 봤습니다.
덧붙이면 이 논쟁 자체가 굴드의 논지와 겹칩니다. 측정하는 사람의 기대가 숫자에 섞인다는 주장이었고, 그 주장을 한 본인의 재분석에서도 같은 일이 지적됐습니다. 누구도 그 바깥에 서지 못한다는 뜻이기도 합니다.
하나의 수로 줄일 때 사라지는 것
실체화가 실제로 어떻게 작동하는지는 제 검사 결과에서 보였습니다.
그 검사에는 여러 종류의 문항이 있었을 것입니다. 기억하는 것, 빠르게 처리하는 것, 규칙을 찾는 것, 말로 설명하는 것이요. 사람마다 이 사이의 차이가 큽니다.
그런데 결과지에는 그게 하나의 값으로 합쳐져 있었습니다. 합치는 순간 어느 쪽이 높고 어느 쪽이 낮았는지가 사라집니다. 남는 것은 위치 하나입니다.
그리고 위치는 사람에게 붙습니다. 이 문항들에서 이런 결과가 나왔다는 서술이 아니라 저는 이 정도인 사람이라는 문장이 됩니다. 서술은 조건이 붙어 있는데 문장은 조건이 없습니다.
골렘 효과를 쓰면서 낮은 기대가 실제 성취를 낮춘다는 논의를 다뤘는데, 숫자 하나가 그 기대를 만드는 통로가 될 수 있습니다. 붙이는 쪽에서도 붙는 쪽에서도요.
총점보다 하위 항목이 저를 더 말해줬습니다
그래서 요즘은 검사 결과를 받으면 보는 순서를 바꿉니다.
먼저 문항을 봅니다. 결과 설명보다 문항이 정보가 훨씬 많습니다. 뭘 물었는지를 보면 이 검사가 못 재는 것까지 같이 보입니다. 설명문은 대개 잘 재고 있다는 쪽으로 쓰여 있어서요.
그다음으로 하위 항목을 찾습니다. 하나의 수로 줄여져 있어도 대개 항목별 값이 어딘가에 붙어 있습니다. 제 경우엔 이게 제일 쓸모 있었습니다. 어떤 항목은 높고 어떤 항목은 낮았고, 총점은 그 둘의 가운데였습니다. 그 가운뎃값이 저를 설명한다고 보기는 어려웠습니다.
마지막으로 점수를 사람이 아니라 그날의 수행에 붙여 적습니다. 저는 이 정도인 사람이 아니라, 그날 그 문항들에서 이 정도가 나왔다고 적는 겁니다.
문장 하나 차이인데 다음에 할 일이 달라집니다.
더닝 크루거 효과를 쓰면서 자기 실력을 재는 감각 자체가 잘 안 맞는다는 이야기를 다뤘는데, 검사 점수를 그 감각의 근거로 쓰기 시작하면 둘 다 흔들립니다.
십 분이면 될 일이었습니다
그 검사가 뭐였는지 찾아보는 데 십 분쯤 걸렸습니다.
십 분입니다. 십 몇 년을 들고 다닌 숫자인데 확인하는 데 십 분이 걸렸습니다.
어떤 문항들이었는지 보고 나니 그 숫자가 좀 달라 보였습니다. 제가 그 값으로 설명하던 것 중 몇 가지는 애초에 그 검사가 재지 않는 것이었습니다.
숫자가 틀렸다는 뜻은 아닙니다. 굴드도 측정을 하지 말자고 한 게 아니었고요. 재는 일과 그 결과로 사람을 줄 세우는 일을 구분하자는 쪽이었습니다.
제가 십 몇 년 동안 안 한 게 딱 그 구분이었습니다. 숫자는 기억하면서 출처는 한 번도 안 봤습니다.
결과지는 다시 서랍에 넣어뒀습니다. 버릴까 하다가 그냥 뒀습니다. 다음에 또 어떤 숫자를 만나면 그때는 문항부터 볼 생각입니다.
저는 심리 측정이나 통계 분야의 전문가가 아니며, 이 글은 특정 검사를 평가하거나 권하려는 내용이 아닙니다. 검사 결과를 진로나 교육에 관한 판단의 근거로 쓰기 전에는 자격을 갖춘 기관의 해석을 받아보시기 바랍니다.
- 다중지능 이론, 학원 유리창의 문구 앞에서 잠깐 멈춰 섰습니다 - 10월 8, 2026
- 콰이어트, 혼자 있는 시간이 게으름이 아니라 회복이었습니다 - 10월 7, 2026
- MBTI, 단톡방에 네 글자가 줄줄이 올라오던 저녁에 생각한 것들 - 10월 7, 2026



