04 / 07
신경심리 검사에서의 스트룹 — 무엇을 보고, 무엇을 못 보나
골든 판·빅토리아 판·D-KEFS 등 임상에서 쓰는 스트룹 검사의 구성과 쓰임, 그리고 점수 하나로 진단할 수 없는 이유를 설명합니다. 이 사이트는 진단 도구가 아닙니다.
스트룹 과제는 실험실을 넘어 임상 신경심리 평가에서도 오래 쓰였습니다. 다만 이 사이트의 테스트는 표준화된 검사가 아니며, 어떤 질환도 진단하거나 배제하지 못합니다. 아래는 임상 검사가 어떻게 쓰이는지에 대한 일반 정보입니다.
대표적인 임상용 스트룹 검사
- Stroop Color and Word Test(골든 판) — 골든(Golden, 1978)이 만든 판입니다. 색 단어 읽기, 색 이름 대기, 불일치 색 이름 대기의 세 쪽을 각각 45초 동안 얼마나 많이 해내는지 셉니다.
- 빅토리아 스트룹 검사(Victoria Stroop Test) — 캐나다 빅토리아 대학에서 쓰인 짧은 판으로, 점·일반 단어·색 단어의 세 카드에 각각 24개 항목이 있습니다. 신경심리 검사 편람(Strauss, Sherman & Spreen, 2006)에 실시 방법과 자료가 실려 있습니다.
- D-KEFS 색-단어 간섭 검사 — 델리스·캐플런·크레이머(Delis, Kaplan & Kramer, 2001)의 실행 기능 검사 묶음에 들어 있는 판으로, 기본 조건에 더해 규칙이 바뀌는 억제/전환 조건을 둡니다.
이런 검사는 대부분 음성 응답을 쓰고, 훈련받은 검사자가 시간을 재며 오류를 기록합니다. 그리고 결과를 나이·교육 수준별 규준과 비교해 해석합니다.
무엇을 보려는가
임상에서 스트룹 검사는 주로 억제 조절(저절로 나오는 반응을 누르는 능력), 선택적 주의, 처리 속도를 살피는 데 쓰입니다. 실행 기능 평가 묶음의 한 부분으로 자주 들어가며, 뇌손상, 주의력결핍 과잉행동장애(ADHD), 치매 등 여러 상태를 다룬 연구에 쓰였습니다.
왜 점수 하나로 진단할 수 없나
- 여러 능력이 섞인다 — 색 이름 대기가 느린 것은 억제의 문제일 수도, 단순히 처리 속도나 시력·색각의 문제일 수도 있습니다. 그래서 검사들은 읽기와 색 이름 대기 같은 기본 조건을 따로 재서 비교합니다.
- 읽기 능력과 교육 — 읽기에 덜 익숙하면 단어가 덜 자동으로 처리돼 간섭이 오히려 작게 나올 수 있습니다.
- 특정 질환에 특이적이지 않다 — 간섭이 크다는 결과는 여러 상태에서 나타날 수 있어, 그 자체로 어떤 병을 가리키지 않습니다. 피로·불안·수면 부족만으로도 달라집니다.
- 차이 점수의 신뢰도 — 간섭처럼 두 조건의 차이로 만든 점수는 집단 평균에서는 뚜렷해도 개인 차이를 안정적으로 재기 어렵다는 지적이 있습니다(Hedge, Powell & Sumner, 2018).
그래서 임상 판단은 면담, 여러 검사, 병력과 생활 기능을 종합한 전문가의 해석으로 이뤄집니다.
이 사이트와 임상 검사의 차이
| 항목 | 임상 검사 | 이 사이트 |
|---|---|---|
| 실시 | 훈련된 검사자, 표준 절차 | 스스로, 기기마다 다름 |
| 응답 | 주로 음성 | 버튼·키보드 |
| 측정 | 쪽(카드)별 시간이나 항목 수 | 시행별 반응시간(ms) |
| 해석 | 나이·교육 수준별 규준 | 규준 없음, 내 기록끼리 비교 |
집중이 갑자기 어려워졌거나 기억력이 달라졌다고 느끼는 등 걱정되는 변화가 있다면, 온라인 테스트 결과로 판단하지 말고 의료 전문가와 상담하세요.
참고 문헌
Golden, C. J. (1978). Stroop Color and Word Test: A manual for clinical and experimental uses. Stoelting.
Delis, D. C., Kaplan, E., & Kramer, J. H. (2001). Delis-Kaplan Executive Function System (D-KEFS). The Psychological Corporation.
Strauss, E., Sherman, E. M. S., & Spreen, O. (2006). A Compendium of Neuropsychological Tests (3rd ed.). Oxford University Press.
Hedge, C., Powell, G., & Sumner, P. (2018). The reliability paradox: Why robust cognitive tasks do not produce reliable individual differences. Behavior Research Methods, 50(3), 1166–1186.