07 / 07
Interpréter les résultats du test de Stroop — interférence, taux de réussite, nuage de points
Comment lire l'effet d'interférence, la facilitation et le coût d'inhibition, l'écart de taux d'erreur, la moyenne et la médiane, le nuage de points par essai ; les limites de la précision de mesure et le nombre de mesures nécessaires pour un résultat fiable.
À la fin du test s'affichent le temps de réaction moyen et médian par condition, le taux de réussite, l'effet d'interférence et un nuage de points par essai. Voici ce que signifie chaque valeur et jusqu'où l'on peut s'y fier.
Comment c'est calculé
- Temps de réaction — le temps (ms) écoulé entre l'image où le mot est dessiné à l'écran et l'événement d'appui sur un bouton ou une touche. Seuls les essais réussis entrent dans la moyenne et la médiane.
- Règles d'exclusion — une réponse de moins de 200 ms est considérée comme une anticipation, donnée avant d'avoir vu et jugé le mot, et exclue à la fois du temps de réaction et du taux de réussite. Un dépassement de temps compte comme une erreur et est exclu du temps de réaction. Un appui avant l'apparition du stimulus (pendant l'affichage du +) est ignoré ; seul leur nombre est indiqué.
Effet d'interférence = moyenne incongruente − moyenne congruente
Facilitation = moyenne neutre − moyenne congruente · Coût d'inhibition = moyenne incongruente − moyenne neutre
Lire l'effet d'interférence
Une valeur positive signifie que vos réponses ont été plus lentes d'autant en condition incongruente. La plupart des gens obtiennent une valeur positive ; si elle est proche de zéro ou négative, pensez d'abord à une fluctuation due au hasard avec trop peu d'essais.
Ce site ne vous compare pas à un « top X % » ni à des moyennes par âge. Il n'existe pas de normes validées pour les tâches à boutons en ligne, et comme la latence varie d'un appareil à l'autre, vos chiffres ne sont pas directement comparables à ceux d'autres personnes. Comparez vos propres résultats, mesurés sur le même appareil, dans la même langue et avec les mêmes réglages.
Regarder aussi le taux de réussite
Si l'écart de temps de réaction est faible en condition incongruente mais que les erreurs sont nombreuses, vous avez peut-être sacrifié la précision à la vitesse (compromis vitesse-précision). Regardez aussi l'écart de taux d'erreur (incongruent − congruent) sur l'écran de résultats. Si la condition incongruente est défavorable à la fois pour le temps de réaction et pour le taux d'erreur, on peut considérer que l'interférence est nette.
Moyenne et médiane
Un ou deux essais où l'on a répondu tard par distraction suffisent à faire fortement varier la moyenne. La médiane est moins sensible à ces valeurs aberrantes. Si l'interférence calculée sur la moyenne et celle calculée sur la médiane diffèrent beaucoup, c'est le signe d'essais aberrants : cherchez dans le nuage de points un point isolé tout en haut.
Lire le nuage de points
L'axe horizontal représente l'ordre des essais, l'axe vertical le temps de réaction. ○ = congruent, ■ = incongruent, △ = neutre, × = erreur, dépassement de temps ou anticipation ; les pointillés indiquent la moyenne de chaque condition.
- Les ■ sont globalement au-dessus des ○ — il y a interférence.
- Les premiers points sont hauts puis descendent — c'est l'effet d'entraînement, le temps de se familiariser avec la tâche. Il diminue si vous activez les 8 essais d'entraînement.
- Les points montent ou se dispersent vers la fin — pensez à la fatigue ou à une baisse de concentration.
- Une zone où les × se concentrent — un passage où la règle a été confondue ou où l'on s'est précipité.
Combien de mesures pour un résultat fiable ?
Le réglage à 24 essais ne donne que 8 essais par condition, et les valeurs fluctuent beaucoup. Si une condition compte moins de 5 bonnes réponses, un avertissement s'affiche sur l'écran de résultats. Une différence entre deux moyennes, comme l'interférence, est plus bruitée que chaque moyenne prise isolément ; Hedge et ses collègues (Hedge, Powell & Sumner, 2018) ont d'ailleurs rapporté que la fidélité test-retest de l'interférence Stroop était plus faible que prévu. Mieux vaut mesurer plusieurs fois avec 48 à 72 essais et suivre l'évolution que se fier à un chiffre unique.
Ce qui influe sur la précision de mesure
- Périphérique de saisie — un clavier filaire a généralement une latence courte ; un clavier sans fil ou Bluetooth et un écran tactile peuvent ajouter une latence plus longue.
- Fréquence de rafraîchissement — un écran à 60 Hz se redessine toutes les 16,7 ms, d'où une erreur d'environ une image sur le moment où le mot devient réellement visible.
- Navigateur et charge de l'appareil — si d'autres onglets ou applications sont gourmands, le traitement des événements peut être retardé. Si vous changez d'onglet pendant le test, celui-ci s'interrompt automatiquement.
La plupart de ces latences s'ajoutent de la même façon à toutes les conditions : l'effet d'interférence, qui est une différence entre conditions, en est donc moins affecté que le temps de réaction absolu. Changer d'appareil peut toutefois modifier les valeurs absolues : comparez sur le même appareil.
Ce n'est pas un diagnostic
Ce test n'est pas un test neuropsychologique standardisé et ne pose aucun diagnostic médical ou psychologique. Utilisez les résultats uniquement pour vous divertir et vous observer.
Références
Hedge, C., Powell, G., & Sumner, P. (2018). The reliability paradox: Why robust cognitive tasks do not produce reliable individual differences. Behavior Research Methods, 50(3), 1166–1186.
MacLeod, C. M. (1991). Half a century of research on the Stroop effect: An integrative review. Psychological Bulletin, 109(2), 163–203.