Analyses statistiques / 2011

Consistance interne

Consistance entre les sous-tests

Il a été montré (voir Corrélations) que le sous-test « Comptine » manquait d'homogénéité et pouvait avantageusement être scindé en deux : « ScoreCpter » (comptine numérique classique) et « CptineCplt » (manipulations de la comptine). C'est à partir de cette nouvelle configuration qu'a été calculé l'indice α de Cronbach inter-sous-tests.

En pratique, on souhaite un indice supérieur à 0,6 pour être satisfait de la cohérence interne de l'échelle — mais un α trop élevé (au-delà de 0,95) serait le signe d'une redondance excessive entre les items, une cohérence en réalité douteuse.

α de Cronbach inter-sous-tests = ,709 — jugé à la fois suffisamment élevé (les sous-tests mesurent une composante commune) et suffisamment faible pour justifier la présence de plusieurs sous-tests distincts.

Le tableau des corrélations item-total permet de constater que le sous-test « Dénombrement » se démarque des autres par sa faible corrélation avec les autres sous-tests (voir plus bas pour l'explication).

Consistance au sein de chaque sous-test

Mesurée elle aussi par l'indice α de Cronbach, calculé séparément par sous-test (le sous-test « Comptine » est ici analysé dans sa version originale, non scindée). Concernant l'item « ScoreCptine » en particulier, son retrait n'a qu'une incidence marginale : il est bien consistant avec les autres items de « Comptine » — s'il a été isolé ailleurs, ce n'est pas pour une inconsistance interne, mais parce qu'il se montrait moins prédictif du score total que les autres items de ce sous-test.

Sous-testα de Cronbach
Comptine,75
Dénombrement,44
Subitizing,64
Sens des nombres,83
Additions,91
Soustractions,88

Les indices pour « Lecture » et « Écriture » des nombres ne sont pas mentionnés : structurés en échelle de Guttman (arrêt après un premier échec), ils gonflent artificiellement la cohérence mesurée.

Le cas particulier du sous-test « Dénombrement » (α = ,44)

Cet indice, nettement plus faible que les autres, s'explique par plusieurs facteurs cumulés :

  • le nombre d'items est très faible (7) ;
  • deux items ont une variance nulle (réussis par tous les enfants de l'échantillon), réduisant le nombre d'items réellement pris en compte à 5 ;
  • ce sous-test investigue des compétences aussi diverses que l'énonciation de la suite conventionnelle des nombres, l'activité de pointage, et les principes de Gelman & Gallistel (eux-mêmes peu homogènes entre eux — voir Quantification).

Il paraît néanmoins important de maintenir ce sous-test en l'état : même reposant sur des compétences variées, il met en évidence une activité clairement identifiable. Dans la mesure où les aptitudes sous-jacentes au dénombrement sont variées et peu homogènes, constater qu'un enfant est faible à ce sous-test n'a pas de valeur explicative au sens neuropsychologique du terme — il reste à découvrir lesquelles de ces compétences sous-jacentes font défaut. C'est ce qui distingue « Dénombrement » de tous les autres sous-tests de l'échelle.

Consistance entre tous les items

Il est instructif de visualiser les corrélations entre chaque item — indépendamment du sous-test auquel il appartient — et le résultat total à MathEval.

α de Cronbach global (64 items) = ,869 — un indice particulièrement élevé, confirmant que les items du test, indépendamment de leur sous-test d'appartenance, mesurent une (ou des) caractéristique(s) commune(s).

Notes méthodologiques : les items de variance nulle ont été exclus de l'analyse. Les items des sous-tests « Écriture » (EcrNb) et « Lecture » (LectNb) n'ont pas été individualisés (structure en échelle de Guttman) — seule leur note totale figure dans le tableau ci-dessous ; leur corrélation y est donc mécaniquement plus élevée que si chaque item avait été pris isolément.

Corrélations item-total (ordre croissant)

ItemCorrélation item-totalα si l'item est supprimé
NPertOrdre,010,870
19M7,035,869
Cpter9,040,869
CorrTàT,040,869
L97,137,869
2P3C,165,869
2P1SC,165,869
18M6,172,869
Cpter19,181,869
5M3C,196,869
26M3,207,869
BorneSup,213,868
SubPts,259,867
2P1,300,868
L10,303,867
11P4,304,868
L9,318,867
L2,332,867
5M3SC,344,867
SubDoigts,347,866
3M1SC,349,867
12M4,349,868
L8,384,867
17M4,393,868
L1,394,867
IntrBornes,396,874
2P3SC,400,867
13P5,401,868
12P6,401,868
8P7,421,867
7P6,421,867
SensNb0-10,430,866
5M3Bis,440,866
Par5,440,866
5M3,448,866
3M1,449,866
L18,460,866
2P3Bis,470,866
25P3,472,868
24P5,472,868
82P6,472,868
43P5,472,868
72P7,472,868
SensNb10-20,480,866
12P3,486,866
SensNb20-100,490,866
7M4,491,866
11P2,494,866
8M5,496,866
Rebours9,499,866
2P3,509,866
5P3,517,866
6M3,518,866
14P3,528,867
3P6,532,866
Par10,540,863
BorneInf,544,863
L42,551,866
LectNb,552,862
Rebours16,556,863
2P7,575,865
9P3,595,865
EcrNb,603,876
Par2,663,863

Lecture du tableau : les items les plus faiblement corrélés au score total (NPertOrdre, 19M7, Cpter9…) contribuent le moins à la mesure globale ; les plus fortement corrélés (Par2, EcrNb, 9P3…) sont les plus représentatifs de la compétence globale mesurée par MathEval. L'indice alpha reste remarquablement stable (,862 à ,876) quel que soit l'item retiré, ce qui confirme la robustesse de la cohérence interne globale de l'échelle.