Matrices progressives de Raven : le test de QI non verbal
Les matrices progressives de Raven constituent le test de raisonnement non verbal le plus connu de la psychologie. Le principe : une grille incomplète de figures abstraites, et une seule question — quelle pièce complète correctement le motif ? Ni mots, ni calcul, ni culture générale. Publié pour la première fois en 1938, l'instrument reste utilisé en recherche, en sélection professionnelle et dans les évaluations menées entre locuteurs de langues différentes ; il est aussi l'ancêtre direct des subtests de raisonnement matriciel présents dans la plupart des batteries de QI actuelles. Ce guide retrace son origine, décrit la construction de ses items, précise ce qu'il mesure — et ce qu'il ne mesure pas — et explique comment lire ses résultats.
1. D'où viennent les matrices progressives de Raven
Le test a été conçu par le psychologue britannique John C. Raven, qui en publia la première version en 1938. Raven avait travaillé comme assistant de recherche auprès de Lionel Penrose sur une étude consacrée aux origines de la déficience intellectuelle. Il lui fallait un instrument administrable rapidement, sur le terrain, à des personnes dont le niveau d'alphabétisation et de scolarisation variait énormément. Les tests de l'époque reposaient massivement sur le vocabulaire, les connaissances générales et des consignes verbales — autant d'éléments qui voyagent mal d'un contexte à l'autre.
Le point de départ théorique de Raven vient de Charles Spearman et de sa théorie bifactorielle, selon laquelle un facteur général (g) traverse l'ensemble des tâches cognitives. Spearman avait décrit l'« éduction des relations et des corrélats » : cet acte mental qui consiste à percevoir comment des éléments se relient entre eux, puis à étendre cette relation à des cas nouveaux. Raven a conçu ses matrices comme un exercice délibérément épuré de cette seule opération.
Il les associa à un test de vocabulaire, la Mill Hill Vocabulary Scale, destinée à mesurer ce qu'il appelait la capacité reproductive : le stock d'informations apprises qu'une personne peut restituer. Les matrices, elles, mesuraient la capacité éductive : donner du sens à un matériel dépourvu de signification préétablie. Ensemble, les deux épreuves devaient offrir un portrait à deux versants plutôt qu'un chiffre unique — une intuition de conception qui survit aujourd'hui dans la distinction entre intelligence fluide et intelligence cristallisée.
La longévité de ce test est remarquable. Très peu d'instruments psychologiques des années 1930 sont encore publiés commercialement et régulièrement réétalonnés près de quatre-vingt-dix ans plus tard.
2. À quoi ressemble concrètement un item matriciel
Les items de Raven sont protégés par le droit d'auteur : aucun item authentique n'est reproduit ici. Leur structure générale, en revanche, relève du domaine public et se décrit sans difficulté.
Un item typique présente une matrice de figures abstraites — le plus souvent une grille 3 × 3, les séries les plus faciles utilisant des dispositions plus simples en 2 × 2 ou en bande unique. La case en bas à droite est vide. Sous la matrice figure un ensemble de pièces candidates, généralement six ou huit. Il s'agit d'identifier laquelle vient combler la case manquante.
Plusieurs caractéristiques de cette conception méritent attention :
- Aucune langue n'est nécessaire. Les consignes peuvent au besoin être mimées. Les items eux-mêmes ne contiennent aucun texte.
- Aucune connaissance préalable n'aide. Les figures sont arbitraires — flèches, points, hachures, contours géométriques — et ne véhiculent aucun contenu culturel ou scolaire.
- La difficulté est « progressive ». Les items sont ordonnés du très facile au très difficile, si bien que les premiers enseignent en pratique la logique dont dépendent les suivants. C'est de là que vient le mot « progressives » dans le nom du test.
- Les distracteurs sont systématiques. Les mauvaises réponses ne sont pas tirées au hasard : elles correspondent généralement à des applications partiellement correctes de la règle — la bonne forme avec le mauvais remplissage, la bonne progression appliquée à la mauvaise dimension, etc. C'est ce qui rend le hasard peu payant sur les items difficiles.
Une illustration de notre propre fabrication : imaginez une ligne où le nombre de points augmente d'une unité de gauche à droite, tandis que la figure qui les entoure pivote d'un quart de tour à chaque étape. Deux règles indépendantes opèrent simultanément, et la case manquante doit satisfaire les deux. Les items les plus ardus cumulent plusieurs règles de ce type.
3. Les principales versions du test
Raven n'a jamais publié un test unique. Les matrices forment une famille d'instruments destinés à des plages d'aptitude différentes, et c'est précisément la plage d'aptitude visée qui détermine la version appropriée.
| Version | Abrév. | Items | Structure | Public visé |
|---|---|---|---|---|
| Coloured Progressive Matrices | CPM | 36 | 3 séries de 12 (A, Ab, B) | Jeunes enfants, personnes âgées, personnes présentant une atteinte cognitive |
| Standard Progressive Matrices | SPM | 60 | 5 séries de 12 (A–E) | Population générale, d'environ 6 ans à l'âge adulte |
| Standard Progressive Matrices Plus | SPM+ | 60 | 5 séries de 12 | Même plage que le SPM, items plus difficiles pour limiter l'effet plafond |
| Advanced Progressive Matrices | APM | 12 + 36 | Série I (entraînement), Série II (cotée) | Adultes et adolescents du haut de la distribution |
| Matrices progressives de Raven, 3ᵉ éd. | Raven's 2 | Variable | Numérique, sélection adaptative des items | Usage clinique et professionnel actuel |
Le CPM utilise des fonds colorés, qui retiennent mieux l'attention des jeunes enfants et allègent la charge visuelle. Le SPM est la forme classique, celle à laquelle on pense généralement en parlant « des matrices de Raven ». L'APM a été développé parce que le SPM comprime le haut de la distribution — trop d'adultes performants atteignent le plafond ; ses items commencent donc là où s'arrêtent les plus difficiles du SPM.
La révision publiée en 2018 par Pearson, couramment appelée Raven's 2, a fait passer le test à un format numérique adaptatif : la difficulté de l'item suivant dépend des réponses déjà données. Cette administration adaptative atteint une précision comparable avec moins d'items et atténue les problèmes de plancher et de plafond des formes fixes.
La passation dure généralement de 20 à 45 minutes. Raven avait conçu le SPM sans limite de temps, y voyant une mesure de la puissance de raisonnement plutôt que de la rapidité ; l'administration chronométrée s'est imposée plus tard, et elle modifie la nature de ce que le score reflète.
4. Ce que le test mesure réellement
Dans les études d'analyse factorielle, les matrices de Raven saturent très fortement le facteur d'intelligence fluide (Gf) et, par son intermédiaire, le facteur g. La littérature psychométrique la décrit couramment comme l'un des meilleurs marqueurs isolés de l'intelligence générale disponibles — d'où le réflexe des chercheurs qui cherchent une approximation rapide de g.
Sur le plan cognitif, la tâche exige :
- L'induction de règles — inférer une régularité abstraite à partir d'un petit nombre d'exemples.
- La mémoire de travail et la gestion des buts — maintenir simultanément plusieurs sous-buts partiellement résolus tout en testant des règles candidates.
- L'attention aux dimensions pertinentes — déterminer lequel des nombreux attributs visuels (forme, nombre, remplissage, orientation, taille, position) porte effectivement le motif.
L'analyse cognitive de référence reste celle de Carpenter, Just et Shell (1990), qui ont modélisé en détail la performance à l'APM et conclu que les items les plus difficiles se distinguaient surtout par le nombre de règles à gérer en parallèle et par la charge imposée à la gestion des buts en mémoire de travail. Ils ont recensé un petit nombre de types de règles récurrents :
| Type de règle | Ce qu'elle fait |
|---|---|
| Constante en ligne | Un attribut reste identique sur une ligne et change d'une ligne à l'autre |
| Progression quantitative par paires | Un attribut croît ou décroît par pas fixes le long d'une ligne |
| Addition ou soustraction de figures | Deux cases se combinent, ou l'une se retranche de l'autre, pour donner la troisième |
| Distribution de trois | Trois valeurs d'un attribut apparaissent chacune une fois par ligne et par colonne |
| Distribution de deux | Deux valeurs apparaissent et une est nulle dans chaque ligne |
Notez ce que cette liste implique : le test ne mesure pas une « aptitude visuelle » au sens étroit. Il mesure l'efficacité avec laquelle une personne engendre, teste et retient des hypothèses abstraites sous contrainte.
Les travaux de neuro-imagerie associent la performance au raisonnement matriciel à un réseau fronto-pariétal distribué — le tableau que résume la théorie d'intégration pariéto-frontale de Jung et Haier (2007). Ces résultats décrivent des corrélats de la performance ; ils ne localisent pas « l'intelligence » en un point du cerveau.
5. La question de l'équité culturelle
On qualifie fréquemment les matrices de Raven de test « indépendant de la culture » ou « équitable culturellement ». La première formule est fausse et la seconde n'est, au mieux, qu'une approximation.
Il est exact que le test lève les barrières culturelles les plus visibles : pas de langue, pas de vocabulaire, pas de contenu de programme scolaire, pas d'objets culturellement situés. C'est un avantage réel, et c'est pourquoi l'instrument s'est autant diffusé dans la recherche interlinguistique et dans les situations où l'examinateur et la personne évaluée ne partagent aucune langue.
Mais à influence culturelle réduite n'est pas sans culture. La performance dépend encore de choses inégalement réparties :
- La familiarité avec les figures abstraites en deux dimensions, largement produit de la scolarisation formelle et de l'exposition aux supports imprimés et aux écrans.
- Les conventions de passation — le format à choix multiples, le postulat qu'une seule réponse est « correcte », le fait de travailler seul, en silence, contre la montre.
- La durée de scolarisation, corrélée à la performance matricielle indépendamment du contenu enseigné.
La position consensuelle de la psychométrie contemporaine tient en trois points : aucun test n'est indépendant de la culture ; les matrices de Raven réduisent substantiellement certaines sources de biais ; cette réduction ne doit pas être transformée en une prétention de comparabilité universelle entre populations.
6. Les matrices de Raven et l'effet Flynn
L'effet Flynn — la hausse séculaire des scores bruts moyens aux tests cognitifs au cours du XXᵉ siècle — a été documenté de la manière la plus spectaculaire sur des tests de type Raven. James Flynn et d'autres ont constaté que les gains au raisonnement matriciel abstrait dépassaient nettement ceux observés au vocabulaire ou aux connaissances générales, atteignant dans certains jeux de données nationaux l'ordre d'un écart-type par génération.
C'est un résultat franchement gênant pour la lecture « équitable culturellement » du test. Si les matrices mesuraient une capacité biologique fixe, insensible à l'environnement, les scores des générations successives n'auraient pas dérivé aussi nettement vers le haut. Les explications dominantes renvoient au contraire au changement environnemental : allongement de la scolarité, environnement visuel saturé de schémas et de symboles, et — c'est l'hypothèse que privilégiait Flynn lui-même — un basculement culturel vers l'usage habituel de catégories abstraites, hypothétiques et classificatoires plutôt que concrètes.
Deux conséquences pratiques en découlent. D'abord, les étalonnages se périment. Un même score brut interprété avec les normes de 1979 puis avec celles de 2018 ne donne pas le même résultat, et les anciennes normes flattent la personne évaluée. Ensuite, une performance moyenne en hausse à un test n'équivaut pas à une population devenue plus intelligente à tous égards : les gains ont été très inégaux selon les domaines cognitifs, et c'est précisément là que réside l'information la plus instructive.
7. Comment se présentent les scores de Raven
Le score brut est simplement le nombre d'items réussis — sur 60 au SPM, sur 36 à la série II de l'APM. Ce nombre brut ne signifie rien en soi. Il ne devient interprétable qu'une fois confronté à une table d'étalonnage correspondant à la tranche d'âge et à la population de référence, qui le convertit en percentile.
Certains éditeurs convertissent en outre le percentile sur une échelle de score standard de moyenne 100 et d'écart-type 15, afin que les résultats puissent être discutés à côté des QI de type Wechsler. Cette conversion est une commodité, non une équivalence : un score standard dérivé des matrices de Raven et un QI total au WAIS reposent sur des contenus différents et ne sont pas interchangeables.
Trois précautions valent pour tout chiffre issu des matrices :
- C'est une mesure à domaine unique. Les matrices évaluent le raisonnement fluide non verbal. Elles ne disent rien de la compréhension verbale, des connaissances acquises ou de la vitesse de traitement. Une batterie complète échantillonne plusieurs domaines pour exactement cette raison.
- Elle comporte une erreur de mesure. Comme pour tout test, un score observé est une estimation. L'intervalle de confiance à 95 % autour d'un score bien étalonné s'étend typiquement de plusieurs points de part et d'autre de la valeur observée.
- L'entraînement modifie le score, pas la personne. Qui a résolu beaucoup de puzzles matriciels devient meilleur aux puzzles matriciels. Ce progrès reflète la familiarité avec le format des items et avec les types de règles récurrents — un apprentissage spécifique à la tâche — et ne doit pas être lu comme un changement de l'aptitude générale sous-jacente.
8. Où l'on croise les matrices aujourd'hui
Même sans jamais passer le test de Raven lui-même, vous avez presque certainement rencontré sa logique. Le raisonnement matriciel est un subtest central du WAIS-IV et du WISC-V. Des tâches de matrices figurales comparables apparaissent dans le Stanford-Binet, dans le test Culture Fair de Cattell, dans le Naglieri Nonverbal Ability Test, dans les batteries d'aptitudes utilisées en recrutement, ainsi que dans une large part des tests gratuits qui circulent en ligne.
Certaines antennes nationales d'associations à haut QI ont accepté des scores surveillés obtenus aux Advanced Progressive Matrices parmi les preuves d'admission, mais les critères varient selon les pays et évoluent dans le temps : qui envisage cette voie a intérêt à vérifier les exigences en vigueur directement auprès de l'organisation plutôt que de se fier à des listes de seconde main.
Les tests matriciels en ligne, y compris les items de raisonnement sur motifs du profil Brambin, reposent sur la même logique sous-jacente, mais ne sont pas l'instrument déposé de Raven et ne sont pas administrés dans des conditions standardisées. Ils sont utiles à la curiosité et à l'auto-exploration. Ce ne sont pas des évaluations cliniques et ils ne peuvent en tenir lieu.
Questions fréquentes
Les matrices progressives de Raven sont-elles un test de QI ?
C'est un test de raisonnement fluide non verbal, très fortement corrélé à l'intelligence générale, dont les résultats sont souvent convertis sur une échelle de type QI, de moyenne 100 et d'écart-type 15. Mais il mesure un seul domaine, là où une batterie complète comme le WAIS en couvre plusieurs : un résultat aux matrices et un QI total ne sont donc pas la même grandeur, même imprimés sur la même échelle.
Combien de temps dure le test ?
Cela dépend de la version et du protocole de passation. Les Standard Progressive Matrices prennent généralement de 20 à 45 minutes ; une limite de 45 minutes est courante en passation collective chronométrée. Raven l'avait initialement conçu sans limite de temps, considérant que c'était la puissance de raisonnement et non la rapidité qui présentait un intérêt, et cette passation sans chronomètre reste utilisée dans certains contextes de recherche.
Le test de Raven est-il vraiment indépendant de la culture ?
Non. Il vaut mieux le décrire comme un test à influence culturelle réduite. Supprimer la langue et les contenus scolaires élimine de grandes sources de biais, mais la performance dépend encore de la familiarité avec les figures abstraites en deux dimensions, de la scolarisation formelle et des conventions de passation, qui varient selon les environnements. La plupart des psychométriciens considèrent aujourd'hui l'expression « indépendant de la culture » comme excessive.
Peut-on progresser aux puzzles de type Raven en s'entraînant ?
La performance aux puzzles matriciels s'améliore effectivement avec la pratique, parce que les types de règles récurrents deviennent familiers et que le format cesse de surprendre. Ce que la recherche établit, c'est qu'il s'agit d'un apprentissage spécifique à la tâche : le gain apparaît sur la tâche entraînée et se transfère mal à des tâches cognitives sans rapport. Il ne doit pas être interprété comme une modification de l'aptitude générale au raisonnement, et c'est une des raisons pour lesquelles les cliniciens relativisent les scores issus de tests repassés peu de temps après.
Pourquoi existe-t-il autant de versions différentes ?
Parce qu'une forme unique de 60 items ne peut pas mesurer avec précision sur toute la plage d'aptitude. La version colorée existe pour que les jeunes enfants et les adultes présentant une atteinte cognitive ne restent pas bloqués au plancher d'un test trop difficile ; la version avancée existe pour que les adultes performants ne soient pas bloqués au plafond d'un test trop facile. L'édition adaptative moderne traite les deux problèmes à la fois en choisissant les items en fonction des réponses.
Où peut-on voir de véritables items de Raven ?
Nulle part de façon légitime dans le domaine public. Les items sont protégés par le droit d'auteur et publiés sous licence, et leur confidentialité compte : un item largement diffusé ne mesure plus ce pour quoi il a été étalonné. Il existe du matériel d'entraînement qui en imite le format, mais ce n'est pas le test, et ses scores ne sont pas comparables à des résultats étalonnés.
Synthèse
Les matrices progressives de Raven durent depuis 1938 parce qu'elles font une chose remarquablement bien : isoler l'induction de règles abstraites de la langue, des connaissances et des programmes scolaires. Cela en fait l'un des marqueurs les plus purs du raisonnement fluide et l'un des instruments de recherche les plus utilisés de la discipline.
Ses limites sont tout aussi nettes. Elle mesure un seul domaine cognitif. Elle est à influence culturelle réduite, non indépendante de la culture. Ses étalonnages dérivent, comme l'effet Flynn l'a montré plus vivement sur ce test que sur aucun autre. Et le score qui en sort est une estimation assortie d'une bande de confiance, non une propriété fixe d'une personne.
Lu à côté d'autres éléments, un résultat de raisonnement matriciel est réellement informatif. Lu seul, comme un verdict, on lui demande de porter bien plus que ce pour quoi il a été construit.
Brambin propose un profil cognitif à huit dimensions, comprenant des items de raisonnement sur motifs, conçu pour l'auto-exploration. Ce n'est pas le test des matrices progressives de Raven, il n'est affilié à aucun de ses éditeurs et ne constitue pas une évaluation clinique. Tout score en ligne — le nôtre compris — doit être pris comme un point de départ pour la curiosité, et non comme un verdict.
Obtenez votre score complet avec le test complet
Téléchargement gratuit · test complet en achat intégré unique, sans abonnement
Télécharger BrambinArticles associés
La théorie CHC de l'intelligence : Cattell-Horn-Carroll
Découvrez la théorie CHC de l'intelligence de Cattell-Horn-Carroll : ses origines, ses grandes aptitudes, son utilisation dans les tests modernes et ce qu'elle révèle sur le QI.
ConnaissanceIntelligence fluide vs cristallisée : les deux grands types de capacité cognitive
Découvrez la distinction entre intelligence fluide et cristallisée, deux concepts fondamentaux qui expliquent comment nous raisonnons et ce que nous savons.
ConnaissanceL'échelle de Stanford-Binet : histoire et usage aujourd'hui
Le test de Stanford-Binet expliqué : de l'échelle Binet-Simon de 1905 au SB5 actuel, sa structure, la lecture de ses scores et ses limites réelles.