Wissen

Ravens Matrizen-Test: der sprachfreie Intelligenztest

Ravens Progressive Matrizen sind der bekannteste sprachfreie Denktest der Psychologie. Vorgelegt wird ein unvollständiges Raster abstrakter Figuren, und die Aufgabe besteht darin, das fehlende Element zu bestimmen — ohne Wörter, ohne Rechnen, ohne Allgemeinwissen. Erstmals 1938 veröffentlicht, wird der Test bis heute in der Forschung, in der Personalauswahl und in sprachübergreifenden Untersuchungen eingesetzt, und er ist der direkte Vorfahr der Matrizen-Untertests in nahezu allen modernen Intelligenztestbatterien. Dieser Leitfaden erklärt seine Herkunft, den Aufbau der Aufgaben, was er misst — und was nicht — und wie seine Werte zu lesen sind.

1. Woher Ravens Progressive Matrizen stammen

Entwickelt wurde der Test vom britischen Psychologen John C. Raven, der die erste Fassung 1938 publizierte. Raven hatte zuvor als wissenschaftlicher Assistent von Lionel Penrose an einer Untersuchung zu den Ursachen geistiger Behinderung mitgearbeitet und brauchte ein Verfahren, das sich schnell und außerhalb des Labors einsetzen ließ — bei Menschen mit sehr unterschiedlichem Bildungsstand und unterschiedlicher Lesefähigkeit. Die damals verfügbaren Tests stützten sich stark auf Wortschatz, Allgemeinwissen und sprachliche Instruktionen. Genau das ließ sich schlecht übertragen.

Theoretisch knüpfte Raven an Charles Spearman an, dessen Zweifaktorentheorie einen allgemeinen Faktor (g) annahm, der alle kognitiven Aufgaben durchzieht. Spearman hatte von der „Eduktion von Relationen und Korrelaten" gesprochen: dem geistigen Akt, Beziehungen zwischen Dingen zu erkennen und sie auf neue Fälle zu übertragen. Raven konstruierte die Matrizen als bewusst reine Übung in genau dieser Operation.

Ergänzt wurden sie durch einen Wortschatztest, die Mill Hill Vocabulary Scale, die das erfasste, was Raven reproduktive Fähigkeit nannte: den abrufbaren Bestand an gelerntem Wissen. Die Matrizen maßen die eduktive Fähigkeit: Sinn aus Material zu ziehen, dem keine fertige Bedeutung anhaftet. Zusammen sollten beide ein zweiseitiges Bild ergeben statt einer einzigen Zahl — eine Konstruktionsidee, die in der heutigen Unterscheidung zwischen fluider und kristalliner Intelligenz fortlebt.

Die Langlebigkeit des Verfahrens ist ungewöhnlich. Kaum ein psychologisches Instrument aus den 1930er-Jahren wird fast neunzig Jahre später noch kommerziell verlegt und aktiv neu normiert.

2. Wie eine Matrizenaufgabe aufgebaut ist

Die Originalaufgaben sind urheberrechtlich geschützt, deshalb wird hier keine einzige davon wiedergegeben. Der grundsätzliche Aufbau ist jedoch allgemein bekannt und leicht zu beschreiben.

Eine typische Aufgabe zeigt eine Matrix aus abstrakten Figuren — meist ein 3 × 3-Raster, in den leichtesten Sätzen auch einfachere 2 × 2-Anordnungen oder einzelne Streifen. Das Feld unten rechts bleibt leer. Darunter stehen Antwortalternativen, in der Regel sechs oder acht. Gesucht ist die Figur, die in die Lücke gehört.

Mehrere Konstruktionsmerkmale sind entscheidend:

  • Keine Sprache erforderlich. Die Instruktion lässt sich notfalls pantomimisch geben. Die Aufgaben selbst enthalten keinen Text.
  • Vorwissen hilft nicht. Die Formen sind willkürlich — Pfeile, Punkte, Schraffuren, geometrische Umrisse — und tragen keinen kulturellen oder schulischen Inhalt.
  • Die Schwierigkeit ist „progressiv". Die Aufgaben sind von sehr leicht bis sehr schwer geordnet, sodass die frühen Items die Logik gewissermaßen mitlehren, auf der die späteren aufbauen. Daher der Namensbestandteil „progressiv".
  • Die Distraktoren sind systematisch. Die falschen Alternativen sind nicht zufällig gewählt. Sie bilden meist teilweise korrekte Regelanwendungen ab: die richtige Form mit der falschen Schraffur, die richtige Progression auf der falschen Dimension und so weiter. Deshalb ist Raten bei den schweren Aufgaben unzuverlässig.

Ein Beispiel aus eigener Feder: Man stelle sich eine Zeile vor, in der die Zahl der Punkte pro Feld von links nach rechts um eins zunimmt, während sich die umschließende Form bei jedem Schritt um eine Vierteldrehung dreht. Zwei unabhängige Regeln wirken gleichzeitig, und das fehlende Feld muss beiden genügen. Schwerere Aufgaben schichten mehrere solcher Regeln übereinander.

3. Die wichtigsten Versionen des Tests

Raven hat nie einen einzelnen Test veröffentlicht. Die Matrizen existieren als Familie von Verfahren für unterschiedliche Fähigkeitsbereiche — und der Fähigkeitsbereich entscheidet, welche Version angemessen ist.

Version Kürzel Aufgaben Aufbau Vorgesehen für
Coloured Progressive Matrices CPM 36 3 Sätze zu 12 (A, Ab, B) Jüngere Kinder, ältere Menschen, Personen mit kognitiver Beeinträchtigung
Standard Progressive Matrices SPM 60 5 Sätze zu 12 (A–E) Allgemeinbevölkerung, etwa ab 6 Jahren bis ins Erwachsenenalter
Standard Progressive Matrices Plus SPM+ 60 5 Sätze zu 12 Gleicher Bereich wie SPM, mit schwereren Aufgaben gegen Deckeneffekte
Advanced Progressive Matrices APM 12 + 36 Satz I (Übung), Satz II (gewertet) Erwachsene und Jugendliche im oberen Fähigkeitsbereich
Ravens Progressive Matrizen, 3. Auflage Raven's 2 variabel digital, adaptive Itemauswahl Moderne klinische und berufsbezogene Anwendung

Die CPM arbeitet mit farbigen Hintergründen, die bei jüngeren Kindern die Aufmerksamkeit besser binden und die visuelle Last senken. Die SPM ist die klassische Form, die gemeint ist, wenn jemand schlicht von „dem Raven" spricht. Die APM entstand, weil die SPM das obere Ende der Verteilung staucht — zu viele leistungsstarke Erwachsene stoßen an die Decke —, ihre Aufgaben setzen deshalb dort an, wo die schwersten SPM-Aufgaben aufhören.

Die 2018 bei Pearson erschienene Revision, meist Raven's 2 genannt, hat den Test in ein digitales, computeradaptives Format überführt: Die Schwierigkeit der nächsten Aufgabe richtet sich nach der bisherigen Leistung. Adaptive Vorgabe erreicht eine vergleichbare Messgenauigkeit mit weniger Aufgaben und entschärft Decken- wie Bodeneffekte der festen Formen.

Die Bearbeitungszeit liegt üblicherweise bei 20 bis 45 Minuten. Raven selbst hatte die SPM ohne Zeitlimit konzipiert und sie als Test der Denkfähigkeit, nicht der Geschwindigkeit verstanden; die Vorgabe unter Zeitdruck kam später auf — und sie verändert, was der Wert abbildet.

4. Was der Test tatsächlich misst

In faktorenanalytischen Untersuchungen laden Ravens Matrizen sehr hoch auf fluide Intelligenz (Gf) und darüber auf g. In der psychometrischen Literatur gelten sie routinemäßig als einer der stärksten Einzelindikatoren allgemeiner Intelligenz, die verfügbar sind — genau deshalb greifen Forschende so häufig darauf zurück, wenn sie einen kurzen Stellvertreter für g brauchen.

Kognitiv verlangt der Test:

  • Regelinduktion — aus wenigen Beispielen eine abstrakte Regelmäßigkeit erschließen.
  • Arbeitsgedächtnis und Zielverwaltung — mehrere halbfertige Teilziele gleichzeitig im Kopf behalten, während Regelhypothesen geprüft werden.
  • Aufmerksamkeit für die relevante Dimension — entscheiden, welches der vielen visuellen Merkmale (Form, Anzahl, Schraffur, Orientierung, Größe, Position) das Muster tatsächlich trägt.

Die klassische kognitive Analyse stammt von Carpenter, Just und Shell (1990). Sie modellierten die Bearbeitung der APM im Detail und kamen zu dem Schluss, dass sich die schwereren Aufgaben vor allem durch die Zahl der gleichzeitig zu verwaltenden Regeln und durch die Belastung der Zielverwaltung im Arbeitsgedächtnis unterscheiden. Sie katalogisierten eine überschaubare Zahl wiederkehrender Regeltypen:

Regeltyp Was er bewirkt
Konstanz in der Zeile Ein Merkmal bleibt innerhalb einer Zeile gleich und wechselt zwischen den Zeilen
Quantitative paarweise Progression Ein Merkmal nimmt entlang der Zeile in festen Schritten zu oder ab
Figurenaddition oder -subtraktion Zwei Felder werden kombiniert oder eines vom anderen abgezogen, was das dritte ergibt
Verteilung von drei Drei Ausprägungen eines Merkmals kommen je einmal pro Zeile und Spalte vor
Verteilung von zwei Zwei Ausprägungen kommen vor, eine bleibt in jeder Zeile leer

Diese Liste macht etwas deutlich: Gemessen wird keine „visuelle Begabung" im engen Sinn. Gemessen wird, wie effizient jemand unter Belastung abstrakte Hypothesen bildet, prüft und festhält.

Bildgebende Arbeiten haben die Leistung in Matrizenaufgaben mit einem verteilten frontoparietalen Netzwerk in Verbindung gebracht — das Muster, das Jung und Haier in ihrer parieto-frontalen Integrationstheorie (2007) zusammengefasst haben. Diese Befunde beschreiben Korrelate von Leistung; sie verorten „Intelligenz" nicht an einer Stelle im Gehirn.

5. Die Frage der Kulturfairness

Ravens Matrizen werden häufig als „kulturfrei" oder „kulturfair" bezeichnet. Der erste Begriff ist falsch, der zweite bestenfalls eine Näherung.

Richtig ist, dass der Test die auffälligsten kulturellen Hürden beseitigt: keine Sprache, kein Wortschatz, keine Lehrplaninhalte, keine kulturspezifischen Gegenstände. Das ist ein echter Vorteil und der Grund, warum sich das Verfahren so weit in die sprachübergreifende Forschung und in Situationen ausgebreitet hat, in denen Testleitung und Testperson keine gemeinsame Sprache haben.

Aber kulturreduziert ist nicht dasselbe wie kulturfrei. Die Leistung hängt weiterhin von Voraussetzungen ab, die ungleich verteilt sind:

  • Vertrautheit mit zweidimensionalen abstrakten Figuren, die sich weitgehend aus formaler Beschulung und aus dem Umgang mit gedruckten und bildschirmbasierten Darstellungen speist.
  • Testkonventionen — Multiple-Choice-Formate, die Annahme, dass genau eine Antwort „richtig" ist, allein und schweigend gegen die Uhr zu arbeiten.
  • Der Umfang der Schulbildung, der mit der Matrizenleistung zusammenhängt, unabhängig davon, welche Inhalte dort vermittelt wurden.

Der heutige Konsens der Psychometrie lautet: Kein Test ist kulturfrei, Ravens Matrizen verringern bestimmte Verzerrungsquellen erheblich — und diese Verringerung sollte nicht zu einem Anspruch auf universelle Vergleichbarkeit zwischen Populationen aufgeblasen werden.

6. Ravens Matrizen und der Flynn-Effekt

Der Flynn-Effekt — der langfristige Anstieg der durchschnittlichen Rohwerte in kognitiven Tests im 20. Jahrhundert — wurde am deutlichsten an Tests vom Raven-Typ dokumentiert. James Flynn und andere stellten fest, dass die Zugewinne im abstrakten Matrizendenken erheblich größer ausfielen als bei Wortschatz- oder Wissenstests, in manchen nationalen Datensätzen in der Größenordnung einer Standardabweichung pro Generation.

Für die Lesart „kulturfair" ist das ein unbequemes Ergebnis. Würden die Matrizen eine feste biologische Kapazität erfassen, die von der Umwelt unberührt bleibt, hätten die Werte aufeinanderfolgender Generationen nicht so stark nach oben driften dürfen. Die führenden Erklärungen verweisen stattdessen auf Veränderungen der Umwelt: mehr Schuljahre, eine visuelle Umgebung voller Diagramme und Symbole und — Flynns eigene bevorzugte Deutung — eine kulturelle Verschiebung hin zum gewohnheitsmäßigen Gebrauch abstrakter, hypothetischer, klassifizierender Kategorien anstelle konkreter.

Daraus folgen zwei praktische Konsequenzen. Erstens: Normen veralten. Derselbe Rohwert ergibt an Normen von 1979 gemessen ein anderes Ergebnis als an Normen von 2018 — und die älteren Normen schmeicheln. Zweitens: Eine steigende Durchschnittsleistung in einem Test ist nicht dasselbe wie eine in jeder Hinsicht intelligenter werdende Bevölkerung; die Zugewinne fielen über die kognitiven Bereiche hinweg sehr ungleich aus, und genau das ist der aufschlussreichste Teil des Befunds.

7. Wie Raven-Werte berichtet werden

Der Rohwert ist schlicht die Zahl der richtig gelösten Aufgaben — von 60 in der SPM, von 36 in Satz II der APM. Diese Zahl bedeutet für sich genommen nichts. Interpretierbar wird sie erst im Vergleich mit einer Normtabelle für die passende Altersgruppe und Population, die sie in ein Perzentil überführt.

Manche Verlage rechnen das Perzentil zusätzlich in eine Standardwertskala mit Mittelwert 100 und Standardabweichung 15 um, damit sich Ergebnisse neben IQ-Werten vom Wechsler-Typ diskutieren lassen. Diese Umrechnung ist eine Bequemlichkeit, keine Gleichsetzung: Ein aus Raven-Werten abgeleiteter Standardwert und ein Gesamt-IQ aus dem HAWIE/WAIS beruhen auf unterschiedlichen Inhalten und sind nicht austauschbar.

Für jede aus Ravens Matrizen abgeleitete Zahl gelten drei Vorbehalte:

  1. Sie erfasst nur einen Bereich. Die Matrizen messen fluides, sprachfreies Denken. Über Sprachverständnis, erworbenes Wissen oder Verarbeitungsgeschwindigkeit sagen sie nichts. Genau deshalb tastet eine vollständige Testbatterie mehrere Bereiche ab.
  2. Sie ist mit Messfehler behaftet. Wie bei jedem Test ist ein beobachteter Wert eine Schätzung. Das 95-%-Konfidenzintervall um einen gut normierten Wert umspannt typischerweise mehrere Punkte in beide Richtungen.
  3. Übung verändert den Wert, nicht die Person. Wer viele Matrizenaufgaben bearbeitet hat, wird besser in Matrizenaufgaben. Dieser Zugewinn spiegelt Vertrautheit mit dem Aufgabenformat und den wiederkehrenden Regeltypen wider — aufgabenspezifisches Lernen — und ist nicht als Veränderung der zugrunde liegenden allgemeinen Fähigkeit zu lesen.

8. Wo Ihnen Matrizen heute begegnen

Auch wer den Raven-Test selbst nie bearbeitet, ist seinem Konstruktionsprinzip mit hoher Wahrscheinlichkeit schon begegnet. Matrizen-Test ist ein Kernuntertest im WAIS-IV und im WISC-V. Vergleichbare figurale Matrizenaufgaben finden sich im Stanford-Binet, im Culture Fair Test von Cattell (im deutschsprachigen Raum als CFT bekannt), im Naglieri Nonverbal Ability Test, in beruflichen Eignungstests und in einem Großteil der frei kursierenden Online-Tests.

Einzelne nationale Landesverbände von Hochbegabtenvereinigungen haben beaufsichtigt erhobene Werte aus den Advanced Progressive Matrices als Aufnahmenachweis akzeptiert; die Kriterien unterscheiden sich jedoch von Land zu Land und ändern sich über die Zeit. Wer diesen Weg erwägt, sollte die aktuellen Anforderungen direkt bei der Organisation erfragen statt sich auf Listen aus zweiter Hand zu verlassen.

Online-Matrizentests, darunter die Musteraufgaben im Brambin-Profil, folgen derselben zugrunde liegenden Logik, sind aber nicht das markenrechtlich geschützte Raven-Verfahren und werden nicht unter standardisierten Bedingungen vorgegeben. Für Neugier und Selbsterkundung sind sie nützlich. Klinische Untersuchungen sind sie nicht und können solche auch nicht ersetzen.

Häufig gestellte Fragen

Sind Ravens Progressive Matrizen ein IQ-Test?

Es handelt sich um einen Test sprachfreien fluiden Denkens, der sehr hoch mit allgemeiner Intelligenz zusammenhängt, und seine Ergebnisse werden häufig auf eine IQ-ähnliche Skala mit Mittelwert 100 und Standardabweichung 15 umgerechnet. Er erfasst allerdings einen Bereich statt der mehreren, die eine vollständige Batterie wie das WAIS abdeckt — ein Raven-Ergebnis und ein Gesamt-IQ sind deshalb nicht dieselbe Größe, auch wenn beide auf derselben Skala gedruckt werden.

Wie lange dauert der Test?

Das hängt von der Version und der Vorgabeform ab. Die Standard Progressive Matrices dauern üblicherweise 20 bis 45 Minuten; in Gruppenvorgaben mit Zeitlimit sind 45 Minuten verbreitet. Raven hatte den Test ursprünglich ohne Zeitbegrenzung konzipiert, weil ihn die Denkfähigkeit und nicht das Tempo interessierte; in manchen Forschungskontexten wird bis heute ohne Zeitlimit vorgegeben.

Ist der Raven-Test wirklich kulturfrei?

Nein. Treffender ist die Bezeichnung kulturreduziert. Der Verzicht auf Sprache und Lehrplaninhalte beseitigt einige große Verzerrungsquellen, doch die Leistung hängt weiterhin von der Vertrautheit mit abstrakten zweidimensionalen Figuren, von formaler Beschulung und von Testkonventionen ab — alles Faktoren, die sich zwischen Lebensumfeldern unterscheiden. Die meisten Fachleute halten den Begriff kulturfrei heute für überzogen.

Wird man durch Übung besser in Aufgaben vom Raven-Typ?

Die Leistung in Matrizenaufgaben verbessert sich mit Übung, weil die wiederkehrenden Regeltypen vertraut werden und das Format seine Überraschung verliert. Die Forschung stützt jedoch die Deutung, dass es sich um aufgabenspezifisches Lernen handelt: Der Zugewinn zeigt sich in der geübten Aufgabe und überträgt sich schlecht auf andere kognitive Anforderungen. Als Veränderung der allgemeinen Denkfähigkeit ist er nicht zu lesen — und er ist einer der Gründe, warum Fachleute Werte aus kurz zuvor wiederholten Tests zurückhaltend bewerten.

Warum gibt es so viele verschiedene Versionen?

Weil eine einzelne Form mit 60 Aufgaben nicht über den gesamten Fähigkeitsbereich hinweg genau messen kann. Die farbige Fassung existiert, damit jüngere Kinder und Erwachsene mit kognitiver Beeinträchtigung nicht am Boden eines zu schweren Tests hängen bleiben; die Advanced-Fassung existiert, damit leistungsstarke Erwachsene nicht an die Decke eines zu leichten stoßen. Die moderne adaptive Ausgabe löst beide Probleme zugleich, indem sie die Aufgaben nach der gezeigten Leistung auswählt.

Wo kann ich echte Raven-Aufgaben ansehen?

Auf legalem Weg nirgends öffentlich. Die Aufgaben sind urheberrechtlich geschütztes, lizenziert verlegtes Material, und ihre Geheimhaltung hat einen Zweck: Eine Aufgabe, die breit kursiert, misst nicht mehr das, wofür sie normiert wurde. Es gibt Übungsmaterial, das das Format nachahmt, doch es ist nicht der Test, und seine Ergebnisse sind mit normierten Raven-Werten nicht vergleichbar.

Zusammenfassung

Ravens Progressive Matrizen halten sich seit 1938, weil sie eine Sache außerordentlich gut können: abstrakte Regelinduktion von Sprache, Wissen und Lehrplan zu trennen. Das macht sie zu einem der reinsten verfügbaren Indikatoren fluiden Denkens und zu einem der meistgenutzten Forschungsinstrumente des Feldes.

Ihre Grenzen sind ebenso klar. Sie erfassen einen einzelnen kognitiven Bereich. Sie sind kulturreduziert, nicht kulturfrei. Ihre Normen driften, wie der Flynn-Effekt an diesem Test deutlicher gezeigt hat als an jedem anderen. Und ein daraus abgeleiteter Wert ist eine Schätzung mit Vertrauensband, keine feste Eigenschaft einer Person.

Neben anderen Informationen gelesen, ist ein Matrizenergebnis wirklich aufschlussreich. Allein und als Urteil gelesen, soll es weit mehr tragen, als es je tragen sollte.


Brambin bietet ein kognitives Profil über acht Dimensionen, darunter Aufgaben zum Mustererkennen, zur Selbsterkundung. Es ist nicht der Test Ravens Progressive Matrizen, steht in keiner Verbindung zu dessen Verlag und ist keine klinische Untersuchung. Betrachten Sie jedes Online-Ergebnis — auch unseres — als Ausgangspunkt für Neugier, nicht als Urteil.

Ihr vollständiges Ergebnis mit dem ganzen Test

Kostenloser Download · vollständiger Test als einmaliger In-App-Kauf, kein Abo

Brambin herunterladen
App herunterladen