Conocimiento

Matrices Progresivas de Raven: el test de CI no verbal

Las Matrices Progresivas de Raven son la prueba de razonamiento no verbal más conocida de la psicología. Presentan una cuadrícula incompleta de figuras abstractas y piden a la persona evaluada que deduzca qué pieza completa el patrón: sin palabras, sin cálculo y sin conocimientos generales. Publicadas por primera vez en 1938, siguen usándose hoy en investigación, en cribados de selección de personal y en evaluación entre hablantes de distintas lenguas, y son el antepasado directo de los subtests de razonamiento matricial que incorporan casi todas las baterías de CI modernas. Esta guía explica de dónde vienen, cómo se construyen sus ítems, qué miden realmente y cómo deben leerse sus puntuaciones.

1. El origen de las Matrices Progresivas de Raven

La prueba fue creada por el psicólogo británico John C. Raven, que publicó la primera versión en 1938. Raven había trabajado como ayudante de investigación de Lionel Penrose en un estudio sobre los orígenes de la discapacidad intelectual, y necesitaba un instrumento que pudiera aplicarse con rapidez, sobre el terreno, a personas con niveles de alfabetización y escolarización muy dispares. Los tests de la época se apoyaban intensamente en vocabulario, cultura general e instrucciones verbales, y nada de eso viajaba bien.

El punto de partida teórico de Raven procedía de Charles Spearman, cuya teoría bifactorial de la inteligencia postulaba un factor general (g) presente en todas las tareas cognitivas. Spearman había descrito la "educción de relaciones y correlatos": el acto mental de percibir cómo se relacionan las cosas entre sí y extender esa relación a casos nuevos. Raven diseñó las matrices como un ejercicio deliberadamente puro de esa operación.

Las emparejó con una prueba de vocabulario (la Escala de Vocabulario Mill Hill), que medía lo que él llamaba capacidad reproductiva: el caudal de información aprendida que una persona puede recuperar. Las matrices medían la capacidad eductiva: dar sentido a un material que no trae significado incorporado. El par pretendía ofrecer un retrato de dos caras en lugar de un número único, una idea de diseño que sobrevive hoy en la distinción entre inteligencia fluida y cristalizada.

La longevidad del test es insólita. Muy pocos instrumentos psicológicos de los años treinta siguen publicándose comercialmente y rebaremándose casi noventa años después.

2. Cómo es realmente un ítem de matrices

Los ítems de Raven están protegidos por derechos de autor, así que aquí no se reproduce ninguno auténtico. Su estructura general, en cambio, es de dominio público y fácil de describir.

Un ítem típico muestra una matriz de figuras abstractas, habitualmente una cuadrícula de 3 × 3, aunque los conjuntos más fáciles usan disposiciones de 2 × 2 o una sola tira. La casilla inferior derecha está vacía. Debajo de la matriz aparece un conjunto de piezas candidatas, normalmente seis u ocho. La tarea consiste en identificar cuál corresponde a la casilla en blanco.

Varios rasgos del diseño importan:

  • No hace falta lenguaje. Las instrucciones pueden darse incluso por gestos. Los ítems no contienen texto.
  • Los conocimientos previos no ayudan. Las figuras son arbitrarias — flechas, puntos, tramas, contornos geométricos — y no transportan contenido cultural ni escolar.
  • La dificultad es "progresiva". Los ítems se ordenan de muy fáciles a muy difíciles, de modo que los primeros enseñan en la práctica la lógica de la que dependen los últimos. De ahí el término "Progresivas" del nombre.
  • Los distractores son sistemáticos. Las respuestas incorrectas no son aleatorias: suelen representar aplicaciones parcialmente correctas de la regla — la forma adecuada con el sombreado equivocado, la progresión correcta aplicada a la dimensión equivocada, y así sucesivamente. Por eso adivinar resulta poco fiable en los ítems difíciles.

Un ejemplo de elaboración propia: imagina una fila en la que el número de puntos de cada casilla aumenta de uno en uno de izquierda a derecha, mientras la figura que los envuelve gira un cuarto de vuelta en cada paso. Operan dos reglas independientes a la vez, y la casilla que falta debe satisfacer ambas. Los ítems más difíciles acumulan varias reglas de este tipo.

3. Las principales versiones del test

Raven nunca publicó un test único. Las matrices existen como una familia de instrumentos dirigidos a distintos rangos de capacidad, y es precisamente el rango de capacidad lo que determina cuál resulta apropiado.

Versión Sigla Ítems Estructura Destinada a
Matrices Progresivas en Color CPM 36 3 series de 12 (A, Ab, B) Niños pequeños, personas mayores, personas con deterioro cognitivo
Matrices Progresivas Estándar SPM 60 5 series de 12 (A–E) Población general, desde unos 6 años hasta la edad adulta
Matrices Progresivas Estándar Plus SPM+ 60 5 series de 12 Mismo rango que la SPM, con ítems más difíciles para reducir el efecto techo
Matrices Progresivas Avanzadas APM 12 + 36 Serie I (práctica), Serie II (puntuada) Adultos y adolescentes del rango superior de capacidad
Matrices Progresivas de Raven, 3.ª ed. Raven's 2 Variable Digital, selección adaptativa de ítems Uso clínico y laboral actual

Las CPM utilizan fondos de color, que mantienen mejor la atención de los niños pequeños y reducen la carga visual. Las SPM son la forma clásica a la que casi todo el mundo se refiere al decir "el Raven". Las APM se desarrollaron porque las SPM comprimen la parte alta de la distribución — demasiados adultos capaces alcanzan el techo —, de manera que sus ítems empiezan donde terminan los más difíciles de las SPM.

La revisión de 2018 publicada por Pearson, conocida habitualmente como Raven's 2, llevó la prueba a un formato digital adaptativo por ordenador, en el que la dificultad del siguiente ítem depende del rendimiento previo. La aplicación adaptativa alcanza una precisión comparable con menos ítems y reduce los problemas de techo y de suelo de las versiones de forma fija.

La aplicación dura por lo general entre 20 y 45 minutos. Raven concibió originalmente las SPM sin límite de tiempo, entendiéndolas como una medida de potencia de razonamiento y no de velocidad; la aplicación cronometrada se generalizó después, y cambia lo que la puntuación refleja.

4. Qué mide realmente la prueba

En los estudios de análisis factorial, las matrices de Raven saturan de forma muy alta en inteligencia fluida (Gf) y, a través de ella, en g. La literatura psicométrica la describe habitualmente como uno de los marcadores de inteligencia general más potentes que puede obtenerse con un solo test, y por eso los investigadores que necesitan un indicador breve de g recurren a ella con tanta frecuencia.

Cognitivamente, lo que exige es:

  • Inducción de reglas: inferir una regularidad abstracta a partir de unos pocos ejemplos.
  • Memoria de trabajo y gestión de metas: sostener a la vez varios subobjetivos resueltos a medias mientras se ponen a prueba reglas candidatas.
  • Atención a las dimensiones relevantes: decidir cuál de los muchos atributos visuales (forma, número, sombreado, orientación, tamaño, posición) es el que realmente porta el patrón.

El análisis cognitivo clásico es el de Carpenter, Just y Shell (1990), que modelaron en detalle el rendimiento en las APM y concluyeron que los ítems más duros se distinguían sobre todo por el número de reglas que había que manejar simultáneamente y por la exigencia de gestión de metas en la memoria de trabajo. Catalogaron un número reducido de tipos de regla recurrentes:

Tipo de regla En qué consiste
Constante en la fila Un atributo se mantiene igual a lo largo de la fila y cambia entre filas
Progresión cuantitativa por pares Un atributo aumenta o disminuye en pasos fijos a lo largo de la fila
Suma o resta de figuras Dos casillas se combinan, o una se sustrae de otra, para dar la tercera
Distribución de tres Tres valores de un atributo aparecen una vez cada uno por fila y por columna
Distribución de dos Aparecen dos valores y uno queda nulo en cada fila

Conviene reparar en lo que implica esta lista: la prueba no mide "capacidad visual" en ningún sentido estrecho. Mide con qué eficiencia alguien puede generar, contrastar y retener hipótesis abstractas bajo carga.

Los trabajos de neuroimagen han asociado el rendimiento en razonamiento matricial con una red frontoparietal distribuida, el patrón resumido por la teoría de integración parietofrontal de Jung y Haier (2007). Estos hallazgos describen correlatos del rendimiento; no localizan "la inteligencia" en un punto del cerebro.

5. La cuestión de la equidad cultural

A las matrices de Raven se las llama con frecuencia "libres de cultura" o "justas culturalmente". Lo primero es sencillamente falso y lo segundo es, en el mejor de los casos, una aproximación.

Es cierto que la prueba elimina las barreras culturales más evidentes: nada de lengua, nada de vocabulario, nada de contenidos curriculares, ningún objeto culturalmente específico. Es una ventaja real, y explica por qué se extendió tanto en la investigación entre distintas lenguas y en contextos donde examinador y examinado no comparten idioma.

Pero cultura reducida no equivale a cultura ausente. El rendimiento sigue dependiendo de factores que están repartidos de forma desigual:

  • La familiaridad con figuras abstractas bidimensionales, que es en gran medida producto de la escolarización formal y de la exposición a material impreso y a pantallas.
  • Las convenciones de examen: el formato de opción múltiple, el supuesto de que hay una única respuesta "correcta", trabajar en silencio, a solas y contrarreloj.
  • La cantidad de escolarización, que correlaciona con el rendimiento en matrices con independencia de los contenidos concretos de esa escolarización.

La posición de consenso en la psicometría actual es que ningún test está libre de cultura, que el de Raven reduce sustancialmente ciertas fuentes de sesgo y que esa reducción no debe exagerarse hasta convertirla en una afirmación de comparabilidad universal entre poblaciones.

6. Las matrices de Raven y el efecto Flynn

El efecto Flynn — el ascenso sostenido de las puntuaciones directas medias en pruebas cognitivas a lo largo del siglo XX — se documentó de la forma más espectacular precisamente en pruebas del tipo Raven. James Flynn y otros investigadores hallaron que las ganancias en razonamiento matricial abstracto eran bastante mayores que las obtenidas en pruebas de vocabulario o de cultura general, y en algunos conjuntos de datos nacionales llegaban al orden de una desviación típica por generación.

Es un resultado genuinamente incómodo para la lectura de la prueba como instrumento "justo culturalmente". Si las matrices midieran una capacidad biológica fija e intocada por el entorno, las puntuaciones de generaciones sucesivas no habrían derivado hacia arriba de manera tan pronunciada. Las explicaciones dominantes apuntan más bien al cambio ambiental: más años de escolarización, un entorno visual saturado de diagramas y símbolos y — la explicación preferida por el propio Flynn — un desplazamiento cultural hacia el uso habitual de categorías abstractas, hipotéticas y clasificatorias en lugar de concretas.

De ahí se siguen dos consecuencias prácticas. Primera: los baremos caducan. Una misma puntuación directa interpretada con baremos de 1979 y con baremos de 2018 da resultados distintos, y los baremos antiguos favorecen a quien se examina. Segunda: que el rendimiento medio en un test suba no equivale a que una población se haya vuelto más inteligente en todos los aspectos; las ganancias fueron muy desiguales entre dominios cognitivos, y esa desigualdad es la parte más informativa del hallazgo.

7. Cómo se informan las puntuaciones de Raven

La puntuación directa es simplemente el número de ítems acertados: sobre 60 en las SPM, sobre 36 en la Serie II de las APM. Ese número, por sí solo, no significa nada. Solo se vuelve interpretable al compararlo con una tabla de baremos del grupo de edad y de la población adecuados, que lo convierte en un percentil.

Algunos editores convierten además el percentil a una escala de puntuación típica con media 100 y desviación típica 15, para poder comentar los resultados junto a las puntuaciones de CI de tipo Wechsler. Esa conversión es una comodidad, no una equivalencia: una puntuación típica derivada del Raven y un CI total del WAIS se construyen con contenidos distintos y no son intercambiables.

Toda cifra derivada del Raven exige tres cautelas:

  1. Es una medida de un solo dominio. Las matrices evalúan razonamiento fluido no verbal. No dicen nada sobre comprensión verbal, conocimientos adquiridos o velocidad de procesamiento. Una batería completa muestrea varios dominios exactamente por este motivo.
  2. Arrastra error de medida. Como en cualquier prueba, la puntuación observada es una estimación. El intervalo de confianza del 95 % en torno a una puntuación bien baremizada suele abarcar varios puntos a cada lado del valor observado.
  3. La práctica cambia la puntuación, no a la persona. Quien ha resuelto muchos rompecabezas de matrices mejora en rompecabezas de matrices. Esa mejora refleja familiaridad con el formato de los ítems y con los tipos de regla recurrentes — aprendizaje específico de la tarea — y no debe leerse como un cambio en la capacidad general subyacente.

8. Dónde te encontrarás matrices hoy

Aunque nunca llegues a pasar el Raven propiamente dicho, casi con seguridad ya te has topado con su diseño. Matrices es un subtest nuclear del WAIS-IV y del WISC-V. Tareas de matrices figurativas comparables aparecen en el Stanford-Binet, en el test de Factor G de Cattell, en el Test de Aptitud No Verbal de Naglieri, en baterías de aptitudes para selección de personal y en buena parte de los tests gratuitos que circulan por internet.

Algunas delegaciones nacionales de sociedades de alto CI han aceptado puntuaciones supervisadas de las Matrices Progresivas Avanzadas como parte de las pruebas de admisión, aunque los criterios varían de un país a otro y cambian con el tiempo; quien siga esa vía debería consultar los requisitos vigentes directamente con la organización y no fiarse de listados de segunda mano.

Los tests de matrices en línea, incluidos los ítems de razonamiento con patrones del perfil de Brambin, emplean la misma lógica de fondo, pero no son el instrumento registrado de Raven ni se aplican en condiciones estandarizadas. Sirven para la curiosidad y el autoconocimiento. No son evaluaciones clínicas y no pueden sustituirlas.

Preguntas frecuentes

¿Son las Matrices Progresivas de Raven un test de CI?

Son una prueba de razonamiento fluido no verbal que correlaciona muy intensamente con la inteligencia general, y sus resultados se convierten a menudo a una escala tipo CI con media 100 y desviación típica 15. Pero miden un solo dominio, y no los varios que abarca una batería completa como el WAIS, así que un resultado del Raven y un CI total no son la misma magnitud aunque se impriman en la misma escala.

¿Cuánto dura la prueba?

Depende de la versión y del protocolo de aplicación. Las Matrices Progresivas Estándar suelen llevar entre 20 y 45 minutos; en aplicaciones colectivas cronometradas es habitual un límite de 45 minutos. Raven la diseñó originalmente sin límite de tiempo, por considerar que lo relevante era la potencia de razonamiento y no la velocidad, y la aplicación sin cronómetro se sigue empleando en algunos contextos de investigación.

¿Está el Raven realmente libre de influencia cultural?

No. Se describe mejor como una prueba de influencia cultural reducida. Eliminar la lengua y los contenidos curriculares suprime algunas fuentes importantes de sesgo, pero el rendimiento sigue dependiendo de la familiaridad con figuras abstractas bidimensionales, de la escolarización formal y de las convenciones de examen, factores que varían de un entorno a otro. Hoy la mayoría de los psicómetras considera la etiqueta "libre de cultura" una exageración.

¿Se puede rendir mejor en rompecabezas tipo Raven practicando?

El rendimiento en rompecabezas de matrices sí mejora con la práctica, porque los tipos de regla recurrentes se vuelven familiares y el formato deja de sorprender. Lo que respalda la investigación es que se trata de aprendizaje específico de la tarea: la mejora aparece en la tarea practicada y se transfiere mal a tareas cognitivas no relacionadas. No debe interpretarse como un cambio en la capacidad general de razonamiento, y es una de las razones por las que los clínicos descuentan las puntuaciones de pruebas repetidas hace poco.

¿Por qué existen tantas versiones distintas?

Porque una única forma de 60 ítems no puede medir con precisión en todo el rango de capacidad. La versión en Color existe para que los niños pequeños y los adultos con deterioro cognitivo no queden atrapados en el suelo de una prueba demasiado difícil; la versión Avanzada existe para que los adultos capaces no queden atrapados en el techo de una demasiado fácil. La edición adaptativa moderna resuelve ambos problemas a la vez seleccionando los ítems en función del rendimiento.

¿Dónde puedo ver ítems reales del Raven?

En abierto y de forma legítima, en ningún sitio. Los ítems son material protegido por derechos de autor y publicado bajo licencia, y su seguridad importa: un ítem que ha circulado ampliamente deja de medir aquello para lo que fue baremizado. Existe material de práctica que imita el formato, pero no es la prueba, y sus puntuaciones no son comparables con resultados baremizados del Raven.

Resumen

Las Matrices Progresivas de Raven han perdurado desde 1938 porque hacen una cosa excepcionalmente bien: aíslan la inducción de reglas abstractas del lenguaje, del conocimiento y del currículo escolar. Eso las convierte en uno de los marcadores más puros de razonamiento fluido disponibles y en uno de los instrumentos de investigación más utilizados del campo.

Sus límites son igual de nítidos. Miden un único dominio cognitivo. Son de influencia cultural reducida, no ausente. Sus baremos se desplazan, como demostró el efecto Flynn de forma más vívida en esta prueba que en ninguna otra. Y una puntuación obtenida con ellas es una estimación con banda de confianza, no una propiedad fija de una persona.

Leído junto a otras evidencias, un resultado de razonamiento matricial resulta genuinamente informativo. Leído a solas, como veredicto, se le está pidiendo que sostenga mucho más de lo que jamás se construyó para sostener.


Brambin ofrece un perfil cognitivo de ocho dimensiones que incluye ítems de razonamiento con patrones y está diseñado para el autoconocimiento. No es el test de las Matrices Progresivas de Raven, no está afiliado a su editorial y no constituye una evaluación clínica. Cualquier puntuación en línea — incluida la nuestra — debería tomarse como un punto de partida para la curiosidad, no como un veredicto.

Consigue tu puntuación completa con el test completo

Descarga gratuita · el test completo es una compra única dentro de la app, sin suscripción

Descargar Brambin
Descargar App