Kiến thức

Ma trận Raven: Bài kiểm tra IQ phi ngôn ngữ nổi tiếng nhất

Ma trận tiến triển Raven (Raven's Progressive Matrices) là bài kiểm tra suy luận phi ngôn ngữ được biết đến rộng rãi nhất trong tâm lý học. Người làm bài nhìn một lưới hình trừu tượng còn khuyết một ô và phải tìm ra mảnh ghép hoàn thiện quy luật — không chữ nghĩa, không tính toán, không kiến thức phổ thông. Xuất bản lần đầu năm 1938, bài kiểm tra này vẫn đang được dùng trong nghiên cứu, sàng lọc tuyển dụng và đánh giá xuyên ngôn ngữ, đồng thời là tổ tiên trực tiếp của các tiểu trắc nghiệm suy luận ma trận trong hầu hết bộ trắc nghiệm IQ hiện đại. Bài viết này giải thích nguồn gốc, cách xây dựng câu hỏi, những gì nó đo và không đo, cùng cách đọc điểm số cho đúng.

1. Ma trận Raven ra đời từ đâu

Bài kiểm tra do nhà tâm lý học người Anh John C. Raven tạo ra, phiên bản đầu tiên công bố năm 1938. Trước đó Raven làm trợ lý nghiên cứu cho Lionel Penrose trong một công trình về nguồn gốc của khuyết tật trí tuệ, và ông cần một công cụ có thể triển khai nhanh, ngay tại thực địa, cho những người có trình độ học vấn và khả năng đọc viết rất khác nhau. Các bài trắc nghiệm đương thời phụ thuộc nặng vào từ vựng, kiến thức phổ thông và hướng dẫn bằng lời — tất cả đều "đi xa" rất kém.

Nền tảng lý thuyết của Raven đến từ Charles Spearman, người đề xuất thuyết hai nhân tố với một nhân tố tổng quát (g) chạy xuyên suốt mọi nhiệm vụ nhận thức. Spearman mô tả khái niệm "rút ra quan hệ và tương liên" — hành động tinh thần nhận ra các sự vật liên hệ với nhau ra sao rồi mở rộng quan hệ đó sang trường hợp mới. Raven thiết kế ma trận như một bài tập cố ý thuần khiết cho đúng thao tác ấy.

Ông ghép ma trận với một bài trắc nghiệm từ vựng (thang Mill Hill Vocabulary Scale) để đo cái ông gọi là năng lực tái tạo: kho thông tin đã học mà một người có thể gợi lại. Ma trận đo năng lực rút ra: khả năng tạo nghĩa cho chất liệu vốn chưa gắn sẵn ý nghĩa nào. Cặp công cụ này nhằm cho một bức tranh hai mặt thay vì một con số duy nhất — ý tưởng thiết kế vẫn còn sống đến nay trong sự phân biệt giữa trí thông minh linh hoạt và trí thông minh kết tinh.

Tuổi thọ của bài kiểm tra là điều hiếm thấy. Rất ít công cụ tâm lý học từ thập niên 1930 còn được xuất bản thương mại và chuẩn hóa lại tích cực sau gần chín mươi năm.

2. Một câu hỏi ma trận trông như thế nào

Các câu hỏi của Raven có bản quyền, nên ở đây không tái hiện bất kỳ câu hỏi thật nào. Tuy vậy, cấu trúc chung là kiến thức công khai và dễ mô tả.

Một câu hỏi điển hình cho thấy một ma trận các hình trừu tượng — thường là lưới 3 × 3, dù các bộ dễ nhất dùng bố cục 2 × 2 hoặc một dải đơn giản hơn. Ô dưới cùng bên phải để trống. Bên dưới ma trận là một dãy mảnh ghép ứng viên, thường là sáu hoặc tám. Nhiệm vụ là xác định mảnh nào thuộc về ô trống.

Vài đặc điểm thiết kế đáng chú ý:

  • Không cần ngôn ngữ. Hướng dẫn có thể diễn đạt bằng cử chỉ nếu cần. Bản thân câu hỏi không chứa chữ.
  • Kiến thức có sẵn không giúp ích. Các hình là tùy ý — mũi tên, chấm, vạch gạch, đường viền hình học — và không mang nội dung văn hóa hay học đường nào.
  • Độ khó "tiến triển". Câu hỏi được xếp từ rất dễ đến rất khó, nên các câu đầu thực chất dạy luôn thứ logic mà các câu sau dựa vào. Chữ "tiến triển" trong tên gọi đến từ đây.
  • Phương án nhiễu có hệ thống. Đáp án sai không hề ngẫu nhiên. Chúng thường thể hiện việc áp dụng quy luật đúng một nửa: đúng hình nhưng sai sắc độ, đúng quy luật tăng tiến nhưng áp lên chiều thuộc tính khác. Đó là lý do đoán mò trở nên vô ích ở các câu khó.

Một minh họa do chúng tôi tự dựng: hãy hình dung một hàng trong đó số chấm ở mỗi ô tăng thêm một từ trái sang phải, đồng thời hình bao quanh chúng xoay một phần tư vòng ở mỗi bước. Hai quy luật độc lập vận hành cùng lúc, và ô còn thiếu phải thỏa mãn cả hai. Các câu khó hơn chồng thêm nhiều quy luật như vậy.

3. Các phiên bản chính của bài kiểm tra

Raven chưa bao giờ công bố một bài kiểm tra duy nhất. Ma trận tồn tại như một họ công cụ nhắm vào những dải năng lực khác nhau, và chính dải năng lực quyết định nên dùng bản nào.

Phiên bản Viết tắt Số câu Cấu trúc Dành cho
Coloured Progressive Matrices CPM 36 3 bộ 12 câu (A, Ab, B) Trẻ nhỏ, người cao tuổi, người có suy giảm nhận thức
Standard Progressive Matrices SPM 60 5 bộ 12 câu (A–E) Dân số chung, từ khoảng 6 tuổi đến người lớn
Standard Progressive Matrices Plus SPM+ 60 5 bộ 12 câu Cùng dải với SPM, câu khó hơn để giảm hiệu ứng trần
Advanced Progressive Matrices APM 12 + 36 Bộ I (luyện), Bộ II (tính điểm) Người lớn và thanh thiếu niên ở dải năng lực cao
Raven's Progressive Matrices, bản 3 Raven's 2 Thay đổi Kỹ thuật số, chọn câu thích ứng Ứng dụng lâm sàng và tuyển dụng hiện đại

Bản CPM dùng nền màu, giúp giữ chú ý tốt hơn ở trẻ nhỏ và giảm tải thị giác. Bản SPM là dạng cổ điển mà phần lớn mọi người muốn nói khi nhắc đến "ma trận Raven". Bản APM ra đời vì SPM nén phần trên của phân phối — quá nhiều người lớn có năng lực chạm trần — nên câu hỏi của nó bắt đầu từ chỗ các câu khó nhất của SPM dừng lại.

Bản sửa đổi năm 2018 do Pearson phát hành, thường gọi là Raven's 2, chuyển bài kiểm tra sang định dạng số hóa thích ứng theo máy tính, trong đó độ khó của câu tiếp theo phụ thuộc vào kết quả làm bài trước đó. Cách triển khai thích ứng đạt độ chính xác tương đương với ít câu hỏi hơn và giảm cả vấn đề trần lẫn sàn của các bản cố định.

Thời gian làm bài thường là 20–45 phút. Ban đầu Raven chủ ý để SPM không giới hạn thời gian, coi đó là bài đo sức mạnh suy luận chứ không phải tốc độ; việc tính giờ trở nên phổ biến về sau, và điều đó làm thay đổi ý nghĩa của điểm số.

4. Bài kiểm tra thực sự đo cái gì

Trong các nghiên cứu phân tích nhân tố, ma trận Raven tải rất mạnh lên trí thông minh linh hoạt (Gf) và qua đó lên g. Trong tài liệu tâm trắc học, nó thường được mô tả là một trong những chỉ báo đơn lẻ mạnh nhất cho trí thông minh tổng quát — đó là lý do các nhà nghiên cứu cần một đại diện ngắn gọn cho g rất hay chọn nó.

Về mặt nhận thức, bài kiểm tra đòi hỏi:

  • Quy nạp quy luật — suy ra một quy tắc trừu tượng từ vài ví dụ ít ỏi.
  • Trí nhớ làm việc / quản lý mục tiêu — giữ đồng thời nhiều mục tiêu con đang giải dở trong đầu trong khi thử các quy luật ứng viên.
  • Chú ý đúng chiều thuộc tính — quyết định xem trong vô số thuộc tính thị giác (hình dạng, số lượng, sắc độ, hướng, kích thước, vị trí) thì cái nào thực sự mang quy luật.

Phân tích nhận thức kinh điển là công trình của Carpenter, Just và Shell (1990), nhóm đã mô hình hóa chi tiết cách người ta giải APM và kết luận rằng các câu khó khác biệt chủ yếu ở số lượng quy luật phải xử lý cùng lúc và ở gánh nặng quản lý mục tiêu trong trí nhớ làm việc. Họ liệt kê một số kiểu quy luật lặp lại:

Kiểu quy luật Nội dung
Hằng định theo hàng Một thuộc tính giữ nguyên trong cùng hàng và thay đổi giữa các hàng
Tăng tiến định lượng theo cặp Một thuộc tính tăng hoặc giảm theo bước cố định dọc hàng
Cộng hoặc trừ hình Hai ô hợp lại, hoặc một ô bị trừ khỏi ô kia, để tạo ra ô thứ ba
Phân phối ba giá trị Ba giá trị của một thuộc tính, mỗi giá trị xuất hiện một lần trên mỗi hàng và mỗi cột
Phân phối hai giá trị Hai giá trị xuất hiện và một giá trị rỗng trong mỗi hàng

Hãy để ý điều danh sách này hàm ý: bài kiểm tra không đo "năng lực thị giác" theo nghĩa hẹp nào cả. Nó đo mức độ hiệu quả khi một người tạo ra, kiểm chứng và duy trì các giả thuyết trừu tượng dưới áp lực nhận thức.

Các nghiên cứu hình ảnh não liên hệ thành tích suy luận ma trận với một mạng lưới trán–đỉnh phân tán — mô hình được Jung và Haier tóm lược trong thuyết tích hợp trán–đỉnh (2007). Những phát hiện này mô tả các tương quan của thành tích; chúng không định vị "trí thông minh" vào một điểm cụ thể trong não.

5. Câu hỏi về tính "công bằng văn hóa"

Ma trận Raven thường được gọi là "phi văn hóa" hoặc "công bằng văn hóa". Cách gọi thứ nhất là sai, và cách gọi thứ hai, tốt nhất, chỉ là một phép xấp xỉ.

Đúng là bài kiểm tra loại bỏ những rào cản văn hóa hiển nhiên nhất: không ngôn ngữ, không từ vựng, không nội dung chương trình học, không vật thể đặc thù văn hóa. Đó là một lợi thế thật, và cũng là lý do nó lan rộng vào nghiên cứu xuyên ngôn ngữ và vào những bối cảnh mà người khảo thí và người làm bài không chung tiếng nói.

Nhưng giảm ảnh hưởng văn hóa không đồng nghĩa với thoát khỏi văn hóa. Thành tích vẫn phụ thuộc vào những thứ phân bố không đồng đều:

  • Mức độ quen thuộc với hình trừu tượng hai chiều, vốn chủ yếu là sản phẩm của giáo dục chính quy và của việc tiếp xúc với tài liệu in ấn, màn hình.
  • Quy ước làm bài thi — định dạng trắc nghiệm nhiều lựa chọn, giả định rằng có một đáp án "đúng", việc làm bài một mình trong im lặng và chạy đua với đồng hồ.
  • Số năm đi học, yếu tố tương quan với thành tích ma trận độc lập với nội dung được học.

Quan điểm đồng thuận trong tâm trắc học hiện đại là: không có bài kiểm tra nào thoát khỏi văn hóa, ma trận Raven giảm đáng kể một số nguồn thiên lệch, và không nên phóng đại sự giảm ấy thành tuyên bố về khả năng so sánh phổ quát giữa các quần thể.

6. Ma trận Raven và hiệu ứng Flynn

Hiệu ứng Flynn — sự tăng dài hạn của điểm thô trung bình trên các bài trắc nghiệm nhận thức suốt thế kỷ XX — được ghi nhận rõ rệt nhất trên các bài dạng Raven. James Flynn và các đồng nghiệp thấy rằng mức tăng ở suy luận ma trận trừu tượng lớn hơn hẳn mức tăng ở từ vựng hay kiến thức phổ thông, ở một số bộ dữ liệu quốc gia lên tới cỡ một độ lệch chuẩn qua mỗi thế hệ.

Đây là kết quả thực sự khó xử cho cách đọc "công bằng văn hóa". Nếu ma trận đo một năng lực sinh học cố định không bị môi trường chạm tới, điểm số của các thế hệ nối tiếp lẽ ra đã không trôi lên mạnh như vậy. Các giải thích hàng đầu chỉ về phía biến đổi môi trường: số năm đi học nhiều hơn, một môi trường thị giác bão hòa sơ đồ và ký hiệu, và — cách lý giải mà chính Flynn ưa chuộng — sự chuyển dịch văn hóa sang thói quen tư duy bằng các phạm trù trừu tượng, giả định, phân loại thay vì các phạm trù cụ thể.

Hai hệ quả thực tiễn nảy sinh. Thứ nhất, chuẩn mực có hạn dùng. Cùng một điểm thô đọc theo chuẩn năm 1979 và theo chuẩn năm 2018 sẽ cho kết quả khác nhau, và chuẩn cũ thì "ưu ái" người làm bài hơn. Thứ hai, thành tích trung bình tăng lên trên một bài kiểm tra không đồng nghĩa với việc cả một dân số trở nên thông minh hơn về mọi mặt; mức tăng rất không đồng đều giữa các miền nhận thức, và chính sự không đồng đều đó mới là phần giàu thông tin nhất của phát hiện này.

7. Điểm số Raven được báo cáo ra sao

Điểm thô đơn giản là số câu trả lời đúng — trên tổng 60 câu ở SPM, trên tổng 36 câu ở Bộ II của APM. Con số thô đó tự nó chẳng nói lên điều gì. Nó chỉ có thể diễn giải khi được so với một bảng chuẩn phù hợp với nhóm tuổi và quần thể, qua đó chuyển thành phân vị.

Một số nhà xuất bản còn chuyển phân vị sang thang điểm chuẩn với trung bình 100 và độ lệch chuẩn 15, để kết quả có thể bàn luận song song với điểm IQ dạng Wechsler. Phép chuyển đổi ấy là một tiện ích, không phải một sự tương đương: điểm chuẩn suy ra từ Raven và IQ toàn thang của WAIS được xây dựng từ nội dung khác nhau và không thể thay thế cho nhau.

Ba lưu ý áp dụng cho mọi con số suy ra từ Raven:

  1. Đây là phép đo một miền duy nhất. Ma trận đánh giá suy luận linh hoạt, phi ngôn ngữ. Chúng không nói gì về hiểu biết ngôn ngữ, kiến thức tích lũy hay tốc độ xử lý. Một bộ trắc nghiệm đầy đủ lấy mẫu nhiều miền chính vì lý do này.
  2. Nó mang sai số đo lường. Như mọi bài kiểm tra, điểm quan sát chỉ là một ước lượng. Khoảng tin cậy 95 % quanh một điểm được chuẩn hóa tốt thường trải vài điểm về mỗi phía của giá trị quan sát.
  3. Luyện tập làm thay đổi điểm số, không phải con người. Ai từng giải nhiều câu đố ma trận sẽ giỏi hơn ở câu đố ma trận. Sự tiến bộ đó phản ánh mức độ quen với định dạng câu hỏi và với các kiểu quy luật lặp lại — tức học tập đặc thù nhiệm vụ — và không nên đọc như một thay đổi ở năng lực tổng quát nền tảng.

8. Bạn sẽ gặp ma trận ở đâu ngày nay

Ngay cả khi bạn chưa từng làm bài Raven, gần như chắc chắn bạn đã gặp thiết kế của nó. Suy luận ma trận (Matrix Reasoning) là một tiểu trắc nghiệm cốt lõi của WAIS-IV và WISC-V. Các nhiệm vụ ma trận hình học tương tự xuất hiện trong Stanford-Binet, trong bài Cattell Culture Fair, trong Naglieri Nonverbal Ability Test, trong các bộ trắc nghiệm năng khiếu nghề nghiệp, và trong phần lớn các bài test miễn phí đang lưu hành trên mạng.

Một số chi hội quốc gia của các hội IQ cao từng chấp nhận điểm APM làm bài có giám sát như một phần bằng chứng xét kết nạp, dù tiêu chí khác nhau theo từng nước và thay đổi theo thời gian — ai muốn đi con đường đó nên hỏi trực tiếp tổ chức về yêu cầu hiện hành thay vì tin vào các danh sách truyền miệng.

Các bài test ma trận trực tuyến, bao gồm phần câu hỏi suy luận quy luật trong hồ sơ Brambin, dùng cùng một logic nền tảng nhưng không phải là công cụ Raven có đăng ký nhãn hiệu và không được thực hiện trong điều kiện chuẩn hóa. Chúng hữu ích cho sự tò mò và tự khám phá. Chúng không phải đánh giá lâm sàng và không thể thay thế cho đánh giá lâm sàng.

Câu hỏi thường gặp

Ma trận Raven có phải là một bài test IQ không?

Đây là bài đo suy luận linh hoạt phi ngôn ngữ, tương quan rất mạnh với trí thông minh tổng quát, và kết quả thường được quy về thang giống IQ với trung bình 100, độ lệch chuẩn 15. Nhưng nó đo một miền duy nhất thay vì nhiều miền như một bộ trắc nghiệm đầy đủ kiểu WAIS, nên kết quả Raven và IQ toàn thang không phải cùng một đại lượng dù được in trên cùng một thang điểm.

Làm bài mất bao lâu?

Điều đó tùy phiên bản và quy trình thực hiện. Bản Standard Progressive Matrices thường mất 20 đến 45 phút; giới hạn 45 phút khá phổ biến khi tổ chức theo nhóm có tính giờ. Ban đầu Raven thiết kế bài không giới hạn thời gian, với quan điểm rằng đối tượng quan tâm là sức mạnh suy luận chứ không phải tốc độ, và cách làm không tính giờ vẫn được dùng trong một số bối cảnh nghiên cứu.

Ma trận Raven có thực sự "phi văn hóa" không?

Không. Mô tả chính xác hơn là "giảm ảnh hưởng văn hóa". Việc loại bỏ ngôn ngữ và nội dung chương trình học đã xóa một số nguồn thiên lệch lớn, nhưng thành tích vẫn phụ thuộc vào mức độ quen thuộc với hình trừu tượng hai chiều, vào giáo dục chính quy và vào các quy ước làm bài thi — tất cả đều khác nhau giữa các môi trường. Phần lớn nhà tâm trắc học ngày nay xem cụm từ "phi văn hóa" là một sự phóng đại.

Luyện tập có giúp giải câu đố kiểu Raven tốt hơn không?

Thành tích ở câu đố ma trận có tiến bộ khi luyện tập, vì các kiểu quy luật lặp lại trở nên quen thuộc và định dạng không còn gây bất ngờ. Điều nghiên cứu ủng hộ là: đây là học tập đặc thù nhiệm vụ — mức tăng xuất hiện ở chính nhiệm vụ được luyện và chuyển giao rất kém sang các nhiệm vụ nhận thức không liên quan. Không nên diễn giải nó như một thay đổi ở năng lực suy luận tổng quát, và đó cũng là lý do các nhà lâm sàng dè dặt với điểm số từ bài vừa làm lại gần đây.

Vì sao lại có nhiều phiên bản đến vậy?

Vì một dạng bài 60 câu duy nhất không thể đo chính xác trên toàn bộ dải năng lực. Bản Coloured tồn tại để trẻ nhỏ và người lớn có suy giảm nhận thức không bị mắc kẹt ở sàn của một bài quá khó; bản Advanced tồn tại để những người lớn có năng lực cao không bị mắc kẹt ở trần của một bài quá dễ. Bản thích ứng hiện đại xử lý cả hai vấn đề cùng lúc bằng cách chọn câu hỏi theo diễn biến làm bài.

Tôi có thể xem câu hỏi Raven thật ở đâu?

Không có nguồn hợp pháp nào công khai. Các câu hỏi là tài liệu có bản quyền, xuất bản theo giấy phép, và tính bảo mật của chúng rất quan trọng: một câu hỏi đã lan truyền rộng thì không còn đo được thứ mà nó đã được chuẩn hóa để đo. Tài liệu luyện tập mô phỏng định dạng thì có tồn tại, nhưng đó không phải bài kiểm tra thật, và điểm số từ chúng không so sánh được với kết quả Raven đã chuẩn hóa.

Tóm tắt

Ma trận tiến triển Raven trụ được từ năm 1938 vì nó làm cực tốt một việc: tách riêng thao tác quy nạp quy luật trừu tượng ra khỏi ngôn ngữ, kiến thức và chương trình học. Điều đó khiến nó trở thành một trong những chỉ báo thuần khiết nhất cho suy luận linh hoạt và một trong những công cụ nghiên cứu được dùng rộng rãi nhất trong lĩnh vực này.

Giới hạn của nó cũng rõ ràng không kém. Nó đo một miền nhận thức duy nhất. Nó giảm ảnh hưởng văn hóa chứ không thoát khỏi văn hóa. Chuẩn mực của nó trôi theo thời gian, như hiệu ứng Flynn đã thể hiện trên bài kiểm tra này sống động hơn bất kỳ bài nào khác. Và một điểm số từ nó là một ước lượng kèm dải tin cậy, không phải một thuộc tính cố định của con người.

Đọc cùng các bằng chứng khác, kết quả suy luận ma trận thực sự giàu thông tin. Đọc đơn độc, như một bản án, nó đang bị bắt gánh nhiều hơn rất nhiều so với những gì nó được tạo ra để gánh.


Brambin cung cấp hồ sơ nhận thức tám chiều, bao gồm các câu hỏi suy luận quy luật, hướng đến mục tiêu tự khám phá. Đây không phải bài kiểm tra Raven's Progressive Matrices, không liên kết với nhà xuất bản của bài kiểm tra đó, và không phải đánh giá lâm sàng. Hãy xem bất kỳ điểm trực tuyến nào — kể cả của chúng tôi — là xuất phát điểm cho sự tò mò, chứ không phải bản án.

Xem điểm đầy đủ với bài test đầy đủ

Tải miễn phí · bài test đầy đủ là giao dịch mua trong ứng dụng một lần, không đăng ký định kỳ

Tải Brambin
Tải ứng dụng