Fabelwaren

사고력 테스트가 어떻게 측정하는지, 한계는 어디에 있는지

테스트가 측정하는 것

8가지 종류의 문제 11개씩으로 된 라운드: 도형 패턴 행렬, 그림 행렬(Sandia), 수열, 다른 하나 찾기, 기억 행렬(시각 작업 기억), 도형 저울(숫자 없는 양적 추론), 정육면체 세기(공간 시각화), 그리고 해당 언어의 언어 문제 세 개. 초점은 연구에서 ‘유동 지능’이라 부르는 것, 즉 새로운 자료에서 규칙을 알아보는 힘이에요. 비언어 부분이 주된 값이고 모든 언어에서 똑같이 작동해요. 언어 섹션은 별도의 범위를 받아요.

측정하지 않는 것: 지식, 어휘, 창의성, 실생활의 지혜, 사회적 지능이에요. 사고력은 어떤 온라인 테스트보다 훨씬 넓어요. 기억과 주의는 살짝만 다루기 때문에(각 6문제) 그것만으로 믿을 만한 점수가 되지는 않아요.

왜 숫자 하나가 아니라 범위인지

모든 테스트 점수에는 측정 오차가 있어요. 그날의 컨디션, 피로, 연습 효과, 운 좋은 찍기 같은 것들요. 그래서 진지한 검사는 신뢰구간으로 작업해요. “IQ 128”을 정확한 숫자처럼 파는 온라인 테스트는 이 불확실성을 숨기는 거예요. 저희는 보여 드려요.

보정 단계란 무엇인지

이 테스트는 새로 만들어져 지금 보정 중이에요. 당분간 위치 산정은 잠정적이고 아직 보정되지 않은 모델에 기대고 있어요. 표본과의 비교가 아니라, 운 좋은 찍기를 걸러 낸 정답률을 통계적 불확실성 범위(윌슨 구간)와 함께 보여 주는 방식이에요. 결과 화면에도 그렇게 그대로 적어 두었어요. 익명 참여가 하나씩 쌓일수록 데이터가 자라고, 충분해지면 경험적 백분위 순위로 전환해 모든 결과를 무료로 새 기준에 다시 맞춰 드려요. 온라인 표본은 여전히 자기선택적이에요. 그 점도 함께 밝힐게요.

지금까지의 응시로 계산한 실시간 지표

지표를 불러오는 중 …

정해진 끝이 없는 라운드 — 그리고 왜 라운드 사이에서만 멈출 수 있는지

테스트는 11문제씩 라운드로 진행되고 원하는 만큼 할 수 있어요(최대 30). 모든 라운드는 같은 틀을 따라요: 같은 문제 종류, 같은 난이도 구성, 각 라운드는 쉽게 시작해서 어렵게 끝나요. 그래서 어느 라운드가 끝나든 멈출 수 있어요: 푼 만큼이 테스트의 공정한 축소판이니까요. 라운드 중간에 멈추는 건 일부러 막아 두었어요 — 끝부분의 어려운 문제를 건너뛰게 되니까요. 3라운드부터는 내 응시가 다른 모든 사람과 비교 가능해요.

불확실성 범위는 라운드마다 좁아져요: 비율의 오차는 문제 수의 제곱근에 따라 줄어들기 때문이에요. 그래서 라운드 카드는 지금의 폭과 한 라운드 더 한 뒤의 폭을 알려 줘요 — 충분히 정밀하다고 느끼는 시점은 당신이 정해요. ‘신뢰도’ 막대는 8라운드를 기준으로 해요.

공정성과 한계

  • 속도 점수는 없어요: 문제마다 넉넉한 제한 시간은 외부 도움을 막기 위한 것일 뿐이에요. 속도는 결과에 절대 들어가지 않아요. 그래서 휴대폰에서도 컴퓨터에서도 공정해요.
  • 감독 없는 테스트는 추정이라는 뜻이에요. 누가 어떤 조건에서 풀었는지 아무도 확인하지 않으니까요. 확실한 점수가 필요하면 전문가가 감독하는 검사가 있어요.
  • 임상 도구도, 진단도 아니고, 채용이나 입학용도 아니에요. 사람에 대한 판정은 더더욱 아니에요.
  • 문제는 색각 이상이 있어도 풀 수 있게 만들었어요(정보는 언제나 색이 아니라 모양과 패턴이 담아요).

문제 종류는 어디에서 왔나

모든 문제는 자체 생성기가 만들어요. 다른 테스트에서 가져온 문항은 없어요. 문제 종류에는 본보기가 있고, 이를 밝혀요: 도형 저울은 WAIS-IV 연구에서 일반 요인 적재량이 가장 높은 ‘Figure Weights’ 유형을, 정육면체 세기는 공유 저작물인 Army General Classification Test(1940)와 Army Beta 테스트(1917)를, 행렬은 Carpenter·Just·Shell 규칙 체계를 따라요. 2026년 9월 2일(형식 C)부터 ‘순간 보기’는 없어졌어요 — 우리 데이터에서 테스트가 재려는 것에 거의 적재되지 않았기 때문이에요 — 그리고 옛 형식의 24번 문제는 우연 수준 아래로 풀려서 폐기했어요.

언어 문제는 절대 번역하지 않고 언어별로 따로 작성해서 외부 모델이 블라인드로 검증해요(선택지를 섞고 정답 힌트 없이; 지적된 문항은 교체). 여덟 언어 모두 검증된 목록이 있어요. 그림 행렬은 Sandia Matrices(Matzen 외, 2010, BSD 라이선스)에서 왔어요: 공개된 840개 문항 중 30개를 규준화된 정답과 함께 사용해요 — 출처를 밝히는 건 라이선스 조건이자 사실이기 때문이에요.

숫자를 원한다면

결과는 먼저 범위이고, 그 원칙은 변하지 않아요. 그래도 숫자를 꼭 보고 싶다면 원할 때 보여 드려요 — 정직하게 자리매김해서, 두 단계로요. 먼저 지금까지 이 테스트를 끝까지 마친 모든 응시 중에서의 위치(“약 X%보다 위”)를 곡선 위의 점과 불확실성 범위로 보여 드려요. 끝까지 마친 응시가 약 300회 모이면 IQ 척도(평균 100, 표준편차 15)의 잠정값이 추가돼요 — 우리 참여자 집단 안에서의 위치에서 도출한 값으로, 범위 없이 보여 주는 일은 없고 등급을 매기지도 않아요.

두 가지 한계를 분명히 말해 둘게요: 우리 참여자 집단은 모집단을 대표하는 표본이 아니에요 — 스스로 추론 퍼즐을 푸는 사람들은 평균적으로 일반 평균보다 높아서 비교가 다소 엄격해요. 그리고 3라운드 이상 응시의 비언어 부분만 비교해요 — 더 짧은 응시는 잡음이 너무 크고, 언어 섹션은 언어마다 별도의 문제 목록을 갖기 때문이에요.

숨김없이 밝히는 수익 구조

결과는 무료예요. 상세 분석은 1회 결제 4.99 €로 열 수 있어요. 구독도, 광고도, 데이터 공유도 없어요. 구매한 상세 분석은 규준이 개선될 때마다 무료로 업데이트돼요.