Fabelwaren

思考テストはどのように測り、限界はどこにあるのか

このテストが測るもの

8種類の問題11問ずつのラウンド:図形パターンの行列、画像の行列(Sandia)、数列、仲間はずれ、記憶行列(視覚的ワーキングメモリ)、図形の天秤(数字を使わない量的推論)、立方体の数え上げ(空間的視覚化)、そしてそれぞれの言語での言語問題3問。焦点は研究で「流動性知能」と呼ばれるもの、つまり新しい素材の中に規則を見つける力です。非言語部分が主な値で、どの言語でも同じように機能します。言語セクションには独自の幅が付きます。

測らないもの:知識、語彙、創造性、実践的な知恵、社会的知能。思考というものは、どんなオンラインテストよりもずっと広いのです。記憶と注意は軽く触れる程度で(各6問)、それだけで頑健なスコアにはなりません。

なぜ数字ひとつではなく、幅なのか

どんなテストのスコアにも測定誤差が含まれます。その日の調子、疲れ、慣れ、まぐれ当たり。だからこそ、まじめなアセスメントは信頼区間を用います。「IQ 128」を正確な数字として売るオンラインテストは、この不確かさを隠しています。私たちは、それを示します。

キャリブレーション(調整)期間とは

このテストは新しく、現在キャリブレーション中です。今のところ位置づけは暫定的な未調整モデルにもとづいています。表示されるのは、まぐれ当たりを補正した正答率と統計的な不確かさの幅(Wilson区間)であって、サンプルとの比較ではありません。そのことは結果画面にも明記しています。匿名の受検が積み重なるごとにデータの土台が育ち、十分になった時点で実データにもとづくパーセンタイル順位に切り替え、これまでのすべての結果も無料で新しい基準に合わせて再調整します。オンラインのサンプルが自己選択的であることは変わりません。その点も明記します。

これまでの記録から算出したライブ指標

指標を読み込み中 …

終わりの決まっていないラウンド — そしてなぜ区切りでしか止められないのか

テストは11問ずつのラウンドで進み、好きなだけ続けられます(最大30)。すべてのラウンドは同じ設計です:同じ問題の種類、同じ難易度の配分、どのラウンドもやさしく始まり難しく終わります。だから各ラウンドの終わりで止められます:解いた分はテストの公平な縮図だからです。ラウンドの途中で止めることは意図的にできません — 終盤の難しい問題を飛ばすことになるからです。3ラウンド以上で、あなたの記録は他の全員と比較可能になります。

不確かさの幅はラウンドごとに狭くなります:割合の誤差は問題数の平方根に反比例して減るからです。そのためラウンドカードは今の幅と、もう1ラウンド後の幅を示します — どこで十分と判断するかはあなた次第です。「説得力」のバーは8ラウンドを基準にしています。

公平さと限界

  • 速さは採点しません:問題ごとの余裕ある制限時間は、外部の助けを使いにくくするためだけのものです。速さが結果に影響することはありません。だからスマホでもパソコンでも公平です。
  • 監督なしのテストは、あくまで推定です。誰がどのように受けているかを確認する人はいません。確かなスコアが必要な場合には、専門家による監督つきのアセスメントがあります。
  • 臨床検査でも診断でもなく、採用や入学の判断のためのものでもありません。そして、人そのものへの評価でもありません。
  • 問題は色覚に配慮したつくりです(情報を伝えるのは形と模様で、色だけに頼ることはありません)。

問題の種類はどこから来たのか

すべての問題は自前のジェネレーターが作ります。他のテストから持ってきた項目はありません。問題の種類には手本があり、それを明記します:図形の天秤はWAIS-IV研究で一般因子への負荷が最も高い「Figure Weights」型に、立方体の数え上げはパブリックドメインのArmy General Classification Test(1940年)とArmy Betaテスト(1917年)に、行列はCarpenter・Just・Shellの規則体系に基づきます。2026年9月2日(フォームC)以降、「一瞬視」はなくなりました — 私たち自身のデータで、測るべきものにほとんど負荷していなかったためです — また旧フォームの問題24は、偶然以下の正答率だったため除外しました。

言語問題は決して翻訳せず、言語ごとに別々に作成して、外部のモデルがブラインドで検査します(選択肢を混ぜ、正解のヒントなし。指摘された項目は差し替え)。8言語すべてに検査済みのリストがあります。画像の行列はSandia Matrices(Matzen他、2010年、BSDライセンス)に由来します:公開された840項目のうち30項目を、規準化された正解とともに使用しています — 出典を明記するのは、ライセンスの条件であり、事実だからです。

数値がほしい人へ

結果はまず幅であり、それは変わりません。どうしても数値を見たい人には、希望すれば表示します — 正直に位置づけて、2段階で。まず、このテストをこれまでに最後まで解いたすべての回の中での位置(「およそX%より上」)を、曲線の上の点と不確かさの幅で示します。最後まで解いた回が約300回集まると、さらにIQスケール(平均100、ばらつき15)の暫定値が加わります — 私たち自身の参加者の中での位置から導いたもので、幅なしで示すことはなく、等級づけもしません。

2つの限界をはっきり述べておきます:私たちの参加者は母集団を代表する標本ではありません — 自ら進んで推論パズルを解く人は平均して一般より高いため、比較は厳しめになります。また比較するのは3ラウンド以上の記録の非言語部分だけです — それより短い記録はノイズが大きすぎ、言語セクションは言語ごとに別の問題リストを持つからです。

収益のしくみを、包み隠さず

結果は無料でご覧いただけます。詳しい分析は買い切り4.99ユーロです。サブスクリプションも広告もデータ共有もありません。ご購入いただいた分析は、基準データが改良されるたびに無料で更新されます。