Fabelwaren

Come misura il test di ragionamento e dove stanno i limiti

Cosa misura il test

Round da 11 quesiti di otto tipi: matrici di schemi, matrici di immagini (Sandia), serie numeriche, quesiti di intruso, una matrice di memoria (memoria di lavoro visiva), la bilancia di figure (ragionamento quantitativo senza numeri), il conteggio di cubi (visualizzazione spaziale) e tre quesiti linguistici nella rispettiva lingua. Il fulcro è ciò che la ricerca chiama «intelligenza fluida»: riconoscere regole in materiale nuovo. La parte senza lingua è il valore principale e funziona in modo identico in ogni lingua; la sezione linguistica riceve una fascia propria.

NON misura: conoscenze, vocabolario, creatività, saggezza pratica, intelligenza sociale. Il pensiero è molto più ampio di qualsiasi test online. Memoria e attenzione vengono solo sfiorate (6 quesiti ciascuna) e da sole NON danno un valore affidabile.

Perché una fascia invece di un numero

Ogni punteggio di test porta con sé un errore di misura: forma del giorno, stanchezza, allenamento, fortuna nel tirare a indovinare. La diagnostica seria lavora perciò con intervalli di confidenza. Un test online che ti vende «QI 128» come numero esatto nasconde questa incertezza. Noi la mostriamo.

Fase di calibrazione: cosa significa

Questo test è nuovo ed è in fase di calibrazione. Per ora la tua collocazione poggia su un modello provvisorio, non calibrato: mostra la tua percentuale di risposte esatte corretta per la fortuna nel tirare a indovinare, con una fascia di incertezza statistica (intervallo di Wilson), non un confronto con un campione. Te lo diciamo direttamente sul risultato. Ogni sessione anonima amplia la base di dati; appena sarà abbastanza solida, passeremo a percentili empirici e ricollocheremo gratuitamente tutti i risultati. I campioni online restano auto-selezionati, e anche questo lo diremo chiaramente.

Valori in tempo reale dalle sessioni finora

Caricamento dei valori …

Round senza una fine fissa — e perché puoi fermarti solo tra uno e l'altro

Il test si svolge in round da 11 quesiti, quanti ne vuoi (al massimo 30). Tutti i round seguono lo stesso modello: gli stessi tipi di quesito, lo stesso mix di difficoltà, ognuno inizia più facile e finisce più difficile. Per questo puoi fermarti alla fine di qualsiasi round: ciò che hai fatto è una miniatura equa del test. Fermarsi a metà round è bloccato di proposito — salteresti i quesiti difficili della fine. Da tre round in poi la tua sessione è comparabile con tutte le altre.

La fascia di incertezza si restringe a ogni round: l'errore di una proporzione scende con la radice quadrata del numero di quesiti. La scheda del round indica quindi la larghezza ora e la larghezza dopo un round in più — decidi tu quando è abbastanza preciso. La barra di «attendibilità» è tarata su otto round.

Equità e limiti

  • Nessun punteggio di velocità: i limiti generosi per quesito servono solo a scoraggiare aiuti esterni. La velocità non entra mai nel tuo risultato. Così il test resta equo su telefono e computer.
  • Senza supervisione significa stima: nessuno controlla chi fa il test e come. Per valori affidabili c'è la diagnostica professionale supervisionata.
  • Non è uno strumento clinico, non è una diagnosi, non va usato per assunzioni o ammissioni, e non è un giudizio su una persona.
  • I quesiti sono adatti anche a chi distingue male i colori (l'informazione la portano forma e schema, mai il colore).

Da dove vengono i tipi di quesito

Il nostro generatore produce ogni quesito; nessun item proviene da un altro test. I tipi di quesito hanno modelli che nominiamo: la bilancia di figure segue il tipo «Figure Weights», che nella ricerca sul WAIS-IV mostra la saturazione più alta sul fattore generale; il conteggio di cubi segue l'Army General Classification Test (1940), di pubblico dominio, e il test Army Beta (1917); le matrici seguono la famiglia di regole di Carpenter, Just e Shell. Dal 2 settembre 2026 (forma C) lo «sguardo rapido» non c'è più — nei nostri stessi dati saturava appena su ciò che il test deve misurare — e il quesito 24 della vecchia forma è scartato perché veniva risolto sotto il livello del caso.

I quesiti linguistici non vengono mai tradotti, ma scritti separatamente per ogni lingua e verificati alla cieca da un modello esterno (opzioni mescolate, senza indizi sulla soluzione; gli item segnalati vengono sostituiti). Tutte e otto le lingue hanno una lista verificata. Le matrici di immagini provengono dalle Sandia Matrices (Matzen et al. 2010, licenza BSD): 30 di 840 item pubblicati, usati con le loro soluzioni normate — citiamo la fonte perché la licenza lo richiede e perché è vero.

Il numero, se lo vuoi

Il risultato è prima di tutto una fascia, e così resta. Chi vuole espressamente vedere un numero lo riceve su richiesta — collocato con onestà, in due fasi: prima mostriamo la posizione tra tutte le sessioni complete di questo test finora («meglio di circa X%»), come un punto con la sua fascia di incertezza su una curva. Appena si saranno raccolte circa 300 sessioni complete, si aggiunge un valore provvisorio sulla scala del QI (media 100, dispersione 15) — derivato dalla posizione all'interno del nostro stesso pubblico di partecipanti, mai senza fascia, mai come classificazione.

Due limiti li diciamo espressamente: il nostro pubblico di partecipanti non è un campione rappresentativo della popolazione — chi risolve rompicapi di ragionamento di propria iniziativa sta in media sopra la media della popolazione, quindi il confronto tende a essere severo. E si confronta solo la parte senza lingua di sessioni con almeno tre round — quelle più brevi sono troppo rumorose, e la sezione linguistica ha una lista di quesiti propria per lingua.

Il modello di business, detto apertamente

Risultato gratis, analisi dettagliata a 4,99 € una tantum: niente abbonamento, niente pubblicità, nessuna cessione di dati. Le analisi acquistate si aggiornano gratuitamente a ogni miglioramento della norma.