Comment le test de réflexion mesure, et où se trouvent les limites
Ce que le test mesure
Manches de 11 exercices de huit types : matrices de motifs, matrices d'images (Sandia), suites de nombres, exercices d'intrus, une matrice de mémoire (mémoire de travail visuelle), la balance de figures (raisonnement quantitatif sans nombres), le comptage de cubes (visualisation spatiale) et trois exercices de langue dans la langue concernée. L'accent est mis sur ce que la recherche appelle « intelligence fluide » : reconnaître des règles dans un matériel nouveau. La partie sans langue est la valeur principale et fonctionne à l'identique dans toutes les langues ; la section langue reçoit sa propre fourchette.
Il ne mesure PAS : les connaissances, le vocabulaire, la créativité, la sagesse pratique, l’intelligence sociale. La pensée est bien plus vaste que n’importe quel test en ligne. La mémoire et l’attention ne sont qu’effleurées (6 exercices chacune) et ne donnent PAS à elles seules une valeur solide.
Pourquoi une fourchette plutôt qu’un chiffre
Tout score de test porte une erreur de mesure : forme du jour, fatigue, entraînement, chance en devinant. L’évaluation sérieuse travaille donc avec des intervalles de confiance. Un test en ligne qui te vend « QI 128 » comme un nombre exact tait cette incertitude ; nous, nous la montrons.
Phase d’étalonnage : ce que cela veut dire
Ce test est nouveau et en cours d’étalonnage. Pour l’instant, ton positionnement repose sur un modèle provisoire, non étalonné : il montre ton taux de réussite corrigé de la part de chance quand on devine, avec une fourchette d’incertitude statistique (intervalle de Wilson), et non une comparaison avec un échantillon. Nous le disons directement sur le résultat. Chaque passation anonyme élargit le socle de données ; dès qu’il sera assez solide, nous passerons à des rangs percentiles empiriques et réancrerons tous les résultats gratuitement. Les échantillons en ligne restent auto-sélectionnés. Nous l’indiquerons aussi.
Valeurs en direct issues des parcours jusqu'ici
Chargement des valeurs …
Des manches sans fin fixe — et pourquoi tu ne peux arrêter qu'entre elles
Le test se déroule en manches de 11 exercices, autant que tu veux (30 au maximum). Toutes les manches suivent le même modèle : les mêmes types d'exercices, le même mélange de difficulté, chacune commence plus facile et finit plus difficile. C'est pourquoi tu peux arrêter à la fin de n'importe quelle manche : ce que tu as fait est une miniature équitable du test. Arrêter en milieu de manche est bloqué volontairement — tu sauterais les exercices difficiles de la fin. À partir de trois manches, ton parcours est comparable à tous les autres.
La fourchette d'incertitude se resserre à chaque manche : l'erreur d'une proportion décroît avec la racine carrée du nombre d'exercices. La carte de manche indique donc la largeur actuelle et la largeur après une manche de plus — tu décides quand c'est assez précis pour toi. La barre de « portée » est calibrée sur huit manches.
Équité & limites
- Pas de score de vitesse : les limites généreuses par exercice ne servent qu'à décourager l'aide extérieure. La vitesse n'entre jamais dans ton résultat. Le test reste ainsi équitable sur téléphone et sur ordinateur.
- Sans surveillance veut dire estimation : personne ne vérifie qui passe le test, ni comment. Pour des valeurs solides, il existe l’évaluation professionnelle encadrée.
- Ni un instrument clinique, ni un diagnostic, ni un outil de recrutement ou d’admission, et aucun jugement sur une personne.
- Les exercices sont pensés pour les troubles de la vision des couleurs (la forme et le motif portent l’information, jamais la couleur).
D'où viennent les types d'exercices
Notre propre générateur produit chaque exercice ; aucun item ne vient d'un autre test. Les types d'exercices ont des modèles que nous nommons : la balance de figures suit le type « Figure Weights », qui montre la plus forte saturation en facteur général dans la recherche sur le WAIS-IV ; le comptage de cubes suit l'Army General Classification Test (1940), dans le domaine public, et le test Army Beta (1917) ; les matrices suivent la famille de règles de Carpenter, Just et Shell. Depuis le 2 septembre 2026 (forme C), le « coup d'œil » n'existe plus — dans nos propres données, il ne saturait presque pas sur ce que le test doit mesurer — et l'exercice 24 de l'ancienne forme est écarté parce qu'il était résolu en dessous du niveau du hasard.
Les exercices de langue ne sont jamais traduits : ils sont rédigés séparément pour chaque langue et vérifiés à l'aveugle par un modèle tiers (options mélangées, sans indication de la réponse ; les items signalés sont remplacés). Les huit langues ont une liste vérifiée. Les matrices d'images proviennent des Sandia Matrices (Matzen et al. 2010, licence BSD) : 30 des 840 items publiés, utilisés avec leurs solutions normées — nous citons la source parce que la licence l'exige et parce que c'est vrai.
Le chiffre, si tu y tiens
Le résultat est d'abord une fourchette, et cela ne change pas. Qui veut expressément voir un chiffre l'obtient sur demande — situé honnêtement, en deux étapes : d'abord nous montrons la position parmi tous les parcours complets de ce test jusqu'ici (« mieux qu'environ X % »), comme un point avec sa fourchette d'incertitude sur une courbe. Dès qu'environ 300 parcours complets seront réunis, s'y ajoute une valeur provisoire sur l'échelle de QI (moyenne 100, dispersion 15) — dérivée de la position au sein de notre propre public de participants, jamais sans fourchette, jamais comme un classement.
Deux limites que nous énonçons expressément : notre public de participants n'est pas un échantillon représentatif de la population — qui résout volontairement des énigmes de raisonnement se situe en moyenne au-dessus de la moyenne de la population, la comparaison est donc plutôt sévère. Et seule la partie sans langue des parcours d'au moins trois manches est comparée — les parcours plus courts sont trop bruités, et la section langue a sa propre liste d'exercices par langue.
Le modèle économique, dit ouvertement
Résultat gratuit, analyse détaillée pour 4,99 € une seule fois : pas d’abonnement, pas de publicité, pas de partage de données. Les analyses achetées sont mises à jour gratuitement à chaque amélioration de la norme.