Fabelwaren

Cómo mide el test de razonamiento y dónde están los límites

Qué mide el test

Rondas de 11 ejercicios de ocho tipos: matrices de patrones, matrices de imágenes (Sandia), series numéricas, ejercicios de intruso, una matriz de memoria (memoria de trabajo visual), la balanza de figuras (razonamiento cuantitativo sin números), contar cubos (visualización espacial) y tres ejercicios de lenguaje en el idioma correspondiente. El foco está en lo que la investigación llama «inteligencia fluida»: reconocer reglas en material nuevo. La parte sin lenguaje es el valor principal y funciona igual en todos los idiomas; la sección de lenguaje recibe un rango propio.

NO mide: conocimientos, vocabulario, creatividad, sabiduría práctica, inteligencia social. El pensamiento es mucho más amplio que cualquier test online. La memoria y la atención solo se rozan (6 ejercicios cada una) y por sí solas NO dan un valor fiable.

Por qué un rango en lugar de una cifra

Toda puntuación de test lleva error de medición: la forma del día, el cansancio, la práctica, la suerte al adivinar. Por eso la evaluación seria trabaja con intervalos de confianza. Un test online que te vende «CI 128» como una cifra exacta esconde esa incertidumbre; nosotros la mostramos.

Fase de calibración: qué significa

Este test es nuevo y se está calibrando. Por ahora tu clasificación se apoya en un modelo provisional sin calibrar: muestra tu porcentaje de aciertos corregido por la suerte al adivinar, con un rango de incertidumbre estadístico (intervalo de Wilson), no una comparación con una muestra. Te lo decimos directamente en el resultado. Cada pasada anónima hace crecer la muestra; en cuanto esta sea lo bastante sólida, cambiaremos a percentiles empíricos y volveremos a clasificar todos los resultados gratis. Las muestras online siguen siendo autoseleccionadas; eso también lo diremos.

Valores en vivo de las pasadas hasta ahora

Cargando valores …

Rondas sin final fijo — y por qué solo puedes parar entre ellas

El test se desarrolla en rondas de 11 ejercicios, tantas como quieras (como máximo 30). Todas las rondas siguen la misma plantilla: los mismos tipos de ejercicio, la misma mezcla de dificultad, cada una empieza más fácil y termina más difícil. Por eso puedes parar al final de cualquier ronda: lo que has hecho es una miniatura justa del test. Parar a mitad de ronda está bloqueado a propósito — te saltarías los ejercicios difíciles del final. A partir de tres rondas tu pasada es comparable con todas las demás.

El rango de incertidumbre se estrecha con cada ronda: el error de una proporción cae con la raíz cuadrada del número de ejercicios. Por eso la tarjeta de ronda indica la anchura ahora y la anchura tras una ronda más — tú decides cuándo te parece suficientemente preciso. La barra de «relevancia» está escalada a ocho rondas.

Equidad y límites

  • Sin puntuación por velocidad: los generosos límites por ejercicio solo desalientan la ayuda externa. La velocidad nunca entra en tu resultado. Así el test sigue siendo justo en móvil y ordenador.
  • Sin supervisión significa estimación: nadie comprueba quién hace el test ni cómo. Para valores fiables existe la evaluación profesional y supervisada.
  • No es un instrumento clínico, no es un diagnóstico, no sirve para contratación ni admisiones, y no es un juicio sobre una persona.
  • Los ejercicios son aptos para el daltonismo (la forma y el patrón transmiten la información, nunca el color).

De dónde vienen los tipos de ejercicio

Nuestro propio generador produce cada ejercicio; ningún ítem procede de otro test. Los tipos de ejercicio tienen modelos que nombramos: la balanza de figuras sigue el tipo «Figure Weights», que en la investigación sobre el WAIS-IV muestra la mayor carga en el factor general; contar cubos sigue el Army General Classification Test (1940), de dominio público, y el test Army Beta (1917); las matrices siguen la familia de reglas de Carpenter, Just y Shell. Desde el 2 de septiembre de 2026 (forma C) ya no hay «vistazo rápido» — en nuestros propios datos apenas cargaba en lo que el test debe medir — y el ejercicio 24 de la forma antigua está descartado porque se resolvía por debajo del nivel de azar.

Los ejercicios de lenguaje nunca se traducen, sino que se redactan por separado para cada idioma y un modelo ajeno los comprueba a ciegas (opciones mezcladas, sin pista de la solución; los ítems señalados se sustituyen). Los ocho idiomas tienen una lista verificada. Las matrices de imágenes proceden de las Sandia Matrices (Matzen et al. 2010, licencia BSD): 30 de 840 ítems publicados, que usamos con sus soluciones normadas — nombramos la fuente porque la licencia lo exige y porque es verdad.

La cifra si la pides

El resultado es primero un rango, y así seguirá. Quien quiera ver expresamente una cifra, la recibe si la pide — situada con honestidad, en dos etapas: primero mostramos la posición entre todas las pasadas completas de este test hasta ahora («mejor que aproximadamente X %»), como un punto con franja de incertidumbre sobre una curva. En cuanto se reúnan unas 300 pasadas completas, se añade además un valor provisional en la escala de CI (media 100, dispersión 15) — derivado de la posición dentro de nuestro propio grupo de participantes, nunca sin franja, nunca como clasificación.

Dos límites los decimos expresamente: nuestro grupo de participantes no es una muestra representativa de la población — quien resuelve enigmas de razonamiento por voluntad propia está de media por encima del promedio de la población, así que la comparación tiende a ser estricta. Y solo se compara la parte sin lenguaje de pasadas con al menos tres rondas — las más cortas tienen demasiado ruido, y la sección de lenguaje tiene una lista de ejercicios propia por idioma.

El modelo de negocio, dicho abiertamente

Resultado gratis, análisis detallado por 4,99 € una única vez. Sin suscripción, sin publicidad, sin ceder datos. Los análisis comprados se actualizan gratis con cada mejora de la norma.