Metodología
Un número sin método detrás no vale nada. Aquí está todo el procedimiento, incluidos sus límites.
1. De las respuestas a la puntuación directa
Pruebas con respuesta correcta (test de CI)
Se cuenta un punto por acierto y se aplica corrección por azar, la fórmula clásica de la teoría de los tests:
puntuación = aciertos − (fallos ÷ (número de opciones − 1))
Un ítem de 5 opciones se acierta al azar 1 de cada 5 veces, así que cada fallo descuenta 0,25 puntos; en los de 6 opciones descuenta 0,20. Dejar en blanco no penaliza. Por eso responder a lo loco no infla el resultado, y por eso el informe distingue entre fallos y preguntas sin contestar.
Cuestionarios de rasgos (Cinco Grandes, inteligencia emocional)
Cada respuesta vale de 1 a 5. Los ítems redactados en sentido contrario se invierten antes de sumar (una respuesta de 5 pasa a valer 1). La puntuación de cada rasgo es la suma de sus 10 ítems, de 10 a 50 puntos. Las preguntas sin responder se puntúan con el valor central para no distorsionar la escala.
Cribados clínicos (PHQ-9, GAD-7)
Aquí no hay baremo estadístico: son escalas con puntos de corte validados en estudios clínicos. Se suman los ítems (0 a 3 cada uno) y el total cae en una franja de gravedad. Son los mismos cortes que se usan en consulta.
Pruebas interactivas
En la amplitud de dígitos, tu puntuación es la secuencia más larga que reprodujiste correctamente en cada bloque; el bloque termina cuando fallas los dos intentos de una misma longitud. En el tiempo de reacción se descartan los intentos por debajo de 120 ms (anticipación) y se usa la media de los válidos.
2. De la puntuación directa a la escala
La puntuación directa se convierte en una puntuación z: cuántas desviaciones típicas te separan de la media de la población.
z = (tu puntuación − media esperada) ÷ desviación típica
Y la z se lleva a la escala de CI, la misma que usan las escalas Wechsler:
CI = 100 + 15 × z
El percentil sale de la función de distribución normal acumulada aplicada a esa z. Un percentil de 84 significa que tu puntuación supera a 84 de cada 100 personas.
La z se recorta al rango de ±3 desviaciones típicas, de modo que ninguna puntuación puede salir por debajo de 55 ni por encima de 145. Fuera de ese rango un test breve por internet no puede discriminar de forma útil, y dar un número concreto sería inventárselo.
3. De dónde salen los baremos
Esta es la parte que casi ninguna web publica, y es donde conviene ser explícito.
Para el test de CI, cada ítem lleva asignada una dificultad: la proporción de la población general que se espera que lo acierte, estimada a partir de la dificultad típica de ítems equivalentes en pruebas publicadas. La suma de las dificultades de los 36 ítems da la puntuación esperada de una persona promedio, que es la media del baremo:
| Área | Ítems | Puntuación esperada |
|---|---|---|
| Razonamiento abstracto | 9 | 6.14 |
| Razonamiento numérico | 9 | 6.39 |
| Comprensión verbal | 9 | 6.21 |
| Lógica y resolución | 9 | 5.26 |
| Total | 36 | 24.00 |
La desviación típica del baremo es 6.2 puntos. Con esos dos valores, acertar los 36 ítems equivale a un CI cercano a 130 y acertar la mitad se sitúa alrededor de 85.
En los cuestionarios de rasgos se usan las medias y desviaciones típicas publicadas para los marcadores IPIP de dominio público. En la amplitud de dígitos, las medias de referencia son 6,4 dígitos en orden directo y 4,8 en inverso, cifras habituales en población adulta. En tiempo de reacción se toma una media de 284 ms con dispositivo de escritorio.
4. Por qué el informe da un intervalo
Ninguna medida psicológica es exacta. Si repitieras la misma prueba en otro momento, tu puntuación variaría unos puntos por cansancio, atención o simple azar. Por eso el informe de CI muestra un intervalo de confianza de aproximadamente ±7 puntos: es la lectura honesta del resultado. Un 112 y un 118 no son puntuaciones distintas en la práctica.
5. Cómo evitamos algunos sesgos habituales
- Orden de opciones aleatorio. La posición de la respuesta correcta se baraja por sesión, así que memorizar posiciones no sirve de nada.
- Ítems inversos. Los cuestionarios de personalidad mezclan afirmaciones en sentido contrario para detectar quien responde en piloto automático.
- Sin publicidad durante la prueba. Un anuncio en mitad de un test cronometrado contamina la medición, así que no se carga ninguno mientras respondes.
- Corrección por azar. Contestar al azar no mejora la puntuación esperada.
- Tiempo registrado. El informe muestra cuánto tardaste, un dato que ayuda a interpretar puntuaciones muy rápidas o muy lentas.
6. Baremo observado frente a baremo declarado
Aquí no hay promesas: esta sección se calcula en vivo con las respuestas ya recogidas. Cuando haya 200 o más aplicaciones del test de CI, la distribución observada se publica junto a la estimada para que cualquiera pueda compararlas.
Dificultad observada por ítem
Proporción de personas que acierta cada ítem, frente a la dificultad que le asignamos al construirlo. Una diferencia grande y sostenida es la señal de que el ítem hay que revisarlo o recalibrarlo.
| Ítem | Área | Estimada | Observada | Respuestas |
|---|---|---|---|---|
ab1 |
Razonamiento abstracto | 92 % | 0 % | 1 |
ab2 |
Razonamiento abstracto | 85 % | 0 % | 1 |
ab3 |
Razonamiento abstracto | 78 % | 0 % | 1 |
ab4 |
Razonamiento abstracto | 80 % | 100 % | 1 |
ab5 |
Razonamiento abstracto | 70 % | 0 % | 1 |
ab6 |
Razonamiento abstracto | 62 % | 0 % | 1 |
ab7 |
Razonamiento abstracto | 55 % | 100 % | 1 |
ab8 |
Razonamiento abstracto | 42 % | 0 % | 1 |
ab9 |
Razonamiento abstracto | 50 % | 0 % | 1 |
nu1 |
Razonamiento numérico | 96 % | 100 % | 1 |
nu2 |
Razonamiento numérico | 92 % | 0 % | 1 |
nu3 |
Razonamiento numérico | 85 % | 0 % | 1 |
nu4 |
Razonamiento numérico | 88 % | 0 % | 1 |
nu5 |
Razonamiento numérico | 70 % | 0 % | 1 |
nu6 |
Razonamiento numérico | 58 % | 0 % | 1 |
nu7 |
Razonamiento numérico | 55 % | 0 % | 1 |
nu8 |
Razonamiento numérico | 60 % | 0 % | 1 |
nu9 |
Razonamiento numérico | 35 % | 0 % | 1 |
ve1 |
Comprensión verbal | 93 % | 0 % | 1 |
ve2 |
Comprensión verbal | 95 % | 0 % | 1 |
ve3 |
Comprensión verbal | 90 % | 0 % | 1 |
ve4 |
Comprensión verbal | 78 % | 0 % | 1 |
ve5 |
Comprensión verbal | 68 % | 100 % | 1 |
ve6 |
Comprensión verbal | 62 % | 0 % | 1 |
ve7 |
Comprensión verbal | 50 % | 0 % | 1 |
ve8 |
Comprensión verbal | 45 % | 100 % | 1 |
ve9 |
Comprensión verbal | 40 % | 0 % | 1 |
lo1 |
Lógica y resolución | 95 % | 0 % | 1 |
lo2 |
Lógica y resolución | 88 % | 0 % | 1 |
lo3 |
Lógica y resolución | 60 % | 0 % | 1 |
lo4 |
Lógica y resolución | 58 % | 0 % | 1 |
lo5 |
Lógica y resolución | 55 % | 100 % | 1 |
lo6 |
Lógica y resolución | 50 % | 0 % | 1 |
lo7 |
Lógica y resolución | 45 % | 100 % | 1 |
lo8 |
Lógica y resolución | 40 % | 100 % | 1 |
lo9 |
Lógica y resolución | 35 % | 0 % | 1 |
En ámbar, los ítems que se desvían más de 20 puntos porcentuales de lo previsto.
7. Qué no hacemos
No aplicamos teoría de respuesta al ítem con parámetros estimados sobre muestra propia, no usamos tests adaptativos y no ajustamos por edad ni por nivel educativo. Todo eso requiere una muestra normativa grande y un proceso de validación que no tenemos.
El código de puntuación está en lib/Puntuacion.php y los baremos
en los archivos de cada prueba dentro de data/. Si detectas un error de cálculo,
cuéntanoslo.