En una frase: el CAT te hace la pregunta que mas information te da sobre tu nivel real.
1. Qué es un CAT
Un CAT es un test administrado por computadora que elige dinámicamente cada ítem a partir de la respuesta anterior. La idea central, formulada por Lord a comienzos de los setenta, es que un test fijo desperdicia preguntas: si ya sabemos que el examinado es muy capaz, darle ítems fáciles no aporta nada, y si tiene un nivel bajo, los ítems difíciles solo generan frustración sin aportar información.
El CAT requiere tres componentes que un test en papel no necesita:
- Un banco de ítems calibrado con TRI (Teoría de Respuesta al Ítem): cada ítem tiene parámetros de dificultad, discriminación y, según el modelo, adivinación.
- Un algoritmo de selección que decide qué ítem mostrar a continuación.
- Un criterio de parada que determina cuándo la estimación del nivel es suficientemente precisa.
2. El algoritmo: diagrama del bucle
El corazón de un CAT es un bucle de cinco pasos que se repite hasta que se cumple el criterio de parada. Weiss y Kingsbury describieron este ciclo en los años ochenta y sigue siendo la base de los CAT modernos.
1 Estimar theta inicial
El sistema arranca con un valor de partida. Lo común es theta igual a cero (la media de la escala) o, si existe, un estimador previo del examinado.
2 Seleccionar el ítem con máxima información
El sistema revisa el banco y elige el ítem cuya función de información alcanza su pico en el theta actual. Ese es el ítem que mas reduce la incertidumbre sobre el nivel real.
3 El examinado responde
Se registra la respuesta (correcta o incorrecta en tests de capacidad; la categoría elegida en escalas de personalidad).
4 Re-estimar theta
Con la nueva respuesta, el sistema recalcula theta (por máxima verosimilitud o métodos bayesianos). El valor se actualiza en cada iteración.
5 Criterio de parada
Se evalúa: ¿el error estándar de medición de theta ya es menor que el umbral fijado? ¿o ya se alcanzó el número máximo de ítems? Si alguna condición se cumple, el test termina. Si no, vuelve al paso 2.
EstimarSeleccionarResponderRe-estimarParar
3. Por qué necesita la TRI
Test clásico (TCT)
La dificultad y la discriminación de un ítem dependen de la muestra con la que se calculó. No se puede predecir cómo se comportará un ítem en un examinado con un nivel distinto al promedio de la muestra.
TRI (Lord, Rasch)
Los parámetros del ítem (dificultad b, discriminación a) son invariantes respecto a la muestra. La información que aporta cada ítem es una curva conocida para cada nivel de theta. Eso es lo que permite elegir el ítem óptimo.
Sin TRI no hay CAT. El algoritmo de selección necesita conocer, para cada ítem del banco, cuánta información aporta a cada nivel de theta. Esa curva se llama función de información del ítem y es el criterio de selección.
4. CAT vs test lineal: cuadro comparativo
| Característica | Test lineal (papel o fijo) | CAT |
|---|---|---|
| Número de ítems | Fijo para cada examinado | Variable: cada persona recibe entre 40% y 60% menos ítems |
| Orden | El mismo para cada examinado | Diferente para cada persona |
| Seleccion de ítem | Predeterminada | Dinamica, según theta estimada |
| Precision | Variable: alta cerca del punto medio, baja en los extremos | Aproximadamente constante en todo el rango de theta |
| Protección del material | Baja: un examinado puede copiar y memorizar el test | Alta: cada examinado ve un conjunto distinto de ítems |
| Revisar respuestas | El examinado puede volver atras y cambiar | No se puede: cada respuesta recalibra theta y bloquea la selección siguiente |
| Requisitos | Papel, lápiz, plantilla de corrección | Banco grande calibrado, servidor, software de administración |
5. Ejemplos reales de CAT
GRE
El Graduate Record Examination (Educational Testing Service) introdujo su sección adaptativa de razonamiento verbal y cuantitativo en 1992. Pionero a gran escala.
GMAT
Graduate Management Admission Test. Funcionó como CAT desde 1997. En 2018 pasó a un formato mas corto, manteniendo la lógica adaptativa en secciones.
CAT-ASVAB
Armed Services Vocational Aptitude Battery (Departamento de Defensa, EE. UU.). Versión adaptativa desplegada a mediados de los noventa. Administra aptitudes a millones de reclutas.
Otros ejemplos: el Differential Aptitude Tests (DAT) en versión informatizada, y escalas de personalidad como el MMPI-2 administrado por computadora con lógica adaptativa en bancos grandes. En el area clínica, el PROMIS (Patient-Reported Outcomes Measurement Information System) del NIH administra bancos adaptativos de depresión, ansiedad y dolor.
6. Parámetros TRI y estimación de theta
Para entender por qué el CAT funciona conviene repasar qué paramétrica maneja el banco. Cada ítem del banco tiene, en el modelo de tres parámetros de Lord, tres valores calibrados:
- Parámetro b (dificultad): punto de theta donde el ítem discrimina mas. Un ítem con b alto resulta facil para examinados de nivel bajo.
- Parámetro a (discriminación): pendiente de la función de respuesta. Un ítem con a alta separa bien entre niveles cercanos.
- Parámetro c (adivinación): probabilidad de acertar al azar (relevante en opción múltiple).
Con esos tres parámetros por ítem, el sistema construye la función de información, que indica cuánta precisión aporta cada ítem en cada nivel de theta. El algoritmo de selección elige el ítem cuyo pico de información cae justo sobre el theta actual del examinado.
La estimación de theta se suele hacer por maxima verosimilitud: el valor de theta que hace mas probables las respuestas observadas hasta ese momento. En los primeros ítems el estimador es inestable; por eso algunos CAT arrancan con un método bayesiano (que incorpora una distribución previa) y cambian a maxima verosimilitud cuando hay suficientes respuestas.
7. Criterios de parada
El bucle termina cuando se cumple al menos una de éstas condiciones:
- Error estándar de medición mínimo: la incertidumbre sobre theta baja de un umbral fijado (por ejemplo, error estándar menor a 0.30). Significa que ya se conoce el nivel con suficiente precisión.
- Número máximo de ítems: tope administrativo (por ejemplo, 30 ítems) para acotar el tiempo del examen.
- Agotamiento del banco: no quedan ítems disponibles sin repetir ni con la información necesaria.
8. Limitaciones
Banco grande
El CAT exige cientos de ítems calibrados. Un banco pequeño se agota rápido y el algoritmo no encuentra ítems con información suficiente.
Infraestructura
Servidor, software de administración, calibración TRI del banco. Costo alto comparado con un cuadernillo de papel.
No volver atras
Cada respuesta recalibra theta y bloquea la selección siguiente. El examinado no puede revisar ni cambiar ítems anteriores.
Comparabilidad
Dos examinados responden ítems distintos. La equivalencia se sostiene por la TRI (theta en la misma escala), pero genera dudas metodológicas.
9. Para el parcial
- Definicion de CAT y en qué se diferencia de un test lineal informatizado.
- Los cinco pasos del bucle (estimar, seleccionar, responder, re-estimar, parar).
- Por qué el CAT necesita la TRI (invarianza de parámetros y función de información).
- Los dos criterios de parada (error estándar y número máximo de ítems).
- Ventajas (menos ítems, misma precisión, protección del material) y limitaciones (banco grande, no revisar, costo).
- Ejemplos reales: GRE, GMAT, CAT-ASVAB.
- CAT: selección dinamica del ítem siguiente según theta estimada.
- Bucle E-S-R-R-P: Estimar, Seleccionar, Responder, Re-estimar, Parar.
- Necesita banco calibrado con TRI (función de información del ítem).
- Parada: error estándar mínimo o número máximo de ítems.
- Menos ítems, misma precisión; pero no se puede volver atras.
10. Preguntas de autoevaluación
1. ¿Qué diferencia un CAT de un test lineal administrado por computadora?
El test lineal entrega el mismo bloque de ítems, en el mismo orden, a cada examinado. El CAT selecciona dinámicamente cada ítem siguiente a partir de la habilidad (theta) estimada con las respuestas previas, de modo que cada examinado recibe un conjunto distinto y de longitud variable.
2. ¿Por qué el CAT necesita que el banco esté calibrado con TRI y no con TCT?
La TCT da parámetros dependientes de la muestra: la dificultad de un ítem cambia según quien lo responda. La TRI produce parámetros invariantes (dificultad, discriminación) y, sobre todo, una función de información del ítem que dice cuánto aporta cada ítem en cada nivel de theta. Sin esa curva el algoritmo no puede elegir el ítem óptimo.
3. Nombra los cinco pasos del bucle del CAT en orden.
Estimar theta inicial, seleccionar el ítem con máxima información, registrar la respuesta del examinado, re-estimar theta con esa respuesta, evaluar el criterio de parada. Si no se cumple, vuelve a seleccionar.
4. ¿Cuáles son los dos criterios de parada mas comunes?
El error estándar de medición de theta baja de un umbral fijado (precisión suficiente) o se alcanza el número máximo de ítems permitido (tope administrativo). Un tercer criterio es el agotamiento del banco.
5. Menciona tres limitaciones del CAT.
Exige un banco grande de ítems calibrados con TRI; requiere infraestructura informatica y de servidor; el examinado no puede revisar ni cambiar ítems anteriores porque cada respuesta recalibra theta.
Estudia esta materia jugando en la Escuela PsiqueAcadémica — la sesión 1 es gratis. O comprueba lo que sabes en la Arena de preguntas.
🎮 12 experiencias — ¿prefieres practicarlo jugando? Psique Juegos — aprende jugando →
Ponlo en práctica
Test de conocimiento: Procesos Psicológicos
Pon a prueba lo que sabes de este tema: 12 preguntas reales, tu nivel al final y los temas exactos a reforzar.