Skip to content

Tests adaptativos informatizados (CAT)

Tesis del tema: un test adaptativo informatizado (CAT) no entrega el mismo bloque de preguntas a cada persona. Selecciona el siguiente ítem en función de la habilidad estimada del examinado, de modo que con la mitad de los ítems se alcanza la misma precisión que un test lineal fijo.

En una frase: el CAT te hace la pregunta que mas information te da sobre tu nivel real.

1. Qué es un CAT

Un CAT es un test administrado por computadora que elige dinámicamente cada ítem a partir de la respuesta anterior. La idea central, formulada por Lord a comienzos de los setenta, es que un test fijo desperdicia preguntas: si ya sabemos que el examinado es muy capaz, darle ítems fáciles no aporta nada, y si tiene un nivel bajo, los ítems difíciles solo generan frustración sin aportar información.

El CAT requiere tres componentes que un test en papel no necesita:

  1. Un banco de ítems calibrado con TRI (Teoría de Respuesta al Ítem): cada ítem tiene parámetros de dificultad, discriminación y, según el modelo, adivinación.
  2. Un algoritmo de selección que decide qué ítem mostrar a continuación.
  3. Un criterio de parada que determina cuándo la estimación del nivel es suficientemente precisa.
Definición clave: el CAT NO es un test que se corrige por computadora. Es un test donde el orden y la cantidad de ítems cambian para cada persona, porque el sistema estima en tiempo real la habilidad (theta) del examinado y pide el ítem que mas information aporta para ese theta.

2. El algoritmo: diagrama del bucle

El corazón de un CAT es un bucle de cinco pasos que se repite hasta que se cumple el criterio de parada. Weiss y Kingsbury describieron este ciclo en los años ochenta y sigue siendo la base de los CAT modernos.

1 Estimar theta inicial

El sistema arranca con un valor de partida. Lo común es theta igual a cero (la media de la escala) o, si existe, un estimador previo del examinado.

paso a

2 Seleccionar el ítem con máxima información

El sistema revisa el banco y elige el ítem cuya función de información alcanza su pico en el theta actual. Ese es el ítem que mas reduce la incertidumbre sobre el nivel real.

paso a

3 El examinado responde

Se registra la respuesta (correcta o incorrecta en tests de capacidad; la categoría elegida en escalas de personalidad).

paso a

4 Re-estimar theta

Con la nueva respuesta, el sistema recalcula theta (por máxima verosimilitud o métodos bayesianos). El valor se actualiza en cada iteración.

paso a

5 Criterio de parada

Se evalúa: ¿el error estándar de medición de theta ya es menor que el umbral fijado? ¿o ya se alcanzó el número máximo de ítems? Si alguna condición se cumple, el test termina. Si no, vuelve al paso 2.

VUELTA AL PASO 2 mientras no se cumpla el criterio de parada
Truco de memoria: el ciclo del CAT se recuerda como E-S-R-R-P (Estimar, Seleccionar, Responder, Re-estimar, Parar). Si no para, vuelve a Seleccionar.
EstimarSeleccionarResponderRe-estimarParar

3. Por qué necesita la TRI

Test clásico (TCT)

La dificultad y la discriminación de un ítem dependen de la muestra con la que se calculó. No se puede predecir cómo se comportará un ítem en un examinado con un nivel distinto al promedio de la muestra.

TRI (Lord, Rasch)

Los parámetros del ítem (dificultad b, discriminación a) son invariantes respecto a la muestra. La información que aporta cada ítem es una curva conocida para cada nivel de theta. Eso es lo que permite elegir el ítem óptimo.

Sin TRI no hay CAT. El algoritmo de selección necesita conocer, para cada ítem del banco, cuánta información aporta a cada nivel de theta. Esa curva se llama función de información del ítem y es el criterio de selección.

4. CAT vs test lineal: cuadro comparativo

CaracterísticaTest lineal (papel o fijo)CAT
Número de ítemsFijo para cada examinadoVariable: cada persona recibe entre 40% y 60% menos ítems
OrdenEl mismo para cada examinadoDiferente para cada persona
Seleccion de ítemPredeterminadaDinamica, según theta estimada
PrecisionVariable: alta cerca del punto medio, baja en los extremosAproximadamente constante en todo el rango de theta
Protección del materialBaja: un examinado puede copiar y memorizar el testAlta: cada examinado ve un conjunto distinto de ítems
Revisar respuestasEl examinado puede volver atras y cambiarNo se puede: cada respuesta recalibra theta y bloquea la selección siguiente
RequisitosPapel, lápiz, plantilla de correcciónBanco grande calibrado, servidor, software de administración
Trampa de parcial: confundir CAT con "corrección automatica". Un examen en computadora que entrega el mismo bloque de preguntas a cada examinado NO es un CAT. Lo que define el CAT es la selección dinamica del ítem siguiente en función del nivel estimado. Si el orden y los ítems son los mismos para cada examinado, es un test lineal informatizado, no adaptativo.

5. Ejemplos reales de CAT

GRE

El Graduate Record Examination (Educational Testing Service) introdujo su sección adaptativa de razonamiento verbal y cuantitativo en 1992. Pionero a gran escala.

GMAT

Graduate Management Admission Test. Funcionó como CAT desde 1997. En 2018 pasó a un formato mas corto, manteniendo la lógica adaptativa en secciones.

CAT-ASVAB

Armed Services Vocational Aptitude Battery (Departamento de Defensa, EE. UU.). Versión adaptativa desplegada a mediados de los noventa. Administra aptitudes a millones de reclutas.

Otros ejemplos: el Differential Aptitude Tests (DAT) en versión informatizada, y escalas de personalidad como el MMPI-2 administrado por computadora con lógica adaptativa en bancos grandes. En el area clínica, el PROMIS (Patient-Reported Outcomes Measurement Information System) del NIH administra bancos adaptativos de depresión, ansiedad y dolor.

6. Parámetros TRI y estimación de theta

Para entender por qué el CAT funciona conviene repasar qué paramétrica maneja el banco. Cada ítem del banco tiene, en el modelo de tres parámetros de Lord, tres valores calibrados:

  1. Parámetro b (dificultad): punto de theta donde el ítem discrimina mas. Un ítem con b alto resulta facil para examinados de nivel bajo.
  2. Parámetro a (discriminación): pendiente de la función de respuesta. Un ítem con a alta separa bien entre niveles cercanos.
  3. Parámetro c (adivinación): probabilidad de acertar al azar (relevante en opción múltiple).

Con esos tres parámetros por ítem, el sistema construye la función de información, que indica cuánta precisión aporta cada ítem en cada nivel de theta. El algoritmo de selección elige el ítem cuyo pico de información cae justo sobre el theta actual del examinado.

La estimación de theta se suele hacer por maxima verosimilitud: el valor de theta que hace mas probables las respuestas observadas hasta ese momento. En los primeros ítems el estimador es inestable; por eso algunos CAT arrancan con un método bayesiano (que incorpora una distribución previa) y cambian a maxima verosimilitud cuando hay suficientes respuestas.

Punto clave: la selección del primer ítem es delicada porque no hay información previa. Las estrategias habituales son: partir de theta igual a cero (la media), partir de un estimador previo (si existe), o repartir los primeros ítems de dificultad variable para acotar rápido el rango.

7. Criterios de parada

El bucle termina cuando se cumple al menos una de éstas condiciones:

  1. Error estándar de medición mínimo: la incertidumbre sobre theta baja de un umbral fijado (por ejemplo, error estándar menor a 0.30). Significa que ya se conoce el nivel con suficiente precisión.
  2. Número máximo de ítems: tope administrativo (por ejemplo, 30 ítems) para acotar el tiempo del examen.
  3. Agotamiento del banco: no quedan ítems disponibles sin repetir ni con la información necesaria.
Punto clave: el criterio por error estándar permite que una persona con un nivel claro termine el test en pocos ítems, mientras que una persona cuyo nivel es ambiguo reciba mas ítems. Esa es la diferencia con un test lineal, donde la longitud es fija sin importar la precisión lograda.

8. Limitaciones

Banco grande

El CAT exige cientos de ítems calibrados. Un banco pequeño se agota rápido y el algoritmo no encuentra ítems con información suficiente.

Infraestructura

Servidor, software de administración, calibración TRI del banco. Costo alto comparado con un cuadernillo de papel.

No volver atras

Cada respuesta recalibra theta y bloquea la selección siguiente. El examinado no puede revisar ni cambiar ítems anteriores.

Comparabilidad

Dos examinados responden ítems distintos. La equivalencia se sostiene por la TRI (theta en la misma escala), pero genera dudas metodológicas.

Analogía útil: un CAT es como un sastre que mide mientras corta. Un test lineal seria el traje de talla única: cada persona recibe el mismo. El CAT mide tu talla con cada respuesta y ajusta la siguiente pieza para que encaje en tu nivel.

9. Para el parcial

Lo que con probabilidad te van a preguntar:
  • Definicion de CAT y en qué se diferencia de un test lineal informatizado.
  • Los cinco pasos del bucle (estimar, seleccionar, responder, re-estimar, parar).
  • Por qué el CAT necesita la TRI (invarianza de parámetros y función de información).
  • Los dos criterios de parada (error estándar y número máximo de ítems).
  • Ventajas (menos ítems, misma precisión, protección del material) y limitaciones (banco grande, no revisar, costo).
  • Ejemplos reales: GRE, GMAT, CAT-ASVAB.
Repaso en 30 segundos:
  • CAT: selección dinamica del ítem siguiente según theta estimada.
  • Bucle E-S-R-R-P: Estimar, Seleccionar, Responder, Re-estimar, Parar.
  • Necesita banco calibrado con TRI (función de información del ítem).
  • Parada: error estándar mínimo o número máximo de ítems.
  • Menos ítems, misma precisión; pero no se puede volver atras.

10. Preguntas de autoevaluación

1. ¿Qué diferencia un CAT de un test lineal administrado por computadora?

El test lineal entrega el mismo bloque de ítems, en el mismo orden, a cada examinado. El CAT selecciona dinámicamente cada ítem siguiente a partir de la habilidad (theta) estimada con las respuestas previas, de modo que cada examinado recibe un conjunto distinto y de longitud variable.

2. ¿Por qué el CAT necesita que el banco esté calibrado con TRI y no con TCT?

La TCT da parámetros dependientes de la muestra: la dificultad de un ítem cambia según quien lo responda. La TRI produce parámetros invariantes (dificultad, discriminación) y, sobre todo, una función de información del ítem que dice cuánto aporta cada ítem en cada nivel de theta. Sin esa curva el algoritmo no puede elegir el ítem óptimo.

3. Nombra los cinco pasos del bucle del CAT en orden.

Estimar theta inicial, seleccionar el ítem con máxima información, registrar la respuesta del examinado, re-estimar theta con esa respuesta, evaluar el criterio de parada. Si no se cumple, vuelve a seleccionar.

4. ¿Cuáles son los dos criterios de parada mas comunes?

El error estándar de medición de theta baja de un umbral fijado (precisión suficiente) o se alcanza el número máximo de ítems permitido (tope administrativo). Un tercer criterio es el agotamiento del banco.

5. Menciona tres limitaciones del CAT.

Exige un banco grande de ítems calibrados con TRI; requiere infraestructura informatica y de servidor; el examinado no puede revisar ni cambiar ítems anteriores porque cada respuesta recalibra theta.

Estudia esta materia jugando en la Escuela PsiqueAcadémica — la sesión 1 es gratis. O comprueba lo que sabes en la Arena de preguntas.

PsiqueAcadémica · Cuaderno de Psicometría II

Fuentes verificadas: Lord (1980, Applications of Item Response Theory to Practical Testing Problems); Weiss (1982, New Horizons in Testing); Wainer (2000, Computerized Adaptive Testing: A Primer, 2.ª ed.); Kingsbury y Weiss (1983, Journal of Educational Measurement, 20(4)); Educational Testing Service (1992, GRE technical manual).

🎮 12 experiencias — ¿prefieres practicarlo jugando? Psique Juegos — aprende jugando →

Ponlo en práctica

Test de conocimiento: Procesos Psicológicos

Pon a prueba lo que sabes de este tema: 12 preguntas reales, tu nivel al final y los temas exactos a reforzar.

Los 20 cuadros clínicos del DSM-5-TR, en una sola guía

Descarga el resumen visual que RDK usa en clase: diagnósticos, criterios y diferenciadores en 20 fichas listas para estudiar.

Sin spam · Descarga instantánea