Want to create interactive content? It’s easy in Genially!

Get started free

LUCERO MARISOL CALDERÓN NEGRETE

Marisol Calderon

Created on May 23, 2026

Start designing with a free template

Discover more than 1500 professional designs like these:

Akihabara Connectors Infographic

Essential Infographic

Practical Infographic

Akihabara Infographic

Vision Board

The Power of Roadmap

Artificial Intelligence in Corporate Environments

Transcript

PSICOMETRÍA

LOS ITEMS

CARACTERÍSTICAS, TIPOS, pruebas Y Teorías DE verificación

CONCEPTO DE ITEM

Un item es la unidad básica de un test:

Cada pregunta, tarea, estímulo o reactivo al que el evaluado debe responder. Su función es operacionalizar el constructo que se desea medir, de modo que larespuesta del sujeto pueda codificarese numéricamente y contribuir a la puntuacióntotal del instrumento. La calidad de un test depende directamente de la calidad de sus items.

CARACTERÍSTICAS DE UN BUEN ITEM

+info

TIPOS DE ÍTEMS

DE RESPUESTA CONSTRUIDA

DE RESPUESTA SELECCIONADA

*Completar: llenar un espacio en blanco. *Respuesta corta: una palabra o frase breve. *Ensayo: respuesta extensa y libre. *Resolución de problemas: *proceso y resultado. *Asociación libre: palabras o ideas que evocan un estímulo.

*Opción múltiple. *Verdadero/falso. *Emparejamienti: relacionar columnas de elementos. *Ordenamiento: secuenciar elementos según criterio. *Escala Likert: grado de acuerdo en un continuo (1-5). Diferencial semántico: par de adjetivos opuestos.

Según formato de respuesta

DE EJECUCIÓN O DESEMPEÑO

*Dicotómico: sí/no, correcto/incorrecto. *Politómicos: más de dos categorías ordenadas. *Continuos: escala analógica visal (EAV). *De velocidad: tiempo como variable de medida. Pictóricos: imágenes como respuesta o estímulo.

*Manipulación de objetos. *Producción óral. *Simulaciones: escenarios prácticos. *Portafolio: evidencias de trabajos acumulados.

PRUEBAS DE EJECUCIÓN MÁXIMA Y TÍPICA

IMPORTANCIA DE VERIFICAR LOS ITEMS

Las pruebas de ejecución máxima...
¿POR QUÉ VERIFICAR CADA ITEM?

+info

Miden lo que el sujeto puede hacer cuando se esfuerza al máximo. Hay re4spuestas correctas e incorrectas. Se evalúa capacidad, aptitud o conocimiento.

CLASIFICACIÓN DE ITEMAS SEGÚN SU FUNCIONAMIENTO

+info

+info

Las pruebas de ejecución típica...
TEORÍAS DE VERIFICACIÓN

Miden lo que el sujeto hace habitualmente, actitudes, rasgos, emociones o conductas. No hay respuestas correctas, se evalúa la tendencia de comportamiento.

+info

Corrección por azar...

Items abiertos y su verificación...

+info

Items al zar (omisión vs respuesta)...

+info

+info

Conocimiento parcial...

+info

CATEGORÍA DESCRIPCIÓN ACCIÓN

  • Item excelente Dificultad (0.05), discriminación alta Conservar en la
sin DIF, distractores funcionales. versión definitiva.
  • Item aceptable Parámetros dentro de rangos aceptables Conservar con
(D entre 0.20-0.39); pequeñas imprecisiones revisión menor. de redacción.
  • Item marginal Baja discriminación (D entre 0.10-0.19) o Revisar y reescribir
dificultadnextrema, DIF significativo. antes de conservar.
  • Item deficiente Discriminación negativa o muy baja (D<0.10);
dificultad extrema (>0.85): DIF significativo. Eliminar test.
  • Item sesgado Funciona diferente para subgrupos (género, etnia, Revisar contenido y
nivel educativo) con DIF estadísticamente significativo. redacción; posiblemente eliminar. * Item trampa Redacción ambigua que lleva al error a sujetos capaces Reescribir o eliminar. correlación item total baja incluso en un gruppo alto.

EJEMPLOS:

  • Escala de inteligencia de Wechsler (WAIS-IV): Mide inteligencia general en adultos mediante subtests verbales y de ejecución (vocabulario, matrices, cubos.)
  • Matrices progresivas de Raven: evalúa razonamiento abstracto y capacidad de inferir relaciones mediante patrones visuales sin componente verbal.
  • DAT (Test de AptitudeDdiferenciales): Mide aptitudes específicas, razonamiento verbal, razonaiento fluido, memoria de trabajo y velocidad de procesamiento.
  • WISC-V (Escala para niños): versión infantil del WAIS, evalúa comprensión verbal, razonamiento fluido, memoria de trabajo y velocidad de procesamiento.
  • BADYG (Batería de Aptitudes Diferenciales y Generales): evalúa inteligencia y aptitudes en población escolar hipanohabloante; incluyeel razonamiento lógico, númerico y verbal.

TÉCNICAS

Redacción clara y sin ambigüedades. Lenguaje adecuado. Una sola idea por item. Independiente de otros items. Sin doble negación. MÉTRICAS: Dificultadadecuada al propósito. Alta capacidad discriminativa. Sin funcionamiento diferencial. Carga factorial con el constructo correcto.

ÉTICAS DE CONTENIDORepresentativo del dominio evaluado.

  • Sin sesgos culturales, de género o socioeconómicos.
  • Valido por expertos.
  • Respetuoso y no invasivo.
  • Pertinente al propósito del test.

EJEMPLOS

  • NEO-PI-R (Inventario de Personalidad: evalúa los cinco grandes factores de personalidad; neuroticismo, extraversión, apertura, amabilidad y responsabilidad.
  • MMPI-2 (Inventario Multifásico de Personalidad de Minnesota: Instrumento clínico de amplio espectro para evaluar psicopatología, rasgos de personalidad y escalas de validez.
  • DI-II (Inventario de Depresión de Beck): Mide la intensidad de síntomas depresivos en las últimas dos semanas mediante 21 items con escala Likert.
  • STAI (Inventario de Ansiedad Estado-Rasgo): diferencia entre ansiedad como estado transitorio y como rasgo estable de personalidad en dos subescalas independientes.
  • 16PF (Cuestionario de 16 Factores de Personalidad de Cattell): evañúa 16 dimensiones de personalidad y 5 factores globales; uso clínico, educativo y organizacional.

La verificación de items garantiza que cada reactivo mida lo que se supone que debe medir, con la dificultad adecuada y sin sesgos. Un itemdeficiente contamina la puntuación total, reducela fiabilidad del test y compromete las decisiones que se tomen a partir de sus resultados. La verificación se realiza en un análisis sualitativo; juicio de expertos. Y análisis cuantitativo; parámetro estadísticos de los items.

CORRECCIÓN POR AZÁR (FORMULA DE CORRECCIÓN)

Se aplica en items de opción múltiple, donde el sujeto puede acertar por azar sin conocer la respuesta. La fórmula descuenta una fracción de los errores para penalizar la respuesta al azar.PC= A- E / (K-1). Donde PC= puntuación corregiga. A= aciertos. E= errores. K= número de alternativas. Si el sujeto responde todas las preguntas al azar en un test v/f, la corrección lleva la puntuación a 0. Se recomienda indicar al evaluado si se aplicará penalización.

Los items de respuest construida (ensayo, respuesta corta). No tienen corrección automática. Para verificarlos se usan:*Rúbricas analítica: criterios detallados por dimensión. *Rúbricas holísticas: impresión global del desempeño. *Doble corrección ciega: dos evaluadores independientes. *Correlación inter-jueces (k de Cohen): mide acuerdo entre correctores. Su ventaja es que permiten evaluar procesos complejos, su desventaja es la subjetividad si no se estandariza la corrección.

El problema del azar surge cuando el sujeto omite items o responde sin saber. Existen dos estrategias de instrucción:-Sin penalización: se pide responder todos los items; puntuación = aciertos. Favorece a sujetos arriesgados. -Con penalización: se aplica la formulación de corrección; favorece a sujetos prudentes. Número de items intentados: alternativa que registra solo los respondidos. La decisión depende del propósito del test y del perfil de la población evaluada.

El modelo clásico trata las respuestas como todo o nada. Sin embargo, el sujeto puede tener conocimiento parcial del item: sabe que algunas opciones son incorrectas aunque no identifique la correcta. Para capturarlos se usan:-Formato de confianza: el sujeto indica su nivel de seguridad en la respuesta. -Respuesta eliminatoria: el sujeto tacha las opciones que sabe que son incorrectas. -Puntuación ponderada: se asigna crédito parcial según el subconjunto de opciones marcadas. - TRI con parámetro de pseudo-azar (c): estrima la probabilidad de acertar sin conocimiento real. Estos métodos mejoran la precisión de la medición y reducen el efecto del azar en la puntuación final.