psicometria
|
|
Título del Test:
![]() psicometria Descripción: psicometria T1-2-3 |



| Comentarios |
|---|
NO HAY REGISTROS |
|
Respecto a la medición psicológica, señale la respuesta correcta: Permite observar directamente los constructos psicológicos. Es un procedimiento sistemático para describir variables psicológicas. Solo tiene utilidad en el ámbito clínico. ¿Cuál de las siguientes afirmaciones sobre los constructos es correcta?. Pueden definirse aisladamente sin relacionarlos con otras variables. Siempre poseen una unidad de medida claramente definida. Deben relacionarse con otros constructos y con conductas observables. ¿Cuál de los siguientes hechos dificulta la medición psicológica?. La inexistencia de error de medida. La existencia de una única forma aceptada de medir los constructos. La ausencia de escalas con origen y unidades perfectamente definidas. ¿Cuál es el principal objetivo de la TRI?. Obtener instrumentos cuyos parámetros dependan menos de la muestra. Sustituir completamente la TCT. Eliminar el error aleatorio. En un test de ejecución máxima: Los ítems suelen ordenarse desde los más fáciles hasta los más difíciles. Todos los ítems presentan la misma dificultad. No existe índice de dificultad. Un test multidimensional, respecto a uno unidimensional, suele requerir: Mayor homogeneidad entre todos sus ítems. Menor homogeneidad entre sus ítems. Que todos los ítems tengan ID = 0,50. Un ítem discrimina poco cuando: Lo aciertan tanto las personas con puntuaciones altas como bajas. Solo lo aciertan quienes obtienen altas puntuaciones. Tiene dificultad media. ¿Cuál de las siguientes recomendaciones es adecuada al redactar un ítem?. Utilizar palabras cuyo significado pueda interpretarse de varias formas. Formular una única idea por enunciado. Emplear dobles negaciones para aumentar la precisión. En un ítem de respuesta corta es recomendable: Permitir varias respuestas correctas. Que los espacios en blanco tengan la misma longitud. Utilizar determinantes como "siempre" y "nunca". La tendencia a escoger sistemáticamente la opción central ("ni de acuerdo ni en desacuerdo") recibe el nombre de: Aquiescencia. Indecisión. Respuesta extrema. Antes de presentar los ítems del test debe aparecer: La clave de corrección. Las instrucciones para realizar la prueba. La puntuación obtenida por otros participantes. Las evidencias de contenido requieren: Consultar a personas expertas en el constructo. Aplicar exclusivamente análisis factorial. Comparar el test con otros instrumentos. Las evidencias basadas en los procesos de respuesta permiten: Comprender cómo las personas llegan a sus respuestas. Calcular el índice de dificultad. Detectar la deseabilidad social exclusivamente. El análisis de la estructura interna pretende comprobar que: El test constituye un constructo coherente. Todos los ítems tengan dificultad media. El test sea corto. El funcionamiento diferencial de los ítems (DIF) estudia si: Los ítems presentan distinta dificultad según el grupo evaluado. Todos los ítems tienen el mismo índice de dificultad. El test posee suficiente homogeneidad. Si dos pruebas miden el mismo constructo mediante procedimientos diferentes, lo esperable es que: Presenten una alta correlación. No correlacionen entre sí. Presenten correlaciones negativas. En una matriz multitratgo-multimétodo, la validez discriminante se observa cuando: Los constructos diferentes presentan correlaciones bajas. Los mismos constructos presentan correlaciones altas. Todos los métodos producen las mismas correlaciones. Se desea elaborar un examen de 70 preguntas. El área "Construcción de tests" representa el 20 % del examen y el proceso "Comprensión" el 50 %. ¿Cuántos ítems corresponderán a esa combinación?. 5. 7. 14. En un examen con 15 preguntas de 3 alternativas, un estudiante acierta 12. Aplicando la corrección por azar, la puntuación corregida será: 10.5. 11. 12. ¿Cuál de las siguientes situaciones corresponde mejor a la función de orientación/consejo?. Conceder un título universitario. Detectar los intereses de una persona para recomendarle el itinerario más adecuado. Seleccionar únicamente a los candidatos con mayor puntuación. Un test se utiliza para asignar a los estudiantes al grupo de inglés A1, B1 o C1 según su nivel. ¿Qué utilización tiene principalmente?. Selección. Clasificación/colocación. Certificación. Un colegio utiliza un test para decidir si un alumno ha alcanzado los objetivos mínimos para pasar de curso. ¿Qué utilización tiene principalmente?. Diagnóstico. Selección. Selección educativa (Apto/No apto). ¿Cuál de las siguientes afirmaciones sobre los constructos es incorrecta?. Pueden definirse completamente de forma aislada. Se relacionan con otros constructos. Se relacionan con conductas observables. ¿Cuál de los siguientes problemas de la medición hace referencia a que los tests solo evalúan una parte del comportamiento que quieren medir?. Error aleatorio. Muestreo limitado de conductas. Indeterminación de la medida. Según la TRI, un buen instrumento de medida debería: Depender lo máximo posible de la muestra. Mantener sus propiedades aunque cambie la muestra. Eliminar completamente el error. En un test unidimensional, la homogeneidad entre los ítems debe ser: Mayor que en un test multidimensional. Menor que en un test multidimensional. Igual en ambos. ¿Qué característica psicométrica indica si un ítem diferencia bien entre participantes con puntuaciones altas y bajas?. Índice de dificultad. Poder discriminativo. Homogeneidad. ¿Cuál de las siguientes recomendaciones corresponde específicamente a los ítems Verdadero/Falso?. Aleatorizar la posición de la respuesta correcta. Utilizar distractores plausibles. Permitir varias respuestas correctas. En los ítems de elección múltiple, los distractores deben ser: Evidentemente falsos. Plausibles. Más largos que la respuesta correcta. En los ítems de respuesta corta se recomienda: Que existan varias respuestas posibles. Que solo exista una respuesta correcta. Utilizar términos ambiguos. ¿Cuál de los siguientes sesgos consiste en responder siempre "sí" o "de acuerdo", independientemente del contenido?. Indecisión. Deseabilidad social. Aquiescencia. En un test de velocidad, las instrucciones deben informar: Del límite de tiempo. Del índice de dificultad. Del análisis factorial. ¿Por qué se incluyen ejemplos en las instrucciones?. Para enseñar cómo responder. Para aumentar la dificultad. Para reducir el número de ítems. ¿Cuál de los siguientes aspectos NO pertenece al formato de presentación del test?. Solicitar los datos identificativos. Agrupar ítems del mismo formato. Consultar a expertos. La validez aparente hace referencia a: La impresión que produce el test a quien lo responde. El resultado del análisis factorial. La correlación entre dos pruebas. ¿Qué evidencia de validez estudia si el test constituye un constructo coherente?. Evidencias de contenido. Procesos de respuesta. Estructura interna. La técnica más utilizada para estudiar la estructura interna es: Regresión lineal. Análisis factorial. ANOVA. Si dos tests miden constructos diferentes, lo esperable es: Correlaciones bajas. Correlaciones muy altas. Correlación perfecta. Se elabora un examen de 90 preguntas. El tema "Validez" representa el 20 % y el proceso "Comprensión" el 50 %. ¿Cuántas preguntas corresponderán a esa combinación?. 9. 18. 10. En un examen de 20 preguntas con 4 alternativas, un estudiante acierta 14. ¿Cuál es su puntuación corregida por azar?. 12. 10. 11. Un investigador crea un test de ansiedad y comprueba que apenas incluye preguntas sobre síntomas fisiológicos, aunque estos forman parte del constructo definido. ¿Qué evidencia de validez está principalmente comprometida?. Procesos de respuesta. Evidencias de contenido. Estructura interna. Tras responder un test, varios participantes comentan que las preguntas parecen medir memoria en lugar de ansiedad. ¿A qué aspecto hace referencia principalmente esta información?. Validez aparente. Validez convergente. Funcionamiento diferencial de los ítems. En un test de personalidad, un participante marca casi siempre la opción "Totalmente de acuerdo", independientemente del contenido de los ítems. ¿Qué sesgo presenta?. Deseabilidad social. Aquiescencia. Indecisión. En un examen tipo test, un profesor utiliza distractores muy poco creíbles. ¿Cuál será probablemente la consecuencia?. Aumentará artificialmente la probabilidad de acierto. Disminuirá la dificultad del examen. Ambas respuestas anteriores son correctas. Un test contiene un único ítem relacionado con memoria y otros 39 relacionados con atención. ¿Cuál es el principal problema?. Baja homogeneidad. Bajo índice de dificultad. Exceso de discriminación. Dos estudiantes obtienen la misma puntuación total en un test. Uno ha acertado muchos ítems difíciles y otro muchos fáciles. ¿Qué teoría permite diferenciar mejor esta situación?. TCT. TRI. Ninguna de las dos. ¿Cuál de las siguientes situaciones corresponde a un uso de diagnóstico?. Conceder un certificado oficial. Detectar un trastorno del aprendizaje. Asignar estudiantes a distintos niveles. En un test de velocidad todos los ítems son muy fáciles porque: La dificultad reside en el tiempo disponible. Se pretende aumentar el poder discriminativo. El índice de dificultad deja de existir. ¿Cuál de estas situaciones refleja mejor el cumplimiento del principio de isomorfismo?. Dos personas con mayor ansiedad obtienen puntuaciones mayores. Todos los participantes obtienen puntuaciones distintas. Todos los ítems tienen el mismo formato. Un investigador elimina todos los ítems que presentan dificultad media. ¿Qué característica psicométrica será la más afectada?. Poder discriminativo. Validez aparente. Deseabilidad social. ¿Qué formato de ítem exige que las premisas y las respuestas sean homogéneas?. Emparejamiento. Respuesta corta. Cloze. ¿Cuál es la principal finalidad de incluir ejemplos en las instrucciones?. Reducir la ansiedad y explicar cómo responder. Aumentar la longitud del test. Mejorar la validez convergente. En un estudio, dos pruebas diferentes que miden inteligencia presentan una correlación de 0,88. Este resultado aporta principalmente evidencias de: Validez discriminante. Validez convergente. Funcionamiento diferencial. Dos pruebas muestran una correlación de 0,10 y pretenden medir constructos distintos. Este resultado indica: Buena validez discriminante. Mala estructura interna. Baja homogeneidad. Se desea elaborar un examen de 100 preguntas. El contenido "Validez" representa el 15 %. Dentro de él, el proceso "Aplicación" representa el 40 %. ¿Cuántas preguntas corresponderán a esa combinación?. 4. 6. 15. En un examen de 30 preguntas con 3 alternativas, un estudiante acierta 21. ¿Cuál será su puntuación corregida por azar?. 16,5. 18. 21. ¿Cuál de estas recomendaciones pertenece específicamente a los ítems de elección múltiple?. Que los distractores sean plausibles. Que todas las respuestas correctas aparezcan al principio. Utilizar frecuentemente "Todas las anteriores". ¿Qué problema de la medición psicológica explica que no existan unidades naturales como centímetros o kilos?. Error aleatorio. Indeterminación de la medida. Muestreo de conductas. ¿Qué afirmación describe mejor la función predictiva de la medición?. Permite describir una variable psicológica. Permite expresar relaciones funcionales entre constructos. Permite clasificar sujetos en grupos. ¿Cuál de las siguientes afirmaciones sobre la estructura interna es correcta?. Solo puede evaluarse preguntando a expertos. Analiza si el conjunto de ítems forma un constructo coherente. Estudia únicamente el índice de dificultad de cada ítem. Una psicóloga diseña un test de ansiedad. Tras revisarlo, varios expertos indican que apenas hay preguntas sobre síntomas cognitivos, aunque forman parte del constructo definido. ¿Qué aspecto debería mejorar?. La estructura interna. Las evidencias de contenido. La validez convergente. Un estudiante responde "Totalmente de acuerdo" en casi todos los ítems de un cuestionario de personalidad, incluso cuando los enunciados expresan ideas opuestas. ¿Qué sesgo presenta?. Deseabilidad social. Indecisión. Aquiescencia. En un test de inteligencia, un ítem es acertado por casi todos los participantes, independientemente de su nivel. ¿Qué puede afirmarse sobre ese ítem?. Tiene poco poder discriminativo. Tiene mucha homogeneidad. Presenta un DIF elevado. Un orientador administra una prueba de inglés para decidir si un alumno entra en el grupo A2, B1 o B2. ¿Cuál es la finalidad principal del test?. Diagnóstico. Clasificación. Certificación. Un investigador quiere que las características de los ítems sean estables aunque aplique el test a muestras diferentes. ¿Qué teoría se ajusta mejor a ese objetivo?. TCT. TRI. Ninguna de las dos. En un test todos los ítems evalúan razonamiento lógico, excepto uno que evalúa memoria. ¿Cuál será la consecuencia más probable?. Disminuirá la homogeneidad. Aumentará la discriminación. Mejorará la validez convergente. Antes de aplicar un test, el evaluador informa de que algunos ítems serán muy difíciles y que eso es completamente normal. ¿En qué tipo de test es especialmente recomendable esta indicación?. Test de velocidad. Test de ejecución máxima. Test de personalidad. Un investigador compara dos pruebas distintas que pretenden medir depresión y obtiene una correlación muy alta. ¿Qué evidencia está obteniendo?. Validez convergente. Validez discriminante. Validez aparente. Un test contiene numerosos enunciados con dobles negaciones. ¿Qué problema puede producir?. Mayor claridad. Confusión en la respuesta. Mayor discriminación. Un profesor construye un examen con 60 preguntas. El tema "Validez" representa el 25 % del examen y el proceso "Aplicación" el 40 %. ¿Cuántas preguntas corresponderán a esa combinación?. 6. 10. 15. Un alumno realiza un examen de 20 preguntas con 5 alternativas. Obtiene 15 aciertos. ¿Cuál es la puntuación corregida por azar?. 13.75. 15. 12.5. Tras analizar un test, se observa que los ítems se agrupan claramente en los factores previstos por la teoría. ¿Qué evidencia aporta principalmente este resultado?. Estructura interna. Evidencias de contenido. Procesos de respuesta. Un participante afirma: "Este test realmente parece medir autoestima". ¿A qué tipo de evidencia hace referencia esa opinión?. Evidencias de contenido. Validez aparente. Validez convergente. En un examen tipo test, todos los distractores son absurdos y fáciles de descartar. ¿Qué consecuencia es más probable?. Aumentará el acierto por azar. Disminuirá el porcentaje de aciertos. Mejorará la discriminación. En un cuestionario aparecen el mismo número de ítems redactados en sentido positivo y negativo. ¿Qué se intenta reducir principalmente?. Aquiescencia. Funcionamiento diferencial. Índice de dificultad. Dos tests que miden constructos diferentes presentan una correlación prácticamente nula. ¿Qué indica este resultado?. Buena validez discriminante. Mala estructura interna. Baja homogeneidad. Un investigador quiere comprobar cómo razonan los participantes para contestar cada pregunta del test. ¿Qué tipo de evidencia está estudiando?. Procesos de respuesta. Estructura interna. Contenido. En un test de ejecución típica, un investigador calcula el índice de dificultad de todos los ítems. ¿Qué puede decirse?. Es un procedimiento adecuado. Carece de sentido en este tipo de test. Solo puede hacerse en la TRI. Un ítem presenta un ID de 0,52. ¿Qué característica cabe esperar, en general?. Buen poder discriminativo. Que sea muy difícil. Que no pueda utilizarse en un test. Al elaborar un test, el investigador decide incluir únicamente preguntas sobre memoria, aunque el constructo definido era "inteligencia general". ¿Cuál será el principal problema?. Baja representatividad del contenido. Baja validez discriminante. Exceso de aquiescencia. Una psicóloga diseña un test de autoestima. Tres expertos indican que varios ítems no representan adecuadamente el constructo definido. ¿Qué tipo de evidencia está analizando?. Estructura interna. Evidencias de contenido. Procesos de respuesta. Un grupo de jueces debe valorar cada ítem únicamente respecto a su dimensión teórica utilizando una escala de -1, 0 y 1. ¿Qué procedimiento están utilizando?. Dunn et al. Osterlind. V de Aiken. Un investigador quiere que los jueces valoren cada ítem en todas las dimensiones posibles sin saber a cuál pertenece realmente. ¿Qué protocolo utilizará?. Dunn et al. Osterlind. Kappa. En un protocolo Dunn, un juez asigna un 5 a un ítem en una dimensión. ¿Qué significa?. Baja idoneidad. Idoneidad media. Alta idoneidad. Una psicóloga pide a los expertos que valoren si los ítems están redactados de forma comprensible para los destinatarios. ¿Qué está evaluando?. Claridad. Homogeneidad. Discriminación. El indicador de claridad se calcula mediante: La media. La mediana. La moda. Un ítem obtiene una V de Aiken de 0,82 en su dimensión teórica. ¿Qué puede afirmarse inicialmente?. Supera el punto de corte habitual. Debe eliminarse. Tiene baja idoneidad. Un ítem obtiene una V de Aiken de 0,30 en una dimensión a la que NO pertenece. ¿Qué interpretación sería más adecuada?. Resultado deseable. Resultado problemático. Debe calcularse Kappa. ¿Qué rango de valores puede tomar la V de Aiken?. -1 a +1. 0 a 1. 0 a 100. Un ítem presenta un CVR igual a 0. ¿Qué significa?. Ningún experto lo considera esencial. El 50 % de expertos lo considera esencial. Todos los expertos lo consideran esencial. Una comisión de 6 expertos evalúa un ítem. Según Lawshe, el CVR mínimo exigido será aproximadamente. 0,99. 0,55. 0,29. Una comisión de 45 expertos evalúa un ítem. Según Lawshe, el CVR mínimo exigido será: 0,99. 0.49. 0.29. Dos jueces valoran un conjunto de ítems. Se desea conocer cuánto acuerdo existe por encima del esperado por azar. ¿Qué índice es más apropiado?. Kappa de Cohen. V de Aiken. CVR. Un Kappa de 0,75 se interpreta como: Concordancia débil. Concordancia buena. Concordancia muy buena. Un Kappa de 0,15 se interpreta como: Pobre. Moderada. Buena. Varios expertos ordenan una serie de ítems según su calidad. ¿Qué índice sería especialmente adecuado?. W de Kendall. V de Aiken. CVR. Un investigador obtiene una W de Kendall de 0,88. ¿Qué indica?. Escasa concordancia. Buena concordancia entre jueces. Baja validez de contenido. Una estudiante responde: "Este cuestionario realmente parece medir ansiedad." ¿A qué tipo de evidencia corresponde?. Validez aparente. V de Aiken. Estructura interna. Dos pruebas diferentes que miden depresión correlacionan 0,91. ¿Qué evidencia aportan?. Validez discriminante. Validez convergente. Claridad. Un investigador elimina un ítem porque mide memoria mientras que el resto del test mide atención. La razón principal es: Mejorar la homogeneidad. Mejorar la claridad. Mejorar el Kappa. Un investigador quiere medir inteligencia, pero únicamente incluye ítems sobre memoria. ¿Cuál es el principal problema?. Baja validez discriminante. Baja representatividad del contenido. Baja estructura interna. Un participante afirma: "Este test parece adecuado para medir ansiedad." Esta afirmación aporta evidencia de: Validez aparente. Validez convergente. Estructura interna. En un test de personalidad se calcula el índice de dificultad de los ítems. ¿Qué puede decirse?. Es necesario. Tiene sentido solo en TRI. No tiene sentido. Un ítem es acertado por el 95 % de los participantes. Ese ítem es: Muy fácil. Muy difícil. Muy homogéneo. ¿Qué característica psicométrica indica que un ítem mide lo mismo que el resto de ítems del test?. Discriminación. Homogeneidad. Dificultad. Un test pretende decidir si una persona posee la cualificación necesaria para ejercer una profesión. ¿Qué función cumple?. Certificación. Diagnóstico. Selección. ¿Qué sesgo aparece cuando una persona responde lo socialmente aceptado en lugar de lo que realmente piensa?. Aquiescencia. Deseabilidad social. Indecisión. ¿Cuál es una recomendación general para redactar ítems?. Utilizar dobles negaciones. Expresar varias ideas en un mismo enunciado. Evitar la ambigüedad. En un ítem de elección múltiple: Los distractores deben ser plausibles. La respuesta correcta debe aparecer siempre en la misma posición. Debe utilizarse "Todas las anteriores". Un test contiene ítems positivos y negativos en proporciones similares. ¿Qué sesgo intenta controlarse?. Deseabilidad social. Aquiescencia. Indecisión. ¿Qué técnica aparece en el tema como la más utilizada para estudiar la estructura interna?. Análisis factorial. Kappa de Cohen. V de Aiken. Dos pruebas que miden el mismo constructo correlacionan fuertemente. ¿Qué evidencia aportan?. Validez discriminante. Validez convergente. Validez aparente. Dos pruebas que miden constructos distintos presentan correlaciones muy bajas. ¿Qué evidencia aportan?. Validez discriminante. Validez convergente. Evidencias de contenido. Según la TRI, las propiedades de los ítems: Dependen totalmente de la muestra. Intentan ser independientes de la muestra. Solo pueden calcularse en test de personalidad. En el protocolo de Osterlind los jueces utilizan una escala: 1 a 5. 0 a 10. -1, 0 y 1. ¿Qué característica tiene el protocolo de Dunn?. Emparejamiento ciego. Emparejamiento no ciego. Utiliza Kappa. La claridad de los ítems se resume mediante: La media. La mediana. La desviación típica. Un ítem obtiene una V de Aiken de 0,80 en su dimensión teórica. ¿Qué puede decirse?. Supera el criterio habitual de aceptación. Debe eliminarse. Tiene baja congruencia. ¿Qué índice se utiliza para estudiar el acuerdo entre jueces por encima del esperado por azar?. V de Aiken. W de Kendall. Kappa de Cohen. Un investigador obtiene una W de Kendall de 0,90. ¿Qué indica?. Alta concordancia entre jueces. Baja claridad. Mala validez de contenido. La Psicometría se ocupa principalmente de: Diagnosticar trastornos psicológicos. Desarrollar teorías de personalidad. Medir variables psicológicas. La función descriptiva de la medición permite: Relacionar variables mediante ecuaciones. Describir variables psicológicas de forma precisa. Eliminar el error de medida. La función predictiva de la medición consiste en: Describir la realidad psicológica. Relacionar variables de forma precisa. Construir escalas de medida. ¿Qué requisito debe cumplirse para que una medición tenga validez según el principio de isomorfismo?. Todos los participantes deben responder igual. Debe existir correspondencia entre el fenómeno y los números asignados. Todos los ítems deben tener la misma dificultad. Los constructos psicológicos se caracterizan porque: Son directamente observables. Son abstracciones evaluadas indirectamente. Son siempre variables fisiológicas. ¿Cuál de los siguientes sería un constructo psicológico?. Altura. Peso. Ansiedad. Uno de los problemas de la medición psicológica es que: No existe una única aproximación universalmente aceptada. Los constructos son observables directamente. No existe error de medida. Cuando medimos un constructo psicológico: Nunca aparecen errores. Siempre existe cierta cantidad de error. Solo aparecen errores en la TRI. Los tests están basados en: Todas las conductas posibles del dominio. Una muestra limitada de conductas. Una única conducta representativa. La indeterminación de la medida hace referencia a que: No existen unidades y orígenes perfectamente definidos como en Física. Los constructos son observables. Todos los ítems tienen distinta dificultad. Según la Teoría Clásica de los Tests: X = V + e. V = X + e. X = V × e. En la TCT, la puntuación observada está formada por: Puntuación verdadera y error. Solo puntuación verdadera. Solo error. La Teoría de la Generalizabilidad fue desarrollada principalmente por: Binet. Cronbach. Spearman. La TRI se caracteriza porque intenta: Que los parámetros dependan de la muestra. Que los parámetros sean independientes de la muestra. Eliminar la puntuación verdadera. ¿Qué instrumento suele utilizarse para medir variables cognitivas?. Escala. Inventario. Test. Las escalas suelen utilizarse principalmente para medir: Variables no cognitivas. Variables fisiológicas. Variables académicas exclusivamente. Un inventario suele caracterizarse por: Agrupar varios tests o conjuntos de medidas. Medir exclusivamente inteligencia. Medir exclusivamente personalidad. Cuando se mide inteligencia a través de respuestas a tareas, la inteligencia actúa como: Conducta observable. Variable latente o constructo. Error de medida. ¿Qué paso debe realizarse antes de construir una escala de medida?. Obtener conclusiones matemáticas. Definir operacionalmente qué se quiere medir. Corregir el sesgo por azar. ¿Cuál de las siguientes afirmaciones es correcta?. Los constructos pueden definirse de forma aislada sin relacionarlos con otros. Los constructos deben relacionarse con otros constructos y conductas observables. Los constructos son directamente observables. La medición psicológica consiste en: Asignar números al azar a las personas. Asignar números siguiendo reglas a atributos psicológicos. Comparar únicamente conductas observables. ¿Qué condición debe cumplir una definición operacional?. Debe permitir obtener indicadores empíricos para medir el constructo. Debe ser exclusivamente teórica. Debe evitar toda referencia a conductas. Cuando medimos un constructo, las conductas observables actúan como: Indicadores empíricos. Errores de medida. Variables irrelevantes. ¿Cuál de los siguientes NO es un elemento necesario para la medición?. Sistema de números. Interpretación de datos. Diagnóstico clínico. Según el principio de isomorfismo: Las propiedades de los números deben corresponderse con las del fenómeno medido. Todos los sujetos deben obtener puntuaciones diferentes. Todos los tests deben tener la misma longitud. Un investigador afirma que la inteligencia no puede observarse directamente pero sí inferirse a partir de conductas. Esta afirmación hace referencia a: Variables latentes. Variables manipuladas. Variables independientes. ¿Qué problema de la medición psicológica aparece cuando un test solo recoge una pequeña parte de las conductas posibles del constructo?. Error aleatorio. Muestreo limitado de conductas. Isomorfismo. Cuando dos personas obtienen puntuaciones distintas en un test, la diferencia puede deberse: Exclusivamente a diferencias reales. Exclusivamente al error. A diferencias reales y/o al error de medida. La Teoría Clásica de los Tests considera que: Toda puntuación observada contiene error. El error es siempre cero. Solo existe puntuación verdadera. ¿Qué teoría intenta superar algunas limitaciones de la TCT permitiendo mayor generalización de los resultados?. TRI. Teoría de la Generalizabilidad. Psicofísica. En la TRI, un objetivo fundamental es que: Los parámetros del ítem dependan del grupo utilizado. Los parámetros del ítem sean relativamente independientes de la muestra. Todos los ítems tengan la misma dificultad. ¿Cuál es la principal diferencia entre una variable observable y un constructo?. Ninguna. El constructo no puede observarse directamente. La variable observable siempre es psicológica. Si un test de ansiedad produce resultados distintos porque los participantes estaban cansados ese día, estamos ante: Error de medida. Isomorfismo. Variable latente. ¿Por qué los constructos no pueden definirse de forma aislada?. Porque deben relacionarse con otros constructos y conductas observables. Porque dependen exclusivamente de variables biológicas. Porque no pueden medirse. ¿Qué afirmación describe mejor la finalidad de la Psicometría?. Crear teorías psicológicas. Desarrollar procedimientos para medir variables psicológicas. Diagnosticar trastornos mentales. La principal diferencia entre un test y una escala es que: El test mide variables no cognitivas. El test suele tener respuestas correctas e incorrectas. La escala siempre tiene más ítems. Los cuestionarios se caracterizan porque: Miden exclusivamente personalidad. Sus ítems no tienen por qué estar relacionados entre sí. Siempre contienen respuestas correctas. Los inventarios se utilizan principalmente para medir: Conocimientos. Aptitudes. Personalidad. Cuando se diseña un test, la pregunta "¿a quién medir?" hace referencia a: Utilización prevista. Población objetivo. Variable objeto de estudio. La pregunta "¿qué medir?" hace referencia a: Variable objeto de estudio. Población objetivo. Tipo de corrección. La utilización prevista de un test hace referencia a: Cómo se corregirá. Para qué se utilizará. Cuántos ítems tendrá. Seleccionar candidatos para un puesto de trabajo corresponde a: Diagnóstico. Certificación. Selección. Detectar dificultades de aprendizaje corresponde a: Diagnóstico. Orientación. Certificación. Acreditar oficialmente una competencia profesional corresponde a: Selección. Certificación. Descripción. Asignar estudiantes a distintos grupos según su nivel corresponde a: Clasificación. Diagnóstico. Selección. La tabla de especificaciones sirve para: Corregir los ítems. Planificar la construcción del test. Calcular la fiabilidad. En una tabla de especificaciones, las columnas suelen representar: Procesos. Áreas de contenido. Participantes. En una tabla de especificaciones, las filas suelen representar: Procesos. Contenidos. Ítems. La finalidad principal de la tabla de especificaciones es: Garantizar representatividad del contenido. Calcular el ID. Calcular la discriminación. Los ítems verdadero-falso pertenecen a: Construcción. Selección. Escalas. Los ítems de elección múltiple pertenecen a: Selección. Construcción. Listados. Los distractores son: Alternativas correctas. Alternativas incorrectas. Ítems eliminados. Un buen distractor debe ser: Fácilmente descartable. Plausible. Ridículo. ¿Cuál debe evitarse en elección múltiple?. Distractores plausibles. Aleatorizar la respuesta correcta. "Todas las anteriores". Los ítems de emparejamiento pertenecen a: Construcción. Selección. Escalas. El formato Cloze consiste en: Elegir una respuesta entre varias. Completar espacios en blanco. Emparejar columnas. Los ítems de respuesta corta pertenecen a: Construcción. Selección. Escalas. En un ítem de respuesta corta: Deben existir varias respuestas correctas. Debe existir una única respuesta correcta. No importa la precisión. En los ítems de ensayo: Puede dejarse elegir libremente qué pregunta responder. Debe decidirse previamente el sistema de corrección. No importa la precisión. En los ítems de ensayo: Puede dejarse elegir libremente qué pregunta responder. Debe decidirse previamente el sistema de corrección. No se necesita criterio de evaluación. Una recomendación general de redacción es: Incluir varias ideas en el mismo ítem. Utilizar dobles negaciones. Evitar la ambigüedad. ¿Qué debe evitarse en la redacción?. Enunciados claros. Dobles preguntas. Lenguaje sencillo. La tendencia a responder siempre de acuerdo o siempre en desacuerdo se denomina: Deseabilidad social. Aquiescencia. Indecisión. Responder lo socialmente aceptado corresponde a: Deseabilidad social. Respuesta extrema. Aquiescencia. Seleccionar sistemáticamente la categoría central corresponde a: Aquiescencia. Respuesta extrema. Indecisión. Elegir habitualmente las categorías más extremas corresponde a: Indecisión. Deseabilidad social. Respuesta extrema. Un ítem con ID = 0.85 se considera: Difícil. Fácil. De discriminación media. índice de dificultad representa: La probabilidad de responder correctamente. La homogeneidad del ítem. La capacidad de discriminar. En un test de personalidad: Tiene sentido hablar de ID. No tiene sentido hablar de ID. Todos los ítems tienen ID=0.50. Un ítem con ID = 0.10 se considera: Muy fácil. Muy homogéneo. Muy difícil. Los ítems más discriminativos suelen ser: Los de dificultad media. Los más fáciles. Los más difíciles. Un ítem con alto IH indica que: Mide lo mismo que el resto de ítems. Tiene alta dificultad. Tiene alta probabilidad de acierto. La capacidad de diferenciar entre sujetos con distinto nivel de aptitud recibe el nombre de: Homogeneidad. Discriminación. Dificultad. En los test de velocidad: Los ítems suelen ser fáciles. Los ítems suelen ser muy difíciles. No existe límite temporal. En los test de ejecución máxima o potencia: Todos los ítems tienen la misma dificultad. Los ítems van de fáciles a difíciles. Todos los ítems son difíciles. En los test de velocidad, la dificultad principal reside en: El tiempo disponible. Los contenidos. La complejidad de los ítems. Una respuesta sesgada es aquella que: Refleja exactamente la opinión del sujeto. Tiene más probabilidad de ser elegida independientemente de la opinión real. Es siempre incorrecta. La aquiescencia consiste en: Responder de forma socialmente aceptada. Elegir siempre categorías extremas. Tender a estar de acuerdo o en desacuerdo sistemáticamente. La deseabilidad social consiste en: Responder lo socialmente aceptado. Elegir siempre el punto medio. Elegir los extremos. La tendencia a elegir la categoría neutral se denomina: Respuesta extrema. Indecisión. Aquiescencia. La respuesta extrema consiste en: Elegir categorías extremas independientemente del contenido. Elegir categorías centrales. Responder al azar. Una recomendación general para redactar ítems es: Utilizar varias ideas en un mismo enunciado. Evitar la ambigüedad. Utilizar dobles negaciones. ¿Qué debe evitarse en un ítem?. Dobles preguntas. Enunciados claros. Lenguaje sencillo. En ítems verdadero-falso se recomienda: Utilizar "siempre" y "nunca". Evitar términos que sugieran la respuesta. Colocar siempre la respuesta verdadera en la misma posición. En elección múltiple, los distractores deben ser: Plausibles. Evidentemente falsos. Muy diferentes entre sí. ¿Qué opción suele recomendarse evitar?. Aleatorizar la correcta. Ninguna de las anteriores. Distractores plausibles. Tras la revisión crítica de expertos, los ítems aprobados constituyen: La versión definitiva. La prueba piloto. El baremo. Una tarea típica del grupo de expertos es: Revisar la claridad de los ítems. Corregir exámenes. Calcular percentiles. La corrección por azar intenta compensar: El efecto de las omisiones. El efecto de acertar por suerte. El error tipográfico. El acierto por azar provoca: Sobreestimación del nivel real. Infraestimación del nivel real. Ningún efecto. Un alumno responde 30 preguntas de 3 alternativas. Acuerda 24 y falla 6. Corrigiendo por azar obtiene: 21. 24. 27. La longitud de un test puede depender de: La población objetivo. El color del cuadernillo. El sexo del investigador. Los ítems de ensayo pertenecen a: Construcción. Selección. Emparejamiento. En un ensayo múltiple: Debe decidirse previamente el sistema de evaluación. No hace falta sistema de corrección. El alumno debe elegir qué preguntas responder. ¿Cuál de estas afirmaciones es correcta?. Los test de personalidad suelen utilizar ítems con distintos niveles de dificultad. En ejecución típica no tiene sentido hablar de dificultad. En velocidad los ítems deben ser difíciles. La evidencia de contenido pretende comprobar: La fiabilidad del test. La pertinencia de los contenidos del test. La rapidez de respuesta. La definición del constructo debe ser: Operativa. Ambigua. Exclusivamente teórica. La correcta representación del constructo en el test hace referencia a: Que los ítems representen todos los aspectos a medir. Que el test tenga muchos ítems. Que los ítems sean difíciles. La consulta a expertos se utiliza principalmente para obtener evidencias de: Contenido. Fiabilidad. Velocidad. La validez aparente hace referencia a: Cómo perciben el test quienes lo responden. La estructura factorial. La discriminación de los ítems. Las inferencias realizadas a partir de las puntuaciones serán mejores cuando: Se conozcan mejor los procesos de respuesta. El test tenga menos ítems. Existan más errores de medida. La validación profunda se consigue cuando: Solo se analizan las puntuaciones. Se integran puntuaciones y procesos de respuesta. Solo se estudia la dificultad. La evidencia basada en la estructura interna evalúa: Si el test constituye un constructo coherente. La apariencia del test. El tiempo de aplicación. La técnica más utilizada para estudiar la estructura interna es: Correlación de Pearson. Análisis factorial. t de Student. El análisis de la dimensionalidad forma parte de: La estructura interna. Los procesos de respuesta. La validez aparente. El DIF (Funcionamiento Diferencial de los Ítems) aporta información sobre. Cómo se comportan los ítems en distintos grupos. La longitud del test. La deseabilidad social. La matriz multitrasgo-multimétodo fue propuesta por: Cronbach. Campbell y Fiske. Spearman. Si dos pruebas miden el mismo constructo mediante métodos distintos, deberían presentar. Validez convergente. Validez discriminante. DIF. La validez discriminante implica que: Constructos distintos deben diferenciarse entre sí. Todos los constructos deben correlacionar mucho. Los métodos deben ser idénticos. En una matriz multitrasgo-multimétodo, las correlaciones entre rasgos distintos deberían ser: Mayores. Menores. Iguales. Se desea hacer un examen de psicoestadística con 50 ítems. Si el área de contenido "contraste de hipótesis" tiene una ponderación del 40%, y de cuatro procesos, el "análisis de datos" tiene una ponderación del 35%, ¿cuántos ítems habrá que hacer para esta situación?. 15. 20. 7. Se desea hacer un examen de psicometría con 40 items. Si el área de contenido fiabilidad tiene una ponderación del 40%, y de cuatro procesos, el "análisis" tiene una ponderación del 25%, ¿cuántos ítems habrá que hacer para esta situación?. 16. 4. 10. Un estudiante ha realizado un examen de psicometría de 50 preguntas tipo test, de las cuales 10 son verdadero-falso; 30 tienen 3 opciones de respuesta y otras 10 tienen 4 opciones de respuesta. El estudiante ha contestado las 50 preguntas, de las cuales, ha acertado 7 verdadero-falso, 25 de las 3 opciones y 5 de las 4 opciones de respuesta. Calcular la puntuación corrigiendo el sesgo por azar obtenida por el estudiante: 29.84 sobre 50 puntos. 5.97 sobre 50 puntos. 37 sobre 50 puntos. Los instrumentos de medición psicológica se diferencian entre: Los tests que se utilizan para medir variables cognitivas, las escalas para no cognitivas y los inventarios para agrupación de varios tests. Los tests que se utilizan para medir variables cognitivas, las escalas para no cognitivas y los inventarios para personalidad. Los tests que se utilizan para medir variables no cognitivas, las escalas para cognitivas, y los inventarios para agrupación de varios tests. Los test se caracterizan por: No tener respuestas correctas o incorrectas. Ser utilizados para medir aptitudes, conocimientos o rendimiento. Ser utilizados para medir variables no cognitivas. Los ítems de selección se caracterizan, entre otras cosas, por ser: Ítems de respuesta cerrada. Apropiados para test que miden variables cognitivas pero no para los que miden variables afectivas. Ítems de respuesta abierta. En los ítems de elección múltiple, las alternativas incorrectas también se conocen como: Distractores. Disuasores. Alternativas alternantes. Las escalas se caracterizan por: No tener respuestas correctas o incorrectas. Ser utilizados para medir variables cognitivas. Ser utilizados para medir aptitudes, conocimientos o rendimiento. Señale la respuesta correcta: La AERA estableció una categorización jerárquica de las áreas de contenido de la psicometría. La versión piloto de test debe contar con un número similar de ítems a los que deberá tener la versión definitiva. Para asegurar la validez de contenido de un test hay que representar todas las áreas de contenido. Para medir variables psicológicas es necesario: Utilizar un cuestionario. Que los ítems representen las conductas observables o indicadores. Que los ítems representen los constructos. Los inventarios se caracterizan por: Ser utilizados para medir variables de personalidad. Tener respuestas correctas o incorrectas. Ser utilizados para medir variables cognitivas. Un instrumento de medida con función diagnóstica se utiliza para: Detectar las capacidades e intereses de los sujetos para elegir la opción que mejor se adecue a su perfil, en cualquier tipo de ámbito. Acreditar la cualificación o competencia para el desarrollo de su profesión. Detectar problemas comportamentales, de aprendizaje, etc., independientemente del ámbito. Los cuestionarios se caracterizan por: La puntuación total es la suma de las puntuaciones asignadas a las categorías elegidas. La puntuación total es la suma de las respuestas correctas. Las opciones de respuestas no están ordenadas ni graduadas. Señale la respuesta correcta: Los test de ejecución típica miden variables de tipo no cognitivo. Los test de ejecución máxima o potencia miden variables de tipo cognitivo. Ambas respuestas son correctas. La estrategia utilizada para especificar el contenido en los test de rendimiento es: En una tabla de doble entrada representar en las filas las áreas de contenido de la asignatura y en las columnas los procesos implicados en la resolución de problemas. En una tabla de doble entrada representar en las columnas las áreas de contenido de la asignatura y en las filas los procesos implicados en la resolución de problemas. En una tabla de doble entrada representar en las columnas la fiabilidad de las puntuaciones del test y en las filas la validez de contenido del test. Un constructo se define como: Variable psicológica que no se pueden manifestar mediante conductas. Variable no psicológica inobservable directamente. Variable psicológica inobservable directamente. La definición clara y precisa del constructo, permitirá: Incluir todas la áreas relevantes de la conducta. Determinar la longitud del test. Conocer las características de la población objetivo. El formato de respuesta de los ítems en los test de ejecución máxima o potencia pueden ser: Elección múltiple y listados. Dos alternativas y escala de clasificación. Emparejamiento y formato cloze. Los ítems de respuesta corta son: Ítems de elección y respuesta cerrada. Ítems de construcción y respuesta abierta. Ítems de construcción y respuesta cerrada. Señale la respuesta correcta: En los test de ejecución máxima o potencia los ítems deben ser de dificultad baja. En los test de velocidad los ítems deben tener un índice de dificultad similar. En los test de ejecución típica los ítems pueden ser de diferentes dificultades. Los procedimientos de corrección de los aciertos por azar son: Penalizar los errores y bonificar las omisiones. Penalizar las omisiones y bonificar los errores. Penalizar los errores y Bonificar los aciertos. Uno de los factores que determina la longitud de un test es: La población objetivo. El nivel de dificultad de los ítems. El tipo de variable psicológica que mida. El fenómeno de la deseabilidad social consiste en: La tendencia a seleccionar la alternativa central o neutra. La tendencia a responder sistemáticamente que se está de acuerdo o en desacuerdo con el enunciado del ítem. La tendencia a responder a un ítem de una manera aceptada por la mayoría. Señale la respuesta correcta sobre el nivel de dificultad (ID) de los ítem en los test de ejecución máxima o potencia: Los ítems serán de diferentes ID, desde muy fáciles (al principio) hasta muy difíciles (al final). Los ítems tendrán el mismo ID, en torno a 0.50. Los ítems serán de diferentes ID, desde muy fáciles (al principio y al final) hasta muy difíciles (en el medio). Algunas de las tareas del grupo de expertos son: Comprobar que los distractores seleccionados son adecuados. Comprobar que los ítems estás redactados de forma clara. Ambas son correctas. Una vez finalizado la revisión crítica por parte del grupo de expertos, los ítems que hayan pasado la prueba: Constituirán la versión definitiva. Constituirán un banco de ítems por si son necesarios ser utilizados en la versión definitiva. Constituirán la prueba piloto. Un estudiante ha realizado un examen de psicometría de 50 preguntas tipo test con 3 opciones de respuesta en la que solo una es correcta. Si ha respondido correctamente 42 preguntas e incorrectamente 8 preguntas, calcular la puntuación corrigiendo el sesgo por azar obtenida por el estudiante. 34. 38. 42. Las respuestas sesgadas son más frecuentes en: Test de ejecución máxima o potencia. Test de ejecución típica. En ambos tipos de test son igualmente frecuentes. Una recomendación común para la redacción de ítems de dos alternativas y elección múltiple es: Evitar en el enunciado o en las alternativas de respuesta el uso de determinantes específicos como todo, nada, nunca, siempre. Que los ítems contenga términos técnicos sobre el constructo. Hacer que los distractores no parezcan igualmente atractivos. Un ítem con un alto índice de homogeneidad indica: Que es capaz de diferenciar entre sujetos diferentes niveles de conocimiento. Que mide lo mismo que el resto de ítems que conforman el test. Que es muy importante en un test de ejecución máxima o potencia. Señale la respuesta correcta respecto a la corrección de la prueba piloto y asignación de las puntuaciones a los sujetos: En las pruebas cognitivas hay que preestablecer a qué extremo del continuo se le va a asignar el valor numérico más alto, y que esta regla de asignación se aplique a todos los ítems. En las pruebas cognitivas un inconveniente grave es el acierto por azar, lo que provoca una infraestimación de su verdadero nivel en el rasgo que se está midiendo. En las pruebas cognitivas un inconveniente grave es el acierto por azar, lo que provoca una sobreestimación de su verdadero nivel en el rasgo que se está midiendo. Señale la respuesta correcta: Un ítem con un ID = 0.50 es muy apropiado para un test de ejecución típica. Un ítem con un ID = 0.15 se considera muy fácil. Un ítem con un ID = 0.15 se considera muy difícil. La capacidad de un ítem de diferenciar entre sujetos con diferente nivel de aptitud, se denomina: Poder discriminativo. Probabilidad de acertar por azar. Dificultad. |





