Aunque el estudio no requirió una aprobación ética formal por parte de un comité de revisión institucional debido a su diseño de encuesta anónima y no experimental, que no implicó intervenciones físicas, manipulaciones ni engaño a los participantes, todos los procedimientos se llevaron a cabo de acuerdo con los principios éticos de la Declaración de Helsinki y las directrices de la Asociación Americana de Psicología para la investigación con participantes humanos. Se obtuvo el consentimiento informado de todos los participantes antes de la recolección de datos. La institución no requirió ni emitió una aprobación ética formal ni una exención para este tipo de estudio. A todos los encuestados se les informó explícitamente sobre el propósito de la investigación, la participación voluntaria, su derecho a retirarse en cualquier momento sin consecuencias y las estrictas medidas de confidencialidad aplicadas a sus datos. No se recopiló ni reportó ninguna información personalmente identificable, y todos los datos se utilizaron exclusivamente para análisis académico agregado. Se prestó especial atención al uso de un lenguaje respetuoso y no intrusivo para garantizar que la encuesta no interfiriera con las actividades académicas ni con el bienestar psicológico de los participantes. Para consultar el formulario de consentimiento informado, véase Archivo Suplementario 1. Además, los materiales utilizados en este estudio se enumeran en la Tabla de Materiales.
Diseño de la investigación
Esta sección describe el diseño de la investigación, los procedimientos de recopilación de datos y los detalles de la muestra utilizados en el estudio para investigar las relaciones entre el estilo de enseñanza, el uso de ChatGPT, la alfabetización digital, la motivación, la ansiedad y la creatividad entre estudiantes de inglés como lengua extranjera (EFL). Este estudio empleó un diseño de investigación cuantitativo y transversal para examinar el papel mediador de la motivación en las relaciones entre el estilo de enseñanza, el uso de ChatGPT, la alfabetización digital y la ansiedad entre estudiantes EFL, y cómo estas variables se relacionan colectivamente con la creatividad. Se adoptó una metodología de encuesta estructurada para recopilar datos primarios, asegurando la estandarización y la fiabilidad en la medición de los constructos. El estudio utilizó escalas validadas para evaluar todas las variables, incluyendo el estilo de enseñanza, el uso de ChatGPT, la alfabetización digital, la motivación, la ansiedad en el aprendizaje de lenguas extranjeras (FLCA) y la creatividad.
Datos y muestra
Los datos para este estudio se recopilaron de estudiantes de inglés como lengua extranjera (EFL) inscritos en la Universidad de Yeda, una universidad del sector público en Arabia Saudita reconocida por su énfasis en la enseñanza de idiomas y la integración de la tecnología en la docencia. Los participantes fueron seleccionados mediante una técnica de muestreo intencional, considerada apropiada para este estudio dada la necesidad específica de que los participantes tuvieran experiencia activa con herramientas de inteligencia artificial, como ChatGPT, en su entorno de aprendizaje. Este enfoque de muestreo no probabilístico fue necesario porque las preguntas de investigación del estudio se centraron en una población específica: estudiantes de inglés como lengua extranjera que habían estado expuestos tanto a métodos tradicionales como a métodos de aprendizaje asistidos por tecnología, y el muestreo aleatorio no habría garantizado la inclusión de participantes que cumplieran con estos criterios. Aunque el muestreo intencional limita la generalización de los hallazgos a la población más amplia, se justificó para esta investigación exploratoria con el fin de asegurar que los participantes poseyeran las experiencias y perspectivas relevantes necesarias para abordar los objetivos de la investigación. Para mitigar las limitaciones del muestreo intencional, se hicieron esfuerzos por incluir participantes con diversos antecedentes académicos y distintos niveles de competencia tecnológica, mejorando así la representatividad de la muestra dentro de la población objetivo. La muestra final constó de 280 estudiantes universitarios de inglés como lengua extranjera, una cantidad considerada adecuada para las técnicas estadísticas empleadas.
La determinación de la adecuación del tamaño de la muestra se basó en pautas establecidas para el Modelado de Ecuaciones Estructurales (SEM). Los investigadores recomiendan una proporción mínima de 10 casos por parámetro estimado para SEM, con pautas más conservadoras que sugieren 20 casos por parámetro para el SEM de Mínimos Cuadrados Parciales (PLS-SEM). El modelo de medición constaba de 29 ítems para la alfabetización digital, 25 ítems para el estilo de enseñanza y 32 ítems para la FLCA, junto con ítems adicionales para el uso de ChatGPT, la motivación y la creatividad. Las pautas de PLS-SEM también recomiendan un tamaño mínimo de muestra igual a 10 veces el mayor número de indicadores formativos o el mayor número de rutas estructurales dirigidas a un constructo particular; por lo tanto, la muestra de 280 participantes superó estos requisitos mínimos. Además, un análisis de potencia a posteriori realizado con G*Power53 indicó que una muestra de 280 participantes proporcionaba una potencia estadística superior a 0,95 para detectar tamaños de efecto medios (f2 = 0,15) con α = 0,05, superando el umbral comúnmente recomendado de 0,80. Este tamaño de muestra proporciona estimaciones de parámetros confiables y potencia estadística suficiente para detectar relaciones significativas entre las variables del estudio, al tiempo que acomoda la complejidad de los modelos de medición y estructurales propuestos.
Participantes y procedimiento
Los participantes fueron estudiantes de inglés como lengua extranjera (EFL) de entre 18 y 25 años de edad, siendo la mayoría estudiantes universitarios de primer y segundo año inscritos en cursos de inglés. La encuesta se realizó entre septiembre y octubre de 2025, período durante el cual se invitó a los estudiantes a participar de forma voluntaria. El proceso de reclutamiento incluyó difusión a través de canales oficiales universitarios, como correos electrónicos y anuncios en clases. Los participantes eran estudiantes de EFL de 18 a 25 años inscritos como estudiantes universitarios de primer o segundo año en cursos de lengua inglesa. La elegibilidad se determinó mediante criterios predefinidos de inclusión y exclusión. Los participantes cumplían con los requisitos si (a) estaban inscritos oficialmente en cursos universitarios de inglés en la Universidad de Jeddah, (b) tenían entre 18 y 25 años, y (c) estaban registrados como estudiantes de primer o segundo año. Se excluyeron a los estudiantes si (a) eran estudiantes de posgrado o estudiantes universitarios avanzados ajenos a la secuencia de cursos básicos, (b) estaban fuera del rango de edad especificado, o (c) participaron en la fase de preprueba del cuestionario. Para garantizar el consentimiento informado, se informó a los participantes sobre el propósito del estudio, la naturaleza voluntaria de su participación y la confidencialidad de sus respuestas. El instrumento de recolección de datos fue un cuestionario estructurado y autoadministrado, distribuido de forma física y electrónica mediante una plataforma en línea segura. Se adaptaron escalas validadas para medir el estilo docente, el uso de ChatGPT, la alfabetización digital, la motivación de los estudiantes, la ansiedad en el aprendizaje de lenguas extranjeras (FLCA) y la creatividad. Se pidió a los participantes que calificaran sus respuestas en una escala tipo Likert de 5 puntos, que iba desde 1 (Totalmente en desacuerdo) hasta 5 (Totalmente de acuerdo). Se realizó una preprueba del cuestionario con un grupo pequeño de 30 estudiantes para asegurar claridad y fiabilidad. Con base en los resultados de la preprueba, se realizaron ajustes menores en el redacción para mejorar la comprensibilidad de los ítems, y no se identificaron problemas significativos en cuanto a la fiabilidad o validez de las escalas. Para mantener la integridad de los datos y fomentar respuestas honestas, se garantizó el anonimato, y se aseguró a los participantes que sus datos solo se utilizarían con fines de investigación. De las 300 respuestas iniciales recopiladas, 280 se consideraron válidas tras revisar datos incompletos o inconsistentes, lo que arrojó una tasa de retención del 93 %. Los procedimientos de revisión de datos incluyeron el análisis de patrones de respuesta para detectar respuestas lineales, datos faltantes excesivos (más del 10 %) y valores atípicos multivariados mediante la distancia de Mahalanobis. Este enfoque metodológico proporciona una base sólida para analizar las relaciones entre las variables del estudio y ofrece información valiosa sobre el papel del estilo docente, las herramientas de inteligencia artificial y la alfabetización digital en la motivación, la ansiedad y la creatividad de los estudiantes de EFL.
Tras la recopilación de datos, se excluyeron 20 respuestas del grupo inicial de 300 según criterios predefinidos: se eliminaron 12 respuestas debido a datos faltantes excesivos que superaban el 10 % de los ítems del cuestionario, otras 5 fueron descartadas por presentar patrones de respuesta lineales (respuestas uniformes en todos los ítems, lo que indica falta de participación) y 3 se identificaron como valores atípicos multivariados mediante la distancia de Mahalanobis (p < 0,001), eliminándose posteriormente para evitar distorsionar los resultados del modelo de ecuaciones estructurales (SEM). Los valores faltantes en los casos conservados se abordaron mediante imputación por la media cuando los datos ausentes eran mínimos (menos del 5 % por caso), ya que este enfoque es aceptable para pequeñas proporciones de datos faltantes en investigaciones mediante encuestas a gran escala. La tasa final de conservación del 93 % (280 respuestas válidas de 300 cuestionarios recopilados) representa la proporción de respuestas utilizables conservadas del total de cuestionarios recopilados; sin embargo, esto no debe interpretarse como una tasa real de respuesta, ya que no fue posible calcular el número exacto de participantes invitados debido a que la combinación de métodos de distribución física y electrónica a través de canales oficiales universitarios impidió un seguimiento preciso del número total de invitaciones. Esta limitación se reconoce, y por ello la cifra del 93 % se informa como la proporción de respuestas válidas conservadas de los cuestionarios recopilados, y no como una tasa de respuesta respecto a la población total invitada.
Herramientas y medidas
Este estudio utilizó escalas bien establecidas y validadas, cuidadosamente adaptadas al contexto de la enseñanza de inglés como lengua extranjera (EFL), para medir los constructos principales: estilo de enseñanza, alfabetización digital, uso de ChatGPT, ansiedad ante la clase de lengua extranjera (FLCA), motivación y creatividad. Cada escala se seleccionó en función de su pertinencia y exhaustividad para captar las dimensiones respectivas de las variables bajo investigación. La alfabetización digital se midió mediante una escala adaptada basada en Rodríguez-de-Dios et al.54, compuesta por seis dimensiones con 29 ítems. Estas dimensiones incluyeron Habilidad Tecnológica, Habilidad en Seguridad Personal, Habilidad Crítica, Habilidad en Seguridad de Dispositivos, Habilidad Informacional y Habilidad Comunicativa, lo que permitió una evaluación integral de la competencia de los estudiantes en habilidades digitales esenciales para contextos educativos modernos. El uso de ChatGPT se evaluó mediante una escala de 8 ítems adaptada de Abbas et al.55, centrada en la interacción de los estudiantes con la herramienta de inteligencia artificial para tareas de aprendizaje del idioma. El estilo de enseñanza se evaluó mediante una versión adaptada del Inventario de Estilos de Enseñanza de Grasha56. Este instrumento mide cinco dimensiones de los estilos de enseñanza: Autoridad, Experto, Modelo Personal, Facilitador y Delegador. Estas dimensiones reflejan diversos enfoques instruccionales que influyen en las experiencias de aprendizaje de los estudiantes de EFL. La FLCA se midió mediante una escala adaptada basada en Briesmaster y Briesmaster57. Este instrumento examinó la ansiedad en tres dimensiones: Aprehensión Comunicativa (10 ítems), Ansiedad ante Exámenes (10 ítems) y Miedo a la Evaluación Negativa (7 ítems). La motivación de los estudiantes se evaluó mediante una escala adaptada de Kanoksilapatham et al.58, que mide tres dimensiones: Promoción e Inhibición Instrumental, Etnocentrismo e Integración, y Actitud hacia el Aprendizaje del Inglés. La escala incluyó un total de 20 ítems. La creatividad de los estudiantes de EFL se midió mediante una escala adaptada de Govindasamy et al.59, que evaluó cuatro dimensiones: Originalidad, Flexibilidad, Fluidez y Elaboración. Cada dimensión se midió mediante tres ítems. Para garantizar la adecuación cultural y contextual de los instrumentos al entorno de EFL, se aplicó un procedimiento sistemático de adaptación. Dado que las escalas originales fueron desarrolladas en inglés, dos expertos bilingües en EFL revisaron y simplificaron el lenguaje para mejorar la claridad para estudiantes universitarios de nivel intermedio, preservando al mismo tiempo el significado original de cada constructo. Las versiones adaptadas se retrotradujeron luego al idioma materno de los participantes por un traductor independiente para verificar la equivalencia lingüística y conceptual, y cualquier discrepancia se resolvió mediante discusión entre el equipo de investigación. Posteriormente, tres instructores experimentados en EFL evaluaron los instrumentos adaptados en cuanto a relevancia del contenido, adecuación cultural y claridad de los ítems, lo que resultó en pequeñas revisiones de redacción y en la sustitución de ejemplos culturalmente poco familiares cuando fue apropiado. Finalmente, los instrumentos revisados se probaron con 30 estudiantes (véase la sección de Procedimiento), y los comentarios de los participantes se utilizaron para realizar ajustes adicionales menores en la redacción con el fin de mejorar la comprensibilidad. Este proceso de múltiples pasos aseguró que los instrumentos adaptados mantuvieran sus propiedades psicométricas originales al tiempo que resultaran apropiados para la población objetivo de EFL. Para consultar el cuestionario adaptado completo, véase Supplementary File 2.
Métodos de análisis de datos
Los datos recopilados para este estudio se analizaron utilizando el Paquete Estadístico para las Ciencias Sociales (SPSS 26) y SmartPLS 4, empleando PLS-SEM. Este enfoque de doble método garantizó un análisis exhaustivo de los datos, abordando tanto los aspectos descriptivos como inferenciales, al tiempo que se evaluaban las relaciones hipotetizadas y los efectos de mediación en el modelo de investigación. Inicialmente, se utilizó SPSS para realizar un análisis preliminar de los datos, que incluyó la limpieza de datos, estadísticas descriptivas y pruebas de fiabilidad. El examen de los datos implicó verificar valores perdidos, valores atípicos y normalidad para asegurar la calidad e integridad del conjunto de datos. Se calcularon estadísticas descriptivas, incluyendo la media, la desviación estándar y las distribuciones de frecuencia, para resumir las características de la muestra. El análisis principal se realizó utilizando SmartPLS 4. Se seleccionó PLS-SEM debido a su adecuación para analizar modelos complejos con múltiples constructos y su robustez en tamaños de muestra pequeños a medianos. El análisis se llevó a cabo en dos etapas: evaluación del modelo de medición y evaluación del modelo estructural. En la evaluación del modelo de medición, se analizaron la fiabilidad de los indicadores, la fiabilidad de consistencia interna (mediante la fiabilidad compuesta [CR]), la validez convergente (mediante la varianza extraída promedio [AVE]) y la validez discriminante (mediante la razón heterotrait–monotrait [HTMT]).
Tras la validación del modelo de medición, se evaluó el modelo estructural para analizar las relaciones hipotetizadas entre el estilo de enseñanza, el uso de ChatGPT, la alfabetización digital, la motivación, la ansiedad y la creatividad. Se analizaron los coeficientes de ruta para determinar la magnitud y significancia de los efectos directos e indirectos, evaluándose la significancia mediante el método de arranque (bootstrapping) con 5.000 remuestras. Para evaluar la significancia de los efectos directos, indirectos y de mediación, se construyeron intervalos de confianza bootstrap corregidos para el sesgo (BC) utilizando 5.000 remuestras bootstrap y un nivel de confianza del 95 %. Asimismo, se evaluaron los efectos de mediación de la motivación en las relaciones entre el estilo de enseñanza, el uso de ChatGPT, la alfabetización digital y la ansiedad, empleando intervalos de confianza bootstrap. El ajuste del modelo y su poder predictivo se evaluaron mediante el coeficiente de determinación (R2), la relevancia predictiva (Q2) y el residuo cuadrático medio estandarizado (SRMR).