Dichiarazione etica
Questo studio è stato condotto in conformità agli standard etici dell'Institutional Review Board (IRB) dell'Università di Chengdu, Cina (Approvazione n.: 202509). Tutti i partecipanti hanno fornito un consenso informato scritto prima della partecipazione. Lo studio ha rispettato le linee guida istituzionali per la ricerca che coinvolge soggetti umani, garantendo partecipazione volontaria, riservatezza e il diritto di ritirarsi in qualsiasi momento senza penalità.
Per mantenere la riservatezza, tutti i dati raccolti venivano anonimizzati tramite identificatori codificati e le informazioni personali venivano memorizzate separatamente dai dati di ricerca in file protetti da password, accessibili solo ai ricercatori principali. Il disegno del questionario ha incorporato misure per minimizzare il disagio psicologico, in particolare per le domande sull'ansia, e ai partecipanti sono state fornite le informazioni di contatto dei servizi di consulenza universitaria nel caso in cui si verificasse disagio dalla partecipazione al sondaggio. Per affrontare potenziali squilibri di potere nel rapporto insegnante-studente, il reclutamento e la raccolta dati sono stati condotti da assistenti di ricerca formati anziché da docenti di corso, e ai partecipanti è stato assicurato che le loro risposte non avrebbero influito sul loro rendimento accademico o sul rapporto con il corpo docente.
Questo studio ha utilizzato un progetto quantitativo e trasversale che coinvolgeva 290 studenti cinesi di inglese inglese provenienti da un'università pubblica. I partecipanti provenienti da anni accademici e discipline diversi sono stati reclutati tramite campionamento di convenienza con rappresentanza proporzionale e hanno compilato questionari cartacei in contesti di classe controllati durante le sessioni regolari, richiedendo circa 25 minuti. La batteria di questionari includeva scale validate che misuravano lo stile di insegnamento, l'alfabetizzazione digitale, l'uso di ChatGPT, la motivazione, l'ansia e la creatività. Per minimizzare i bias, assistenti di ricerca formati hanno somministrato i questionari utilizzando contromisure procedurali come la separazione psicologica degli elementi. Dopo la raccolta dei dati, le risposte sono state analizzate utilizzando software statistico e software di Partial Least Square Structural Equation Modeling (PLS-SEM), inclusi lo screening dei dati, la valutazione del modello di misura, il test del modello strutturale e l'analisi di mediazione utilizzando una procedura bootstrapping con 5.000 ricampioni.
Progettazione della Ricerca
Questo studio ha utilizzato un disegno di ricerca quantitativo e trasversale per esaminare le relazioni tra stile di insegnamento, uso di ChatGPT, alfabetizzazione digitale, motivazione, ansia e creatività tra gli studenti di EFL. Un approccio trasversale è stato ritenuto appropriato per catturare un'istantanea di queste variabili in un momento specifico, permettendo l'analisi delle loro interrelazioni senza le esigenze temporali della ricerca longitudinale. Il design ha facilitato il test di un modello di mediazione ipotizzato in cui la motivazione funge da meccanismo che collega lo stile di insegnamento, l'uso di ChatGPT e l'alfabetizzazione digitale alla riduzione dell'ansia e alla creatività potenziata.
Dati e campione
Il quadro di campionamento comprendeva tutti gli studenti universitari iscritti ai corsi di Inglese come Lingua Straniera (EFL) presso un'università pubblica in Cina durante l'anno accademico 2024–2025. I criteri di idoneità richiedevano che i partecipanti fossero (a) madrelingua cinese, (b) attualmente iscritti ad almeno un corso obbligatorio di EFL, e (c) non avessero una formazione formale precedente sugli strumenti di apprendimento linguistico basati sull'IA oltre ai corsi generali. È stato utilizzato un approccio stratificato di campionamento di convenienza, con allocazione proporzionale tra gli anni accademici (matricola, seconda, terza e quarta) e aree disciplinari (discipline umanistiche, scienze sociali, scienze naturali, ingegneria). Le dimensioni target degli strati sono state fissate al 25% per anno accademico e al 25% per area disciplinare, in base alla distribuzione complessiva degli studenti dell'università. Il campione finale comprendeva 290 studenti universitari di EFL. Dei 328 studenti contattati durante le sessioni regolari, 11 hanno rifiutato di partecipare (tasso di non partecipazione = 3,4%) e 27 hanno fornito questionari incompleti (tasso di risposta incompleta = 8,2%), ottenendo un tasso di risposta utilizzabile finale dell'88,4% (290/328). Il calcolo a priori della dimensione del campione è stato eseguito utilizzando G*Power 3.1 con la famiglia di test F, regressione multipla lineare: modello fisso, deviazione R2 da zero come test. I parametri di input erano: dimensione dell'effetto f2 = 0,15 (dimensione d'effetto media convenzionale per la ricerca comportamentale), α err probabilità = 0,05, potenza (1-β err probabilità) = 0,95 e numero di predittori = 3 (stile di insegnamento, uso di ChatGPT, alfabetizzazione digitale) per il risultato della motivazione. Il calcolo ha prodotto una dimensione minima del campione richiesta di 119 per rilevare un significativoR2. Per tenere conto ulteriormente dell'intero modello SEM (inclusi i percorsi indiretti e le variabili endogene aggiuntive), abbiamo applicato la regola più conservativa di 10 casi per parametro stimato. Con 29 parametri stimati nel nostro modello, la dimensione del campione richiesta era di 290, che corrisponde esattamente al campione finale. Pertanto, il campione ottenuto è completamente alimentato sia per analisi basate su regressione che per analisi SEM.
Partecipanti e procedura
I partecipanti sono stati reclutati tramite campionamento stratificato di convenienza per garantire proporzionalità tra gli anni accademici (primo a quarto) e i background disciplinari (discipline umanistiche, scientifiche e ingegneria). Le dimensioni degli strati nel campione finale erano: matricole (n = 72, 24,8%), sophomore (n = 74, 25,5%), junior (n = 71, 24,5%), senior (n = 73, 25,2%); e discipline umanistiche (n = 76, 26,2%), scienze sociali (n = 68, 23,4%), scienze naturali (n = 72, 24,8%), ingegneria (n = 74, 25,5%). Il campione era composto per il 62% da studenti femmine e per il 38% da studenti maschi, con un'età media di 20,3 anni (DE = 1,7). La raccolta dei dati avveniva durante le normali sessioni di EFL. Assistenti di ricerca formati somministravano questionari cartacei in contesti di classe controllati per garantire la standardizzazione. Prima dell'amministrazione del sondaggio, tutti gli studenti idonei presenti in classe sono stati informati dello scopo dello studio, della natura volontaria e delle misure di riservatezza (risposte anonime, archiviazione sicura dei dati). Gli studenti che non soddisfavano i criteri di idoneità (n = 6, nessuna iscrizione all'EFL) o che avevano rifiutato la partecipazione (n = 11) erano esclusi; Le ragioni del declino includevano vincoli di tempo (n = 7) e disagio per l'uso auto-dichiarato della tecnologia (n = 4). La batteria di questionari ha impiegato circa 25 minuti per essere completata e ha incluso scale validate per tutti i costrutti. Per mitigare il bias comune nei metodi, sono state applicate contromisure procedurali (ad esempio, separazione psicologica degli elementi della scala, anonimato delle risposte). Inoltre, il bias del metodo comune è stato valutato utilizzando il test a fattore singolo di Harman, e il primo fattore ha rappresentato meno del 50% della varianza totale, indicando che il bias del metodo comune non era una preoccupazione principale in questo studio.
Misure di studio
Tutte le scale sono state adattate al contesto cinese dell'EFL attraverso una rigorosa procedura di traduzione e adattamento. Due ricercatori bilingui hanno tradotto indipendentemente gli elementi originali in inglese in cinese, e un terzo ricercatore ha riconciliato le discrepanze per produrre una versione preliminare. Questa versione è stata tradotta in inglese da due diversi traduttori, e eventuali incongruenze sono state risolte attraverso discussioni con il team di ricerca. Le versioni cinesi sono state poi testate in fase pilota con 30 studenti di inglese inglese (non parte del campione principale) per verificare chiarezza e comprensione, con conseguenti lievi aggiustamenti di formulazione. Per ciascuna scala, le risposte sono state raccolte su una scala di Likert a 5 punti che variava da 1 (fortemente dissentito) a 5 (fortemente d'accordo). Per ogni costrutto sono stati utilizzati punteggi sommati o mediati, con punteggi più alti che indicano livelli più alti della rispettiva variabile. Tutte le scale adattate sono state utilizzate con il permesso degli autori originali o con termini di licenza aperta dove applicabile. Nessun elemento fu rimosso dalle scale originali tranne dove indicato di seguito; La ritenzione degli elementi si basava su carichi fattoriali > 0,40 e sulla rilevanza teorica. Per quanto riguarda l'uso di ChatGPT, lo studio ha valutato l'interazione auto-riportata dagli studenti con la versione gratuita di ChatGPT (GPT-3.5/4 disponibile tramite web o app mobile durante l'anno accademico 2024–2025). Tutti i partecipanti avevano pari accesso allo strumento poiché l'università non limitava ChatGPT; tuttavia, l'uso effettivo variava da persona a persona. La scala misurava la frequenza di utilizzo di ChatGPT (da "mai" a "quotidiano"), i tipi di compiti di apprendimento linguistico per cui veniva impiegato (ad esempio, costruzione del vocabolario, correzione grammaticale, stesura di saggi, pratica della conversazione e correzione degli errori) e la qualità percepita dell'interazione (ad esempio, utilità, chiarezza del feedback). La scala non distingueva tra versioni specifiche di ChatGPT, poiché gli aggiornamenti di versione avvenivano durante il periodo di raccolta dati; invece, i partecipanti hanno riportato la versione che hanno utilizzato principalmente, con oltre il 90% che ha riportato GPT-3.5 o GPT-4. Di seguito sono forniti esempi dettagliati di item e note di adattamento per ogni costrutto.
Questo studio ha utilizzato scale rigorosamente validate, adattate con attenzione al contesto educativo EFL, per valutare le variabili chiave: approcci didattici, competenza digitale, integrazione con ChatGPT, ansia nell'apprendimento delle lingue, motivazione degli studenti e pensiero creativo. Gli strumenti di misurazione sono stati scelti per la loro affidabilità dimostrata e la capacità di valutare in modo completo ogni costrutto. Per esaminare i metodi didattici, la ricerca ha utilizzato una versione modificata del Teaching Style Inventory34 di Grasha, che valuta cinque approcci pedagogici distinti: autorevole, esperto, insegnante modello personale, facilitatore e delegativo. Per valutare l'alfabetizzazione digitale, lo studio ha incorporato una versione modificata della scala sviluppata da Rodríguez-de-Dueños et al.35, composta da 29 item in sei domini chiave: (1) alfabetizzazione tecnica, (2) alfabetizzazione per la protezione dei dati personali, (3) alfabetizzazione nella valutazione critica, (4) alfabetizzazione nella sicurezza dei dispositivi, (5) alfabetizzazione nell'elaborazione dell'informazione e (6) alfabetizzazione nella comunicazione digitale. Questo quadro multidimensionale ha fornito una valutazione approfondita delle capacità digitali degli studenti necessarie per l'educazione contemporanea. L'uso di ChatGPT è stato valutato utilizzando una scala di 8 item adattata da Abbas et al.36, concentrandosi sull'interazione degli studenti con lo strumento di IA per compiti di apprendimento linguistico. Questa scala cattura l'uso percepito e auto-riportato di ChatGPT dagli studenti nei compiti di apprendimento linguistico, piuttosto che la frequenza di utilizzo oggettiva. L'ansia in classe in lingua straniera (FLCA) è stata misurata utilizzando una scala adattata basata su Briesmaster eBriesmaster 37. Questo strumento ha esaminato l'ansia in tre dimensioni critiche: apprehensione della comunicazione, ansia da test e paura della valutazione negativa, con rispettivamente 10, 10 e 7 item. La motivazione degli studenti è stata valutata utilizzando una scala adattata da Kanoksilapatham et al.38, misurando tre dimensioni chiave: Promozione e Prevenzione dell'Strumentalità, Etnocentrismo e Integrazione, e Atteggiamento verso l'Apprendimento dell'Inglese. La bilancia includeva un totale di 20 elementi. La creatività degli studenti di EFL è stata misurata utilizzando una scala adattata da Govindasamy et al.39, che valutava quattro dimensioni: Originalità, Flessibilità, Fluidità ed Elaborazione. Ogni dimensione è stata misurata utilizzando tre elementi.
Metodi di Analisi dei Dati
I dati raccolti sono stati analizzati utilizzando un approccio analitico a due fasi che combina SPSS (Versione 27) e Partial Least Square Structural Equation Modeling (PLS-SEM) tramite software SmartPL. Lo screening iniziale dei dati e le analisi preliminari sono state condotte utilizzando SPSS per esaminare la qualità dei dati, inclusi controlli di valori mancanti, valori anomali e assunzioni di normalità. Meno del 2% dei punti dati mancava completamente a caso (MCAR), come confermato dal test MCAR di Little (χ2 = 18,24, p = 0,212), e venivano gestiti utilizzando l'algoritmo di massimizzazione delle aspettative per preservare la potenza statistica. Il dataset ha dimostrato una normalità univariata accettabile (asimetria < |2|, curtosi < |7|) e normalità multivariata (coefficiente di Mardia = 18,37, p < 0,001), giustificando l'uso sia dei test parametrici che del PLS-SEM, che è robusto alla non normalità. Sebbene la normalità univariata fosse accettabile, il coefficiente di Mardia indicava una violazione della normalità multivariata (p < 0,001). Tuttavia, questo non rappresenta un problema poiché PLS-SEM è robusto a distribuzioni di dati non normali.
L'analisi dell'affidabilità ha rivelato una forte coerenza interna per tutte le scale (α > di Cronbach 0,82, affidabilità composita > 0,85), mentre l'analisi fattoriale esplorativa ha confermato le strutture fattoriali previste con tutti gli elementi che si caricano pulitamente sulle rispettive strutture (carichi > 0,65, carichi incrociati < 0,40).
Per il test delle ipotesi, PLS-SEM è stato scelto rispetto al SEM basato sulla covarianza grazie alla sua migliore gestione di modelli complessi con campioni di dimensioni piccole o medie e alla sua capacità di massimizzare la varianza spiegata nei costrutti endogeni. L'analisi ha seguito la procedura in due fasi, prima valutando il modello di misura e poi il modello strutturale. Il modello di misurazione riflessiva ha dimostrato una validità convergente adeguata (varianza media estratta > 0,50 per tutti i costrutti) e validità discriminante confermata sia dal criterio di Fornell-Larcker sia dal rapporto eterotratto-monotratto (HTMT < 0,85). Nel modello strutturale, i coefficienti di percorso sono stati stimati utilizzando una procedura di bootstrapping con 5.000 ricampionamenti per generare stime stabili e intervalli di confidenza. Il potere predittivo del modello è stato valutato tramite valori R2 per variabili endogene (motivazione = 0,53, ansia = 0,41, creatività = 0,38) e rilevanza predittiva (Q2 > 0), con dimensioni dell'effetto (f2) calcolate per determinare l'impatto sostanziale. Le analisi di mediazione hanno utilizzato il metodo bootstrap corretto al bias per testare gli effetti indiretti, con una mediazione significativa stabilita quando intervalli di confidenza al 95% escludevano zero.
Tutti i costrutti sono stati modellati come riflettenti (modalità A) basandosi su considerazioni teoriche, poiché ogni variabile latente era presumibile a causare i suoi indicatori osservati. Nessun elemento è stato eliminato da nessuna scala, poiché tutti gli elementi hanno mostrato carichi esterni sopra la soglia di 0,50 (che varia da 0,62 a 0,89) e tutti i valori medi estratti dalla varianza estratta (AVE) hanno superato 0,50, confermando la validità convergente. Per i test di mediazione, il modello strutturale includeva percorsi diretti dai tre antecedenti (stile di insegnamento, uso di ChatGPT, alfabetizzazione digitale) alla motivazione, dalla motivazione all'ansia e dall'ansia alla creatività. Sono stati inoltre stimati percorsi diretti dagli antecedenti all'ansia e dagli antecedenti alla creatività per testare la mediazione parziale rispetto a quella completa. La mediazione completa è stata determinata sulla base dei criteri secondo cui (a) gli effetti indiretti (antecedenti → motivazione → ansia) erano significativi (intervallo di confidenza bootstrap corretto al 95% escluso zero), e (b) gli effetti diretti degli antecedenti all'ansia diventavano non significativi dopo aver incluso il mediatore, mentre gli effetti diretti degli antecedenti alla creatività non erano mai significativi. Tutte le analisi hanno utilizzato l'algoritmo PLS-SEM in SmartPLS 4 con schema di pesatura del percorso, iterazioni massime impostate a 300 e criterio di stop 1.0e-7. L'bootstrapping è stato eseguito con 5.000 sottocampioni, intervalli di confidenza corretti al bias e accelerati (BCa) al 95% e senza opzione di cambio segno. L'adattamento del modello è stato valutato utilizzando il residuo quadratico medio della radice standardizzato (SRMR = 0,061), che si colloca sotto la soglia raccomandata di 0,08.