$$\rightleftharpoonup{xx}$$
$$\longleftharp{xx}$$,
$$\longrightharp{xx}$$,
Questo studio è stato condotto presso la School of Humanities and Arts della Civil Aviation Flight University of China, utilizzando dati educativi de-identificati raccolti nell'ambito del corso. Nel dataset analitico non è stata inclusa alcuna informazione personale direttamente identificabile. Tutti i partecipanti sono stati informati sullo scopo e sulle procedure dello studio, e il consenso informato scritto è stato ottenuto prima della partecipazione. La partecipazione era volontaria e la mancata partecipazione o il ritiro dalla componente di ricerca non influivano sulla frequenza ai corsi, i voti o l'accesso all'istruzione regolare. Secondo il quadro applicabile delle pratiche di ricerca della Civil Aviation Flight University of China, gli studi basati su dati educativi a rischio minimo deidentificati potrebbero non richiedere una revisione etica formale. Tutti i materiali deidentificati erano conservati in file protetti da password accessibili solo al team di ricerca. L'etica e il flusso dei partecipanti sono mostrati nella Figura 1.
1. Reclutamento dei partecipanti e profilazione di base
In totale, 525 studenti sono stati reclutati da corsi universitari legati all'inglese o alla traduzione. Erano inclusi studenti universitari e post-laurea di discipline come linguistica, letteratura e studi internazionali. Tutti i volontari sono stati selezionati prima dell'iscrizione. Sono stati inclusi solo gli studenti che stavano attualmente seguendo un corso di inglese o traduzione e avevano almeno una competenza intermedia in inglese basata su registri di collocamento istituzionale, corsi precedenti o prove accademiche equivalenti. Gli studenti con una notevole esperienza professionale nella traduzione sono stati esclusi. Sono stati registrati età, genere, livello accademico, campo di studio, esperienza precedente con supporto alla traduzione assistita dall'IA e frequenza di utilizzo degli strumenti di base. Le caratteristiche dei partecipanti sono state presentate nella Tabella 1.
2. Progettazione didattica e flusso di lavoro di intervento
È stato implementato un intervento in aula di otto settimane in cui l'istruzione convenzionale della traduzione è rimasta la modalità principale di insegnamento e il supporto alla traduzione assistita dall'IA è stato utilizzato come impalcatura supplementarestrutturata 11. Nella settimana 0, la valutazione di base è stata completata. Dalla Settimana 1 alla Settimana 8, ogni settimana veniva assegnato un compito di traduzione e tutti i partecipanti dovevano seguire la stessa sequenza didattica. Alla fine della settimana 8, la batteria di valutazione utilizzata alla fase iniziale è stata ripetuta. Dopo la fase quantitativa, sono state condotte interviste semi-strutturate con un sottogruppo selezionato intenzionalmente. Il flusso di lavoro complessivo è mostrato nella Figura 2.
3. Valutazione di base
Tutte le misure di base sono state somministrate in un'aula supervisionata sotto istruzioni e condizioni di orario identiche. Fu utilizzato un compito di traduzione basato su un testo di circa 300 parole. È stato selezionato un passaggio contenente segmenti sia letterali che culturalmente sfumati in modo che gli studenti dovessero dimostrare accuratezza lessicale, controllo sintattico, fedeltà semantica e comprensionecontestuale 12. L'uso di strumenti esterni è stato vietato durante i test di base. Tutti i copioni completati venivano anonimizzati prima della colonna sonora. Ogni script è stato valutato indipendentemente da due valutatori formati utilizzando una rubrica che copriva accuratezza lessicale, appropriatezza grammaticale e sintattica, completezza semantica e contestualizzazione culturale. Se la discrepanza del punteggio superava l'intervallo di tolleranza predefinito, era necessaria una discussione fino a raggiungere un punteggio di consenso.
Dopo il compito di traduzione, è stata somministrata e valutata la Scala di Stress Percepito a 10 item secondo la procedura standard, con punteggi più alti che indicano uno stress percepito maggiore13. La scala per il Disturbo d'Ansia Generalizzato di 7 item è stata poi somministrata e valutata utilizzando il metodo pubblicato, con punteggi più alti che indicano una maggiore gravitàdell'ansia 14. Infine, è stata somministrata una breve misura di fiducia nella traduzione utilizzando un formato Likert a cinque punti. Item rappresentativi, intervalli di punteggio e definizioni di variabili sono stati forniti nella Tabella 2.
4. Integrazione settimanale standardizzata del supporto alla traduzione assistita dall'IA
Durante ogni settimana di intervento, veniva assegnato un compito di traduzione che era stato abbinato il più possibile per genere e difficoltà agli altri compiti settimanali. Gli studenti dovevano completare il compito nello stesso ordine ogni settimana. Innanzitutto, il testo sorgente veniva letto indipendentemente e venivano segnati elementi lessicali difficili, strutture sintattiche o espressioni cariche di cultura. In secondo luogo, veniva preparata una bozza iniziale o una breve nota che descriveva i problemi di traduzione previsti. In terzo luogo, la consultazione dei sistemi di traduzione assistiti dall'IA approvati era consentita solo durante la stesura e la revisione. Non era consentita la trasmissione diretta di output generati da macchina non modificati.
Gli studenti dovevano valutare ogni settimana tutte le proposte di macchina conservate o respinte utilizzando gli stessi quattro criteri: adattamento lessicale, naturalezza sintattica, coerenza del discorso e adeguatezza culturale. Per ogni compito settimanale era necessario inviare il testo sorgente segnato, la bozza assistita da macchina e la traduzione finale rivista. Dopo la consegna, una discussione strutturata tra pari veniva organizzata utilizzando gli stessi prompt ogni settimana, così che gli studenti spiegassero dove l'output automatico fosse utile, fuorviante, troppo letterale o contestualmente inappropriato. Questo progetto ha seguito le evidenze attuali che mostrano che la traduzione automatica è più utile dal punto di vista educativo quando integrata nel confronto e revisione guidati piuttosto che utilizzata come sostituto del giudizioumano 15.
5. Monitoraggio e catalogazione dell'uso degli strumenti
L'uso degli strumenti assistiti dall'IA è stato monitorato durante l'intervento di otto settimane. Dopo ogni compito settimanale, ai partecipanti era richiesto di compilare un breve registro di utilizzo online che riportava se fosse stato utilizzato il supporto automatico, quale funzione svolgeva, con quale frequenza veniva consultato e in quale fase entrava nel processo di traduzione. Nella Settimana 1 sono state fornite categorie di risposta standardizzate in modo che i partecipanti utilizzassero gli stessi criteri di segnalazione durante tutto lo studio. Alla fine della settimana 8, i record settimanali furono aggregati e la frequenza complessiva di utilizzo fu classificata come uso quotidiano, settimanale o occasionale. Le definizioni operative di queste categorie sono mostrate nella Figura 3.
6. Valutazione post-intervento
Alla fine della settimana 8, la stessa batteria di valutazione utilizzata al punto di partenza è stata ripetuta. È stato utilizzato un testo di traduzione post-intervento che è stato abbinato il più possibile al testo di base in termini di lunghezza, genere e difficoltà. Le condizioni amministrative, i tempi, la rubrica di valutazione e il flusso di lavoro del valutatore sono stati mantenuti coerenti con le procedure di base. La stessa Scala di Stress Percepito, la stessa Scala del Disturbo d'Ansia Generalizzato e la stessa misura di fiducia nella traduzione sono state somministrate nello stesso ordine usato alla base.
7. Procedure qualitative di intervista e analisi tematica
Dopo la valutazione post-intervento, 40 studenti sono stati selezionati intenzionalmente per colloqui semi-strutturati, garantendo variazioni di genere, livello accademico ed esperienza precedente con il supporto alla traduzione assistita dall'IA. Le interviste sono state condotte faccia a faccia o tramite un formato di incontro online approvato, utilizzando la stessa guida per tutti i partecipanti. Sono state poste domande su strategie di utilizzo degli strumenti, percepito carico cognitivo, cambiamenti di fiducia, valutazione della produzione delle macchine e preoccupazioni per l'eccessiva dipendenza. Tutte le interviste sono state registrate audio con il consenso dei partecipanti e trascritte parola per parola.
Le trascrizioni sono state analizzate tramite analisi tematica. Due ricercatori sono stati invitati a leggere tutte le trascrizioni in modo indipendente, generare codici iniziali, confrontare i risultati dei codici, unire codici sovrapposti e perfezionare i temi candidati attraverso una revisione ripetuta delle trascrizioni. Dopo la fase iniziale di codifica, fu calcolato l'accordo tra valutatori e fu riportato il kappa di Cohen. La logica analitica ha seguito procedure consolidate per l'analisi tematica nella ricercaqualitativa 16.
8. Analisi quantitativa e a metodi misti
Sono state utilizzate statistiche descrittive per riassumere le caratteristiche dei partecipanti e i punteggi di base. Confronti a campioni accoppiati sono stati utilizzati per testare le differenze pre-post nella precisione della traduzione, nello stress percepito, nell'ansia e nella fiducia in sé stessi. Sono stati utilizzati molteplici modelli di regressione per identificare i predittori dell'accuratezza della traduzione post-intervento, con prestazioni di base, frequenza di utilizzo di strumenti assistiti dall'IA e variabili psicologiche inserite come variabili indipendenti. I test chi-quadrati sono stati utilizzati per esaminare le associazioni tra categorie di utilizzo ed esiti categoricici, mentre i coefficienti di correlazione di Pearson sono stati utilizzati per valutare la direzione e la forza delle associazioni tra accuratezza della traduzione, frequenza d'uso, stress percepito, ansia e fiducia in sé stessi. La significanza statistica è stata impostata ad alfa = 0,05 utilizzando test a due lati. I risultati quantitativi e qualitativi sono stati integrati nella fase di interpretazione secondo le procedure standard a metodimisti 17.