Características basales de los participantes y disponibilidad de datos
El cuestionario incluyó a 62 participantes (31 novatos y 31 entrenados), y la hoja de tareas contenía 124 registros, lo que indica dos registros de tareas completados por participante (Tabla 1). El grupo novato contaba con menos de 12 meses de formación estructurada en traducción (máximo observado, 8,6 meses), mientras que el grupo entrenado tenía al menos 12 meses (mínimo observado, 13,3 meses). Las distribuciones por edad, sexo, duración del aprendizaje del inglés, dominio del idioma y orden de realización de las tareas fueron similares entre los grupos. Figura 1 muestra la muestra final analizada y distingue correctamente los datos específicos de cada tarea: los registros de pulsaciones y grabaciones de pantalla corresponden a la traducción escrita, los audios y transcripciones literales corresponden a la interpretación simultánea, y las calificaciones de calidad se aplican a ambas.
Perfiles conductuales en diferentes condiciones de la tarea
Los perfiles conductuales difirieron entre las dos condiciones de la tarea y entre los grupos de entrenamiento (Tabla 2; Figura 2A–E). La traducción escrita tuvo tiempos de finalización más largos y pausas medias más prolongadas, mientras que la interpretación simultánea presentó más pausas por cada 100 unidades de información bajo el umbral reportado. Dentro de cada condición de tarea, el grupo entrenado completó las tareas más rápidamente y obtuvo puntuaciones medias de producción más altas. Estos contrastes no deben interpretarse como efectos puramente modales, ya que también variaron la longitud del texto, el límite de tiempo, el modo de salida y la posibilidad de revisión. Las pausas no son uniformemente disruptivas: una pausa puede reflejar dificultad no resuelta, planificación exitosa, monitoreo o actividad relacionada con el método de entrada; por ello, las mediciones de pausas se interpretan junto con las mediciones de revisión, entrega y calidad.
Revisión estratégica, autocorrección y modelado predictivo
El marco de codificación separó el tipo de episodio del resultado funcional (Tabla 3; Figura 3A–D). Los participantes entrenados produjeron más episodios de revisión por escrito que los novatos (12,4 ± 3,7 frente a 8,9 ± 3,0 por tarea), mientras que la cantidad total de autorreparaciones orales no difirió significativamente entre los grupos (4,9 ± 1,6 frente a 4,4 ± 1,5 por tarea). Sin embargo, el grupo entrenado tuvo una proporción mayor de episodios efectivos en ambas tareas. El resumen de efectos mixtos reportado en la Tabla 4 presenta asociaciones en lugar de relaciones causales; por lo tanto, la Figura 3E muestra las estimaciones de efectos fijos reportadas y sus intervalos de confianza en lugar de un diagrama causal.

Figura 1: Flujo de participantes, asignación del orden de las tareas y disponibilidad de datos específicos por tarea. (A) Muestra final analizada de 62 participantes y 124 registros de tareas. (B) Asignación contrabalanceada del orden de las tareas dentro de los grupos de principiantes y entrenados. (C) Matriz de disponibilidad en la que los registros de pulsaciones y grabaciones de pantalla son aplicables únicamente a la traducción escrita, las grabaciones de audio y transcripciones literales solo a la interpretación simultánea, y las calificaciones de calidad a ambas tareas. (D) Equilibrio entre grupo y orden (prueba de chi-cuadrado, p = 0.799). n = 62 participantes (31 por grupo). Haga clic aquí para ver una versión más grande de esta figura.

Figura 2: Perfiles conductuales en las condiciones de tarea de traducción escrita e interpretación simultánea. (A) Montaje de grabación específico para cada tarea. (B) Latencia inicial/de inicio y tiempo total de la tarea. (C) Distribución conjunta de la frecuencia de pausas y la duración media de las pausas. (D) Indicadores específicos de cada tarea de eliminaciones, revisiones y disfluencias orales. (E) Velocidad de producción escrita y velocidad de habla oral. En los paneles B, C y E, los puntos y las barras de error muestran las medias del grupo ± DE; en el panel D, los puntos muestran las diferencias medias entre expertos y novatos y las barras de error muestran los intervalos de confianza del 95 %. n = 31 participantes por grupo. En el panel E, el eje y se muestra en escala logarítmica. Haga clic aquí para ver una versión más grande de esta figura.

Figura 3: Codificación de revisiones/autorreparaciones, resultados funcionales y asociaciones con la calidad de la salida. (A) Marco de decisión para asignar de forma independiente el tipo de episodio y el resultado funcional. (B) Recuentos promedio de episodios léxicos, sintácticos, semánticos y estilísticos en cada condición de la tarea. (C) Proporciones promedio de episodios efectivos, neutros y perjudiciales. (D) Asociación descriptiva entre la tasa de episodios efectivos y la puntuación total de calidad de la salida. (E) gráfico de bosque que muestra los efectos fijos de un modelo lineal de efectos mixtos con intervalos de confianza del 95 % (detallados en Tabla 4); el gráfico es asociativo y no representa un modelo causal. Haga clic aquí para ver una versión más grande de esta figura.
| Variables | Grupo novato (n = 31) | Grupo entrenado (n = 31) | Valor de p |
| Edad, años | 21.9 ± 1.7 | 22.4 ± 1.9 | 0.279 |
| Mujeres, n (%) | 22 (71,0) | 21 (67,7) | 0.779 |
| Duración del aprendizaje del inglés, años | 12.4 ± 2.1 | 12.9 ± 2.2 | 0.36 |
| Puntuación de competencia en inglés | 548.6 ± 41.3 | 562.4 ± 45.8 | 0.216 |
| Duración de la formación en traducción, meses | 5.6 ± 3.0 | 18.7 ± 5.4 | <0.001 |
| Duración de la formación en interpretación simultánea, meses | 2.3 ± 2.1 | 13.9 ± 5.7 | <0.001 |
| Práctica previa de traducción escrita ≥5 tareas, n (%) | 9 (29,0) | 24 (77,4) | <0.001 |
| Práctica previa de interpretación simultánea ≥5 tareas, n (%) | 5 (16,1) | 20 (64,5) | <0.001 |
| Traducción escrita primero, n (%) | 16 (51,6) | 15 (48,4) | 0.799 |
| Interpretación simultánea primero, n (%) | 15 (48,4) | 16 (51,6) | 0.799 |
Tabla 1: Características de los participantes y perfiles iniciales de entrenamiento lingüístico por grupo. Las variables se presentan como media ± desviación estándar para datos continuos y como frecuencias (porcentajes) para datos categóricos. Los valores de p informados reflejan comparaciones entre grupos para verificar el equilibrio demográfico basal y confirmar las diferencias previstas en la duración del entrenamiento.
| Variables | Traducción escrita Novato (n = 31) | Traducción escrita Entrenado (n = 31) | Interpretación visual Novato (n = 31) | Interpretación visual Entrenado (n = 31) | Efecto de la tarea p | Efecto del grupo p |
| Latencia inicial/de inicio, s | 31,8 ± 12,4 | 24,6 ± 9,7 | 14,2 ± 5,6 | 10,8 ± 4,2 | <0,001 | 0,003 |
| Tiempo total de la tarea, s | 1038,5 ± 168,2 | 925,4 ± 151,6 | 305,6 ± 59,3 | 274,8 ± 50,7 | <0,001 | 0,004 |
| Frecuencia de pausas, por cada 100 unidades informativas | 18,6 ± 6,1 | 14,2 ± 5,0 | 24,8 ± 7,4 | 19,6 ± 6,3 | <0,001 | 0,001 |
| Duración media de la pausa, s | 4,1 ± 1,2 | 3,3 ± 1,0 | 2,7 ± 0,8 | 2,3 ± 0,7 | 0,012 | 0,002 |
| Ritmo de producción/hablado, caracteres chinos/min | 28,6 ± 6,7 | 34,1 ± 7,5 | 93,4 ± 18,9 | 108,7 ± 20,4 | | 0,001 |
| Tasa de eliminación, % | 8,9 ± 3,4 | 6,8 ± 2,7 | | | | 0,009 |
| Densidad de revisiones, por cada 100 caracteres chinos | 7,6 ± 2,8 | 8,9 ± 3,1 | | | | 0,087 |
| Frecuencia de pausas llenas, por min | | | 5,7 ± 1,9 | 4,2 ± 1,6 | | 0,002 |
| Frecuencia de repeticiones, por min | | | 4,9 ± 1,8 | 3,6 ± 1,4 | | 0,004 |
| Frecuencia de inicios falsos, por min | | | 2,8 ± 1,1 | 2,0 ± 0,9 | | 0,006 |
| Frecuencia de autocorrecciones, por min | | | 4,8 ± 1,7 | 3,9 ± 1,4 | | 0,031 |
| Puntuación total de calidad, 0–25 | 16,8 ± 2,3 | 20,1 ± 2,1 | 15,4 ± 2,6 | 18,9 ± 2,4 | 0,002 | <0,001 |
| Precisión, 0–5 | 3,4 ± 0,7 | 4,1 ± 0,6 | 3,1 ± 0,8 | 3,8 ± 0,7 | 0,004 | <0,001 |
| Completitud, 0–5 | 3,3 ± 0,8 | 4,0 ± 0,6 | 3,0 ± 0,8 | 3,7 ± 0,7 | 0,006 | <0,001 |
| Adecuación léxica, 0–5 | 3,2 ± 0,7 | 4,0 ± 0,6 | 3,1 ± 0,7 | 3,8 ± 0,6 | 0,041 | <0,001 |
| Coherencia, 0–5 | 3,5 ± 0,6 | 4,0 ± 0,6 | 3,1 ± 0,7 | 3,8 ± 0,6 | 0,003 | <0,001 |
| Naturalidad en el idioma de destino, 0–5 | 3,4 ± 0,7 | 4,0 ± 0,6 | 3,1 ± 0,7 | 3,8 ± 0,7 | 0,007 | <0,001 |
Tabla 2: Indicadores del proceso conductual y calidad de los resultados en las distintas condiciones de la tarea y grupos. Los valores se expresan como media ± desviación estándar. Los valores de p informados indican los efectos principales de la modalidad de la tarea (traducción escrita frente a interpretación simultánea) y del historial de formación (novato frente a entrenado) sobre cada variable de proceso y calidad.
| Variables | Traducción escrita Novato | Traducción escrita Entrenado | p valor | Interpretación visual Novato | Interpretación visual Entrenado | p valor |
| Revisión léxica/auto-corrección, n/tarea | 3.4 ± 1.5 | 4.2 ± 1.7 | 0.053 | 1.8 ± 0.8 | 1.7 ± 0.7 | 0.612 |
| Revisión sintáctica/auto-corrección, n/tarea | 2.1 ± 1.1 | 3.0 ± 1.2 | 0.004 | 1.1 ± 0.7 | 1.2 ± 0.8 | 0.645 |
| Revisión semántica/auto-corrección, n/tarea | 1.8 ± 1.0 | 2.5 ± 1.1 | 0.011 | 0.9 ± 0.6 | 1.1 ± 0.7 | 0.232 |
| Revisión estilística/auto-corrección, n/tarea | 1.6 ± 0.9 | 2.7 ± 1.2 | <0.001 | 0.6 ± 0.4 | 0.9 ± 0.6 | 0.026 |
| Episodios totales de revisión/auto-corrección, n/tarea | 8.9 ± 3.0 | 12.4 ± 3.7 | <0.001 | 4.4 ± 1.5 | 4.9 ± 1.6 | 0.209 |
| Episodios efectivos, % | 52.6 ± 13.5 | 68.4 ± 12.1 | <0.001 | 45.1 ± 14.2 | 62.3 ± 13.0 | <0.001 |
| Episodios neutrales, % | 31.8 ± 10.4 | 22.7 ± 8.8 | 0.001 | 35.6 ± 11.7 | 25.4 ± 9.6 | 0.001 |
| Episodios perjudiciales, % | 15.6 ± 7.1 | 8.9 ± 5.6 | <0.001 | 19.3 ± 8.6 | 12.3 ± 6.8 | 0.001 |
Tabla 3: Tipo y efectividad de las revisiones escritas y autoreparaciones orales en las distintas condiciones de la tarea. Los tipos de episodios se reportan como recuentos medios por tarea (± desviación estándar), y los resultados funcionales se expresan como porcentajes medios (± desviación estándar). Los valores de p indican la significancia de las diferencias entre grupos dentro de cada modalidad de tarea.
| Efectos fijos | β | EE | IC 95% | valor p |
| Intercepto | 16.74 | 0.42 | 15.91 a 17.57 | <0.001 |
| Modalidad de la tarea: interpretación auditiva frente a traducción escrita | -1.08 | 0.29 | -1.65 a -0.51 | <0.001 |
| Grupo de entrenamiento: entrenado frente a novato | 2.84 | 0.47 | 1.91 a 3.77 | <0.001 |
| Interacción entre modalidad de la tarea y grupo de entrenamiento | 0.26 | 0.47 | -0.67 a 1.19 | 0.581 |
| Frecuencia de pausas, por cada 100 unidades de información | -0.12 | 0.05 | -0.22 a -0.02 | 0.018 |
| Duración media de la pausa, s | -0.34 | 0.16 | -0.66 a -0.02 | 0.041 |
| Densidad de revisiones/autocorrecciones | 0.07 | 0.07 | -0.07 a 0.21 | 0.334 |
| Tasa efectiva de revisión/autocorrección, por incremento del 10% | 0.56 | 0.13 | 0.30 a 0.82 | <0.001 |
| Carga de eliminaciones/disfluencias | -0.18 | 0.08 | -0.34 a -0.02 | 0.027 |
| Tasa de producción/emisión verbal, estandarizada | 0.42 | 0.19 | 0.04 a 0.80 | 0.032 |
Tabla 4: Efectos fijos informados por el modelo lineal de efectos mixtos que predice la calidad total de la producción. El resumen detalla los coeficientes no estandarizados (β), errores estándar (SE), intervalos de confianza del 95 % (IC) y los valores p exactos para todos los predictores de tarea y conducta especificados.