Características basais dos participantes e disponibilidade de dados
O questionário continha 62 participantes (31 novatos e 31 treinados), e a folha de tarefas continha 124 registros, indicando dois registros de tarefas concluídos por participante (Tabela 1). O grupo novato tinha menos de 12 meses de formação estruturada em tradução (máximo observado, 8,6 meses), enquanto o grupo treinado tinha pelo menos 12 meses (mínimo observado, 13,3 meses). As distribuições de idade, sexo, duração do aprendizado de inglês, proficiência e ordem das tarefas foram semelhantes entre os grupos. Figura 1 apresenta a amostra final analisada e distingue corretamente os dados específicos de cada tarefa: registros de pressionamento de teclas e gravações de tela referem-se à tradução escrita, áudios e transcrições verbais referem-se à interpretação simultânea e avaliações de qualidade aplicam-se a ambas.
Perfis comportamentais nas diferentes condições da tarefa
Os perfis comportamentais diferiram entre as duas condições da tarefa e entre os grupos de treinamento (Tabela 2; Figura 2A–E). A tradução escrita apresentou tempos de conclusão mais longos e pausas médias mais prolongadas, enquanto a interpretação simultânea apresentou mais pausas a cada 100 unidades de informação abaixo do limiar relatado. Dentro de cada condição de tarefa, o grupo treinado concluiu as tarefas mais rapidamente e obteve pontuações médias de produção mais altas. Esses contrastes não devem ser interpretados como efeitos puramente modais, pois o comprimento do texto, o limite de tempo, o modo de saída e a possibilidade de revisão também diferiram. As pausas não são uniformemente disruptivas: uma pausa pode refletir dificuldade não resolvida, planejamento bem-sucedido, monitoramento ou atividade relacionada ao método de entrada; portanto, as medidas de pausa são interpretadas em conjunto com as medidas de revisão, entrega e qualidade.
Revisão estratégica, auto-reparo e modelagem preditiva
O quadro de codificação separou o tipo de episódio do resultado funcional (Tabela 3; Figura 3A–D). Os participantes treinados produziram mais episódios de revisão escrita do que os novatos (12,4 ± 3,7 vs. 8,9 ± 3,0 por tarefa), enquanto o total de autorreparos orais não diferiu significativamente entre os grupos (4,9 ± 1,6 vs. 4,4 ± 1,5 por tarefa). O grupo treinado teve, no entanto, uma proporção maior de episódios eficazes em ambas as tarefas. O resumo dos efeitos mistos relatado na Tabela 4 apresenta associações, e não caminhos causais; portanto, a Figura 3E exibe as estimativas dos efeitos fixos relatadas e os intervalos de confiança, em vez de um diagrama causal.

Figura 1: Fluxo de participantes, alocação da ordem das tarefas e disponibilidade de dados específicos por tarefa. (A) Amostra final analisada de 62 participantes e 124 registros de tarefas. (B) Alocação contrabalançada da ordem das tarefas dentro dos grupos novato e treinado. (C) Matriz de disponibilidade na qual os registros de pressionamento de teclas e gravações de tela são aplicáveis apenas à tradução escrita, gravações de áudio e transcrições verbais apenas à interpretação simultânea, e avaliações de qualidade a ambas as tarefas. (D) Equilíbrio entre grupo e ordem (teste qui-quadrado, p = 0,799). n = 62 participantes (31 por grupo). Clique aqui para visualizar uma versão maior desta figura.

Figura 2: Perfis comportamentais nas condições de tarefa de tradução escrita e interpretação simultânea. (A) Configuração da gravação específica para cada tarefa. (B) Latência inicial/de início e tempo total da tarefa. (C) Distribuição conjunta da frequência de pausas e duração média das pausas. (D) Indicadores específicos para cada tarefa de exclusão, revisão e disfluência oral. (E) Taxa de produção escrita e taxa de fala oral. Nos painéis B, C e E, os pontos e barras de erro mostram as médias do grupo ± DP; no painel D, os pontos mostram as diferenças médias entre treinados e iniciantes e as barras de erro mostram os intervalos de confiança de 95%. n = 31 participantes por grupo. No painel E, o eixo y é exibido em escala logarítmica. Clique aqui para visualizar uma versão maior desta figura.

Figura 3: Codificação de revisão/autorreparo, resultado funcional e associações com a qualidade da saída. (A) Estrutura de decisão para atribuição independente do tipo de episódio e do resultado funcional. (B) Contagens médias de episódios lexicais, sintáticos, semânticos e estilísticos em cada condição da tarefa. (C) Proporções médias de episódios eficazes, neutros e prejudiciais. (D) Associação descritiva entre a taxa de episódios eficazes e a pontuação total de qualidade da saída. (E) gráfico de floresta exibindo efeitos fixos de um modelo linear de efeitos mistos com intervalos de confiança de 95% (detalhados na Tabela 4); o gráfico é associativo e não representa um modelo causal. Clique aqui para visualizar uma versão maior desta figura.
| Variáveis | Grupo novato (n = 31) | Grupo treinado (n = 31) | valor p |
| Idade, anos | 21,9 ± 1,7 | 22,4 ± 1,9 | 0,279 |
| Feminino, n (%) | 22 (71,0) | 21 (67,7) | 0,779 |
| Duração do aprendizado de inglês, anos | 12,4 ± 2,1 | 12,9 ± 2,2 | 0,36 |
| Pontuação de proficiência em inglês | 548,6 ± 41,3 | 562,4 ± 45,8 | 0,216 |
| Duração do treinamento em tradução, meses | 5,6 ± 3,0 | 18,7 ± 5,4 | <0,001 |
| Duração do treinamento em interpretação, meses | 2,3 ± 2,1 | 13,9 ± 5,7 | <0,001 |
| Prática prévia de tradução escrita ≥5 tarefas, n (%) | 9 (29,0) | 24 (77,4) | <0,001 |
| Prática prévia de interpretação simultânea ≥5 tarefas, n (%) | 5 (16,1) | 20 (64,5) | <0,001 |
| Tradução escrita primeiro, n (%) | 16 (51,6) | 15 (48,4) | 0,799 |
| Interpretação simultânea primeiro, n (%) | 15 (48,4) | 16 (51,6) | 0,799 |
Tabela 1: Características dos participantes e perfis iniciais de treinamento linguístico por grupo. As variáveis são apresentadas como média ± desvio padrão para dados contínuos e como contagens (porcentagens) para dados categóricos. Os valores de p relatados refletem comparações entre grupos para verificar o equilíbrio demográfico inicial e confirmar as diferenças pretendidas na duração do treinamento.
| Variáveis | Tradução escrita Novato (n = 31) | Tradução escrita Treinado (n = 31) | Interpretação simultânea Novato (n = 31) | Interpretação simultânea Treinado (n = 31) | Efeito da tarefa p | Efeito do grupo p |
| Latência inicial/de início, s | 31,8 ± 12,4 | 24,6 ± 9,7 | 14,2 ± 5,6 | 10,8 ± 4,2 | <0,001 | 0,003 |
| Tempo total da tarefa, s | 1038,5 ± 168,2 | 925,4 ± 151,6 | 305,6 ± 59,3 | 274,8 ± 50,7 | <0,001 | 0,004 |
| Frequência de pausas, por 100 unidades de informação | 18,6 ± 6,1 | 14,2 ± 5,0 | 24,8 ± 7,4 | 19,6 ± 6,3 | <0,001 | 0,001 |
| Duração média da pausa, s | 4,1 ± 1,2 | 3,3 ± 1,0 | 2,7 ± 0,8 | 2,3 ± 0,7 | 0,012 | 0,002 |
| Taxa de produção/fala, caracteres chineses/min | 28,6 ± 6,7 | 34,1 ± 7,5 | 93,4 ± 18,9 | 108,7 ± 20,4 | | 0,001 |
| Taxa de exclusão, % | 8,9 ± 3,4 | 6,8 ± 2,7 | | | | 0,009 |
| Densidade de revisão, por 100 caracteres chineses | 7,6 ± 2,8 | 8,9 ± 3,1 | | | | 0,087 |
| Frequência de pausas preenchidas, por min | | | 5,7 ± 1,9 | 4,2 ± 1,6 | | 0,002 |
| Frequência de repetições, por min | | | 4,9 ± 1,8 | 3,6 ± 1,4 | | 0,004 |
| Frequência de inícios falsos, por min | | | 2,8 ± 1,1 | 2,0 ± 0,9 | | 0,006 |
| Frequência de autocorreção, por min | | | 4,8 ± 1,7 | 3,9 ± 1,4 | | 0,031 |
| Pontuação total de qualidade, 0–25 | 16,8 ± 2,3 | 20,1 ± 2,1 | 15,4 ± 2,6 | 18,9 ± 2,4 | 0,002 | <0,001 |
| Precisão, 0–5 | 3,4 ± 0,7 | 4,1 ± 0,6 | 3,1 ± 0,8 | 3,8 ± 0,7 | 0,004 | <0,001 |
| Completude, 0–5 | 3,3 ± 0,8 | 4,0 ± 0,6 | 3,0 ± 0,8 | 3,7 ± 0,7 | 0,006 | <0,001 |
| Adequação lexical, 0–5 | 3,2 ± 0,7 | 4,0 ± 0,6 | 3,1 ± 0,7 | 3,8 ± 0,6 | 0,041 | <0,001 |
| Coesão, 0–5 | 3,5 ± 0,6 | 4,0 ± 0,6 | 3,1 ± 0,7 | 3,8 ± 0,6 | 0,003 | <0,001 |
| Naturalidade na língua de destino, 0–5 | 3,4 ± 0,7 | 4,0 ± 0,6 | 3,1 ± 0,7 | 3,8 ± 0,7 | 0,007 | <0,001 |
Tabela 2: Indicadores do processo comportamental e qualidade do resultado nas diferentes condições da tarefa e grupos. Os valores são expressos como média ± desvio padrão. Os valores de p relatados indicam os efeitos principais da modalidade da tarefa (tradução escrita versus interpretação simultânea) e da formação anterior (iniciante versus treinado) sobre cada variável de processo e qualidade.
| Variáveis | Tradução escrita Novato | Tradução escrita Treinado | valor p | Interpretação simultânea visual Novato | Interpretação simultânea visual Treinado | valor p |
| Revisão léxica/autoconserto, n/tarefa | 3,4 ± 1,5 | 4,2 ± 1,7 | 0,053 | 1,8 ± 0,8 | 1,7 ± 0,7 | 0,612 |
| Revisão sintática/autoconserto, n/tarefa | 2,1 ± 1,1 | 3,0 ± 1,2 | 0,004 | 1,1 ± 0,7 | 1,2 ± 0,8 | 0,645 |
| Revisão semântica/autoconserto, n/tarefa | 1,8 ± 1,0 | 2,5 ± 1,1 | 0,011 | 0,9 ± 0,6 | 1,1 ± 0,7 | 0,232 |
| Revisão estilística/autoconserto, n/tarefa | 1,6 ± 0,9 | 2,7 ± 1,2 | <0,001 | 0,6 ± 0,4 | 0,9 ± 0,6 | 0,026 |
| Total de episódios de revisão/autoconserto, n/tarefa | 8,9 ± 3,0 | 12,4 ± 3,7 | <0,001 | 4,4 ± 1,5 | 4,9 ± 1,6 | 0,209 |
| Episódios eficazes, % | 52,6 ± 13,5 | 68,4 ± 12,1 | <0,001 | 45,1 ± 14,2 | 62,3 ± 13,0 | <0,001 |
| Episódios neutros, % | 31,8 ± 10,4 | 22,7 ± 8,8 | 0,001 | 35,6 ± 11,7 | 25,4 ± 9,6 | 0,001 |
| Episódios prejudiciais, % | 15,6 ± 7,1 | 8,9 ± 5,6 | <0,001 | 19,3 ± 8,6 | 12,3 ± 6,8 | 0,001 |
Tabela 3: Tipo e eficácia das revisões escritas e autocorreções orais nas diferentes condições de tarefa. Os tipos de episódios são apresentados como médias de ocorrências por tarefa (± desvio padrão), e os resultados funcionais são apresentados como porcentagens médias (± desvio padrão). Os valores de p indicam a significância das diferenças entre grupos dentro de cada modalidade de tarefa.
| Efeitos fixos | β | EP | IC 95% | valor p |
| Intercepto | 16,74 | 0,42 | 15,91 a 17,57 | <0,001 |
| Modalidade da tarefa: interpretação simultânea versus tradução escrita | -1,08 | 0,29 | -1,65 a -0,51 | <0,001 |
| Grupo de treinamento: treinado versus novato | 2,84 | 0,47 | 1,91 a 3,77 | <0,001 |
| Modalidade da tarefa × grupo de treinamento | 0,26 | 0,47 | -0,67 a 1,19 | 0,581 |
| Frequência de pausas, por 100 unidades de informação | -0,12 | 0,05 | -0,22 a -0,02 | 0,018 |
| Duração média da pausa, s | -0,34 | 0,16 | -0,66 a -0,02 | 0,041 |
| Densidade de revisão/autocorreção | 0,07 | 0,07 | -0,07 a 0,21 | 0,334 |
| Taxa efetiva de revisão/autocorreção, por aumento de 10% | 0,56 | 0,13 | 0,30 a 0,82 | <0,001 |
| Carga de exclusão/desfluentes | -0,18 | 0,08 | -0,34 a -0,02 | 0,027 |
| Taxa de produção/fala, padronizada | 0,42 | 0,19 | 0,04 a 0,80 | 0,032 |
Tabela 4: Efeitos fixos relatados pelo modelo linear de efeitos mistos que prediz a qualidade total da produção. O resumo detalha os coeficientes não padronizados (β), erros padrão (SE), intervalos de confiança de 95% (IC) e valores p exatos para todos os preditores comportamentais e de tarefa especificados.