Artigo de investigação

Modelagem de Memória de Curto Prazo Longo do Método Tradicional Chinês Mongol de Rolamento de Osteopatia usando Adam e o Filtro de Hodrick-Prescott

49 vistas

DOI:

10.3791/70938

12 de junho de 2026

Neste artigo

Resumo

Este estudo propõe um modelo de Memória Longa de Curto Prazo em duas camadas, integrado com filtragem de Hodrick-Prescott, para prever com precisão informações mecânicas na Osteopatia Mongol Tradicional Chinesa, alcançando alta precisão em dados experimentais de exercício de força.

Resumo

A aquisição e previsão de informações mecânicas foram importantes para a digitalização da osteopatia tradicional mongol chinesa. A extração de informações mecânicas periódicas e orientadas a tendências do processo de exercício de força apresentou um desafio substancial para alcançar uma previsão precisa da informação mecânica. Para enfrentar esse desafio, este artigo introduziu uma rede de Memória de Curto Prazo Longo (LSTM) de dupla camada, integrada com filtragem Hodrick-Prescott (HP), que combinava técnicas de filtragem HP com LSTM para melhorar a precisão da previsão mecânica de informações. Essa pesquisa foi fundamentada em dados coletados experimentalmente para análise mecânica de informações, onde a redução de dimensionalidade foi realizada nos dados adquiridos com base nas articulações primárias envolvidas na aplicação da força. Especificamente, três pontos de dados do sensor foram selecionados entre um total de 24 como características de entrada centrais. O LSTM foi empregado para capturar dependências de longo prazo inerentes aos dados sequenciais. Nesta investigação, o algoritmo de otimização Adam foi utilizado para ajustar os hiperparâmetros do modelo, garantindo desempenho ótimo. Os resultados experimentais ressaltaram a eficácia da metodologia proposta, evidenciada por um coeficiente de determinação (R2) de 0,897, um erro absoluto médio de 0,025 e um erro quadrático médio de 0,031. Uma análise comparativa com métodos alternativos de estimativa atesta ainda mais a estabilidade, precisão e capacidades de generalização da rede LSTM de duas camadas complementada com filtragem HP.

Introdução

A Osteopatia Mongol Tradicional Chinesa, também conhecida como terapia Noharahu Tradicional Mongol Chinesa, é uma abordagem terapêutica manual na qual o praticante aplica várias técnicas manipulativas a partes específicas do corpo com o objetivo de quantificação mecânica e padronização de habilidades, sendo aplicada clinicamente para a redução de fraturas. Como uma manipulação típica de microgestos, a Agora1 indicou que o método de aplicação da força da terapia mongol Noharahu difere significativamente do da Medicina Tradicional Chinesa (MTC). Na China, a Osteopatia Mongol foi reconhecida como parte da medicina tradicional, e a educação em osteopatia foi incorporada à proteção do patrimônio cultural imaterial e aos programas acadêmicos em tempo integral. De acordo com Yao et al.2, as características da manipulação osteopática abrangem tanto atributos cinemáticos quanto mecânicos. As características cinemáticas dizem respeito aos aspectos morfológicos dos movimentos manipulativos, como os fundamentos operacionais das técnicas de balanço — "baixar os ombros, abaixar os cotovelos e suspender os pulsos." Atributos mecânicos, no contexto deste estudo, referem-se especificamente à forma de onda da força aplicada em séries temporais, incluindo magnitude da força, frequência, amplitude, velocidade e seus padrões dinâmicos de variação, que coletivamente constituem os requisitos fundamentais da aplicação de força "sustentada, poderosa, uniforme e suave" 3.

As características mecânicas da manipulação osteopática são inerentemente complexas, originando-se do exercício integrado de força de múltiplas articulações, o que impõe altas exigências sobre a geração coordenada de força e as habilidades correspondentes dos ombros, cotovelos, punhos, membros inferiores, região lombar e costas do praticante. No ensino e treinamento em manipulação osteopática, os instrutores frequentemente têm dificuldade em transmitir as características e os fundamentos científicos das técnicas usando apenas terminologia descritiva. Da mesma forma, os alunos têm dificuldade em compreender totalmente as sutilezas e nuances das manipulações e alcançar proficiência em pouco tempo. Para enfrentar essa limitação, pesquisas sobre as características da manipulação osteopática utilizaram diversas tecnologias avançadas de sensoriamento para medir e quantificar os parâmetros das características das técnicas. Por meio da análise sistemática de dados, essas pesquisas validam a experiência clínica, revelam os princípios biomecânicos inerentes às técnicas e, por fim, traduzem os achados em aplicações educacionais, ajudando assim os estudantes a desenvolver uma compreensão mais profunda dos princípios subjacentes às operações manipulativas. No entanto, pesquisas especificamente relacionadas à Osteopatia Mongol continuam limitadas em comparação com as técnicas de Tuina da MTC mais amplamente estudadas, e a padronização dos protocolos de treinamento para a Osteopatia Mongol ainda está em seus estátios iniciais. Ellwood e Carnes4 ilustraram que a aplicação da tecnologia de computação para coletar informações mecânicas de profissionais especialistas e extrair características de manipulação poderia fornecer uma referência objetiva para a padronização e operação padronizada da osteopatia tradicional.

Avanços recentes em tecnologias flexíveis de detecção de força criaram novas oportunidades para a medição objetiva e quantificação das técnicas tradicionais de manipulação. Sensores flexíveis de força/torque de seis eixos, calibrados usando redes neurais profundas, apresentaram erros de medição abaixo de 0,751% em escala total e foram demonstrados com sucesso em aplicações de fisioterapiade massagem 5. De forma semelhante, estruturas híbridas de sensoriamento óptico-tátil permitiram aquisição simultânea de dados de força/torque em seis eixos e identificação anatômica do local de contato, alcançando R2 ≥ 0,87 para estimativa de força e mais de 97% de precisão no reconhecimentode manobras 6. Esses avanços tecnológicos fornecem uma base para a aquisição precisa de informações mecânicas na pesquisa em manipulação osteopática. Consequentemente, há a necessidade de avançar a modelagem científica e a transmissão sistemática de conhecimento na Osteopatia Mongol por meio da integração de métodos modernos de sensorização e computação.

O aprendizado profundo revolucionou a previsão de séries temporais, superando os métodos estatísticos tradicionais na modelagem de dinâmicas complexas não lineares e dependências de longo prazo prevalentes em dados temporais do mundoreal 7,8. Entre as arquiteturas de aprendizado profundo, as redes de Memória de Curto Prazo Longo (LSTM) emergiram como ferramentas particularmente eficazes para capturar dependências temporais em dados sequenciais, e foram amplamente adotadas em diversos domínios, incluindo finanças, saúde, gestão de energia e modelagemclimática 9. Uma revisão abrangente de mais de 150 estudos demonstrou que abordagens baseadas em LSTM, especialmente aquelas aprimoradas com o otimizador Adam, melhoram a precisão das previsões em até 14% em comparação com métodostradicionais 9. No domínio da previsão de forças especificamente, Zhang et al.10 introduziram uma abordagem RNN baseada em LSTM para previsão de força de excitação em tempo real no controle de conversores de energia de ondas. Li et al.7 ilustraram um codificador–decodificador Bi-LSTM com forcing do professor para a previsão do movimento de rolamento de navio de curto prazo. Zhu et al.8 utilizaram um LSTM residual baseado em aprendizado por transferência com atenção temporal ao padrão para inversão de força roda-trilho.

As principais contribuições deste estudo são as seguintes:
Um novo framework híbrido de modelagem que combina filtragem de Hodrick–Prescott com uma arquitetura LSTM de dupla camada, especificamente adaptada para prever padrões de exercício de força no método de rolagem da Osteopatia Mongol.
Uma avaliação comparativa abrangente do modelo proposto em relação a múltiplas arquiteturas de base, incluindo LSTM de camada única, variantes não-HP, PCA-LSTM, rede neural BP e floresta aleatória, demonstrando a superioridade do LSTM de duas camadas aprimorado por HP para a previsão de sinais de força não estacionários.
Validação empírica usando dados de sensores mecânicos coletados experimentalmente, fornecendo uma metodologia reprodutível e resultados de referência para a digitalização das técnicas tradicionais de manipulação osteopática.

Obras relacionadas
No contexto da digitalização tradicional por manipulação terapêutica, redes neurais têm sido cada vez mais aplicadas à extração de características e à classificação de padrões de força. Li et al.6 e Lu et al.11 propuseram métodos de predição mecânica de sequência de informação baseados em LSTM para robôs de massagem portáteis. Lv et al.12 desenvolveram uma abordagem iterativa de otimização combinando redes neurais BP com algoritmos genéticos para a predição de coordenadas de pontos de acupunctura e planejamento comportamental em robôs de massagem MTC. A Midea Group Co. Ltd.13 patenteou um robô de massagem usando visão artificial, enquanto Moll et al.14 e Mo et al.15 demonstraram o uso de redes neurais convolucionais para classificar informações específicas de movimento. Sayapin16 propôs uma rede neural baseada em sensores para coletar e identificar indicadores mecânicos a partir de movimentos das mãos. Com base no status de desenvolvimento do ReinoUnido 17 e da Alemanha18, a digitalização da Osteopatia Mongol pode ser de grande importância para fins educacionais. No entanto, nenhum desses estudos abordou especificamente os padrões únicos de aplicação da força característicos do método de rolamento da Osteopatia Mongol.

Abordagens híbridas que combinam decomposição de sinais com aprendizado profundo demonstraram melhorias substanciais na precisão da previsão para séries temporais não estacionárias. O filtro de Hodrick-Prescott (HP), originalmente proposto para análise de séries temporais econômicas, decompõe um sinal em sua tendência constitutiva e componentescíclicos 19. Estudos recentes aplicaram com sucesso a decomposição HP em conjunto com redes neurais em vários domínios. Um modelo híbrido que combina filtragem HP com RNNs e ARIMA alcançou reduções em MAPE, RMSE e MAE variando de 9,70% a 56,23% em comparação com redes neurais independentes para previsão de demandaelétrica 20. Na previsão de inflação, o filtro HP foi considerado o melhor eliminador de ruído e enfatiza a dinâmica cíclica, permitindo que modelos de conjunto alcancem R2 > 0,99 e redes neurais alcançam R2 > 0,9321. De forma semelhante, a decomposição baseada em filtro HP combinada com LSTM guiado por perda por pinball foi aplicada com sucesso à previsão probabilística de intensidade de carbono em grade4. Ao analisar os padrões inerentes a esses componentesdistintos 22,23, diferentes técnicas de previsão de dados são aplicadas para prever separadamente os componentes datendência 24 eda flutuação 25,26, após o que essas previsões são combinadas para obter os resultados finaisda previsão 27. Estratégias semelhantes de LSTM aumentadas por decomposição também demonstraram eficácia em outros domínios de séries temporais não estacionárias, como a previsão financeira28.

Apesar desses avanços na previsão de séries temporais baseadas em LSTM e da comprovada eficácia do filtragem HP como técnica de pré-processamento, até onde sabemos, nenhum estudo anterior integrou o filtragem HP com uma arquitetura LSTM multicamada especificamente para a previsão dos padrões de aplicação de força em manipulações osteopáticas tradicionais — particularmente no contexto do método chinês de rolagem da Osteopatia Tradicional Mongol, onde as características não estacionárias do exercício de força apresentam desafios únicos de modelagem. O presente estudo aborda essa lacuna introduzindo um modelo LSTM de dupla camada, aprimorado com filtragem HP, validado com dados de força coletados experimentalmente por um profissional qualificado.

Acesso restrito. Inicie sessão ou comece um teste para visualizar este conteúdo.

Protocolo

Redes LSTM
Uma Rede Neural Recorrente (RNN) era um tipo de rede neural que podia prever o valor no próximo passo temporal com base nas observações anteriores de uma série temporal. RNNs processam uma observação de uma série temporal por vez e armazenam informações históricas dessa série ajustando continuamente um "vetor de estado" na camada oculta. Embora o objetivo das RNNs fosse aprender informações históricas em séries temporais, as RNNs não eram adequadas para processar séries temporais mais longas devido ao problema de anulação do gradiente encontrado ao usar o algoritmo de retropropagação. A rede de Memória Longa de Curto Prazo (LSTM) é uma variante da RNN que resolve o problema de anulação do gradiente encontrado durante o treinamento, tornando-a capaz de lidar com séries temporais mais longas. Comparados às RNNs padrão, as LSTMs possuem três unidades adicionais de controle de porta: a porta de entrada, a porta de esquecimento e a porta de saída. A Figura 1 delimita a estrutura fundamental da LSTM e sua estrutura arquitetônica central, que compreende cinco componentes essenciais: três funções de ativação sigmoide e duas funções de ativação tangente hiperbólica (tanh). É notável que a função sigmoide posicionada à esquerda assume um papel fundamental na regulação da transmissão de informação do passo de tempo anterior, desempenhando as funções de filtragem e refinamento da informação para apoiar esse processo regulatório, conforme elucidado pela equação subsequente:

Equação 1(1)

Figura 1
Figura 1. Estrutura fundamental da rede LSTM. Por favor, clique aqui para ver uma versão ampliada desta figura.

onde a porta de esquecimento atuava como "f t", as sequências de entrada como "xt", e "ht-1" era a informação oculta antes da saída da unidade. A porta de esquecimento era responsável por determinar quais informações deveriam ser descartadas ou mantidas, a porta de entrada podia atualizar o estado da unidade de memória, e a porta de saída podia determinar o valor do estado oculto subsequente. Esses três portões são denotados como ft, it e o t.

Equação 7(2)

Equação 8(3)

Equação 9(4)

Equação 10(5)

Equação 11(6)

A equação (3) define o estado candidato da célula C't criado pela função tanh, que propõe novos valores a serem adicionados ao estado da célula. Especificamente, a entrada do modelo foi formulada integrando as saídas de duas funções sigmoides com a da função tanh inicial, conforme ilustrado na Equação (5).

A equação (4) caracteriza a função sigmoide direita que serve como valor inicial de saída do modelo, que foi posteriormente mapeada para o intervalo [−1, 1] via a função tangente hiperbólica (tanh). Após isso, tanto o valor resultante da função tanh quanto a saída da função sigmoide são convertidos para seus respectivos valores reais de saída, como exemplificado na Equação (6).

Na LSTM, a função sigmoide regulava a informação atual, enquanto a função tangente hiperbólica (tanh) podia ser responsável pelo processamento de informações históricas. A integração dessas duas funções doa aos LSTMs com sua capacidade preditiva. Quando comparados às RNNs convencionais, a vantagem das LSTMs reside em sua arquitetura sofisticada, capaz de capturar toda a memória de dados de entrada até o intervalo de tempo t+1. A integridade dessa memória é preservada por meio do mecanismo de gate facilitado pela função sigmoide, garantindo assim que informações críticas sejam retidas por períodos prolongados.

Filtro HP
O filtro de Hodrick-Prescott (filtro HP), proposto por Hodrick e Prescott em 1980, tem sido amplamente utilizado em análise econômica e análise relacionada a séries temporais. O filtro HP assume que o conjunto de dados a ser analisado foi uma combinação de mudanças de longo prazo e flutuações de curto prazo, decompondo a série temporal Y={y1, y2, ⋯, yT} em duas subsséries: a série de tendências de longo prazo G={g1, g2, ⋯, gT} e a série de flutuações de curto prazo S={s1, s2, ⋯, sT}. A série de tendências de longo prazo gT, onde t=1,2,⋯,T, é derivada minimizando a seguinte expressão:

Equação 13(7)

Onde T representa o número de amostras na série temporal yt, e λ é maior que 0, conhecido como parâmetro de suavização, indicando os pesos dos termos Equação 14 e Equação 15. Quando λ=0, a série de tendências de longo prazo G que satisfaz o problema de minimização é igual à série original Y. À medida que o valor de λ aumenta, o número total de mudanças na série de tendências de longo prazo diminui em relação às da série original, o que significa que um λ maior resulta em uma série de tendências de longo prazo mais suave. Quando λ se aproxima do infinito, a série de tendência de longo prazo se assemelha a uma função linear. A série de flutuação de curto prazo pode ser obtida subtraindo a série de tendência de longo prazo da série temporal original, ou seja, S=Y-G.

Antes de aplicar o filtro HP, era imprescindível selecionar um parâmetro de suavização apropriado λ, pois diferentes parâmetros de suavização ditam tendências distintas de longo prazo e flutuações de curto prazo. De acordo com pesquisas anteriores relacionadas, o valor de λ é fixado em 100 neste estudo.

Preparação dos Participantes e Aprovação Ética
A aprovação ética foi obtida do Comitê de Revisão Ética da Universidade Médica da Mongólia Interior (nº YKD202001041) antes de qualquer coleta de dados. Foi recrutado um pesquisador em tempo integral do Colégio de Medicina Mongol da Universidade Médica da Mongólia Interior, especializado no método de rolamento da Osteopatia Tradicional Mongol Chinesa (CTMO). Foi obtido consentimento informado por escrito do participante. Todos os procedimentos seguiram os princípios da Declaração de Helsinque.

Configuração e calibração do equipamento
Um sistema de teste de força de empunhadura de mão multicanal, equipado com 24 sensores mecânicos, foi utilizado para coletar parâmetros mecânicos do método de rolagem CTMO (veja as Figuras 2 e 3 para o layout do sistema e posicionamento dos sensores). Todos os 24 sensores de força foram calibrados conforme as instruções do fabricante. O software de aquisição de dados foi configurado para registrar dados em uma frequência de amostragem de 100 Hz e exibir leituras de força em tempo real em Newtons (N). A duração da gravação foi definida para 60 s por teste.

Figura 2
Figura 2. Sistema de teste de força de empunhadura multicanal. Por favor, clique aqui para ver uma versão ampliada desta figura.

Figura 3
Figura 3. Interface de aquisição de manipulação de massagem baseada no sistema de teste de força de pega multicanal. Por favor, clique aqui para ver uma versão ampliada desta figura.

Aquisição de dados
O participante foi instruído a vestir a luva instrumentada e assumir a postura padrão de partida. O modelo do antebraço humano artificial foi colocado sobre uma superfície horizontal estável à frente do participante. Ao iniciar o software de gravação de dados, o participante realizou a manipulação de rolamento CTMO continuamente na área designada do modelo do antebraço por 1 minuto. O arquivo de dados bruto era salvo em um formato estruturado (por exemplo, .csv ou .txt) contendo carimbos de tempo e leituras de força de todos os 24 sensores. Esse procedimento foi repetido até que um total de 150 ensaios independentes fossem concluídos. O participante descansou por pelo menos 30 segundos entre os ensaios para minimizar a variabilidade induzida pela fadiga. R (versão 4.2) foi posteriormente usada para calcular regras de movimento e ângulos de amplitude de movimento nas articulações, além de resumir as características operacionais da técnica.

Seleção de Sensores via Visualização de Características
Os dados brutos de força de todos os 24 sensores em todos os testes foram carregados em R. A magnitude média da força e a variância para cada sensor foram calculadas em todo o conjunto de dados. Um diagrama de preenchimento de bolhas foi construído usando o pacote ggplot2 em R para mostrar a contribuição relativa de cada falange/metacarpo dos dedos para o esforço total da força. Com base neste diagrama (Figura 4), os Sensores 8 (falange proximal do dedo mindinho), 13 (falange distal dedo médio) e 2 (falange distal do dedo indicador) apresentaram as maiores magnitudes de força e variabilidade e, portanto, foram selecionados como as principais características de entrada para modelagem subsequente.

Figura 4
Figura 4. Diagrama de preenchimento de bolhas dos nós dos dedos no método de rolamento. (1) falange proximal do dedo indicador; (2) falange distal do dedo indicador; (3) metacarpo do dedo indicador; (4) falange média do dedo indicador; (5) falange proximal do dedo anelar; (6) falange distal do dedo anelar; (7) falange metacarpiana do dedo anelar; (8) falange proximal do dedo mindinho; (9) falange distal do dedo mindinho; (10) metacarpo do dedo mindinho; (11) falange média do dedo mindinho; (12) falange proximal do dedo médio; (13) falange distal do dedo médio; (14) metacarpo do dedo médio; (15) falange do dedo médio. Por favor, clique aqui para ver uma versão ampliada desta figura.

Pré-processamento de dados para modelagem de séries temporais
Os dados de forças da série temporal F8(t), F13(t) e F2(t) para os sensores selecionados foram extraídos do conjunto de dados bruto. Uma variável de tempo normalizada T foi criada escalando os carimbos de tempo da gravação para o intervalo [0'1]. A seguinte fórmula foi utilizada:

Equação 21

Onde t era o carimbo de tempo original em segundos. Para cada ensaio, os dados de força e o tempo normalizado foram concatenados em um conjunto de dados multivariado de séries temporais de dimensões N × 4, onde N era o número de passos de tempo (6.000 passos para um teste de 60 s a 100 Hz) e as colunas correspondiam a [T'F8'F 13'F 2].

Filtragem de Hodrick–Prescott (HP)
O filtro Hodrick–Prescott foi aplicado independentemente a cada um dos três sinais de força F8, F13 e F2. O parâmetro de suavização foi definido para λ = 100. Esse valor foi escolhido com base na natureza aproximada anual/cíclica da tendência de força de longo prazo observada nos 2.000 pontos de dados iniciais (conforme demonstrado na Figura 5) e foi considerado adequado para preservar características de força biomecânica.

Figura 5
Figura 5. Comparação dos efeitos do filtro HP com λ = 100 e λ = 10.000 nos primeiros 2.000 pontos de dados do Sensor 8. Por favor, clique aqui para ver uma versão ampliada desta figura.

Nota de implementação: A função hpfilter do pacote mFilter em R foi usada com o argumento freq = 100.

Dois componentes foram obtidos para cada sinal do sensor: o componente de tendência G(t) e o componente cíclico C(t), onde Equação 32. A matriz final de características de entrada foi construída concatenando o tempo normalizado com a tendência filtrada por HP e os componentes cíclicos dos três sensores selecionados. Isso resultou em um conjunto de dados de N × 7 dimensões: Equação 34. O conjunto de dados foi dividido cronologicamente em subconjuntos de treinamento (70%), validação (15%) e testes (15%). Crítico: A embaralhagem aleatória das séries temporais foi evitada para evitar vazamentos temporais. O conjunto de teste continha os últimos 15% da sequência de tempo registrada.

Construção do modelo LSTM de duas camadas com filtragem HP
O ambiente computacional foi configurado usando o TensorFlow (versão 2.10) com a API Keras em R. A arquitetura da rede neural foi definida da seguinte forma:
Camada de entrada: Forma = (comprimento da sequência'7), onde sequence_length era o número de passos de tempo por amostra de entrada (foram usados 100 passos).
Primeira camada LSTM: Unidades = 50, return_sequences = VERDADEIRO. A função de ativação do tanh era usada para o passo recorrente, e o sigmoide era usado para as ativações do portal.
Segunda camada LSTM: Unidades = 50, return_sequences = FALSO.
Camada Totalmente Conectada (Densa): Unidades = 1 (para previsão de força univariada). O fluxo de trabalho completo do modelo LSTM de dupla camada com filtragem HP, desde o pré-processamento de dados até a previsão final, está ilustrado na Figura 6. O alvo de saída era o valor da força no Sensor 8 no próximo passo de tempo (previsão de um passo à frente).

Figura 6
Figura 6. Gráfico de fluxo de trabalho de aplicação LSTM em camadas duplas. Por favor, clique aqui para ver uma versão ampliada desta figura.

O modelo foi compilado usando o algoritmo de otimização Adam com os seguintes hiperparâmetros: Taxa de aprendizado: 0,001; Taxa de decaimento: 0,001; Função de perda: Erro Quadrático Médio (MSE). O modelo foi treinado para 20 épocas, com um lote de 32 anos. O Early Stopping foi implementado com uma paciência de 5 épocas monitorando a perda de validação para evitar sobreajuste. Uma taxa de abandono de 0,2 foi aplicada entre as camadas LSTM para regularização. Os dados de treinamento foram embaralhados apenas no nível do lote dentro de cada época — não na ordem sequencial — para manter a coerência temporal enquanto introduziam estocasticidade para a descida do gradiente.

Configuração do conjunto de dados de teste
Para avaliar o desempenho preditivo dos modelos propostos, o conjunto de dados pré-processado foi dividido cronologicamente em três subconjuntos: treinamento (70%), validação (15%) e teste (15%). A divisão cronológica garantiu que nenhuma informação futura vazasse no processo de treinamento. O conjunto de teste compreendia os últimos 2.000 passos de tempo × 3 sensores = 6.000 pontos de dados da sequência registrada, correspondendo a aproximadamente 20 s de dados de esforço contínuo de força na taxa original de 100 Hz. Para a avaliação das capacidades de previsão de maior duração, uma sequência de teste estendida de 1.200 s (120.000 passos de tempo) foi construída concatenando cronologicamente 20 tentativas consecutivas de 60-s, preservando a ordem temporal. A continuidade da força entre os testes concatenados foi verificada para garantir que não houvesse transições abruptas.

Métricas de desempenho
Três métricas padrão de regressão foram calculadas para quantificar a precisão da previsão:

Coeficiente de Determinação (R2): Definido como Equação 37, onde yi e Equação 39 denotam respectivamente os valores da força real e prevista, e Equação 40 é a média dos valores reais. R2 mede a proporção de variância nos dados de força explicados pelo modelo.

Erro Absoluto Médio (MAE): Definido como Equação 41. O MAE fornece a magnitude média dos erros de predição em unidades de Newtons (N).

Erro quadrático médio da raiz (RMSE): definido como Equação 42. A RMSE é sensível a grandes desvios de erro e é expressa em Newtons (N).

Todas as métricas foram calculadas no conjunto de teste não visto após reverter quaisquer transformações de normalização ou escalonamento aplicadas durante o pré-processamento.

Modelos comparativos de referência
Para comparar o LSTM de duas camadas proposto com filtragem Hodrick–Prescott (HP), os seguintes modelos alternativos foram implementados e avaliados sob divisões idênticas de treinamento, validação e teste. Os hiperparâmetros para todos os modelos de redes neurais foram ajustados usando o conjunto de validação para garantir uma comparação justa.

LSTM de camada única sem filtragem HP
Arquitetura: Uma única camada LSTM com 50 unidades ocultas, seguida por uma camada densa totalmente conectada com um único neurônio de saída.
Recursos de entrada: dados brutos de força dos Sensores 8, 13 e 2, além de tempo normalizado (entrada 4-dimensional).
Treinamento: otimizador Adam com taxa de aprendizado = 0,001, decaimento = 0,001, tamanho do lote = 32, treinado por 20 épocas com parada precoce (paciência = 5) monitorando a perda de validação.

LSTM de dupla camada sem filtragem HP
Arquitetura: Duas camadas de LSTM empilhadas, cada uma com 50 unidades ocultas. A primeira camada LSTM retornava sequências completas, e a segunda camada LSTM retornava apenas o estado oculto final. Uma camada densa de saída com um neurônio seguia.
Recursos de entrada: Iguais aos anteriores (entradas de força bruta 4-dimensionais).
Parâmetros de treinamento: Idênticos à configuração LSTM de camada única.

LSTM de camada única com filtragem HP
Arquitetura: Uma única camada LSTM com 50 unidades ocultas seguida por uma camada densa de saída.
Características de entrada: componentes de tendência e cíclico decompostos por HP para os Sensores 8, 13 e 2, além de tempo normalizado T (entrada 7-dimensional, conforme descrito no Protocolo).
Parâmetros de treinamento: Iguais aos anteriores.

PCA-LSTM
Redução de dimensionalidade: A Análise de Componentes Principais (PCA) foi aplicada à matriz de características filtrada por HP de 7 dimensões para extrair três componentes principais, que explicavam coletivamente >95% da variância no conjunto de características.
Arquitetura: Uma única camada LSTM com 50 unidades ocultas, recebendo as três principais séries temporais como entrada.
Parâmetros de treinamento: Iguais aos anteriores.

Rede neural de retropropagação (BP)
Arquitetura: Uma rede neural feedforward com uma camada oculta contendo 64 neurônios e ativação do ReLU. A camada de saída continha um único neurônio linear.
Representação de entrada: Os dados das séries temporais foram achatados em vetores de características de comprimento fixo (100 passos de tempo × 7 características = 700 dimensões de entrada).
Treinamento: otimizador Adam com taxa de aprendizado = 0,001, perda por erro quadrático médio, treinado por 100 épocas com tamanho de lote de 64. Parar cedo com paciência = 10 foi aplicado.

Regressor da Floresta Aleatória
Algoritmo: Conjunto de 100 árvores de decisão com profundidade máxima de 10 e amostras mínimas por divisão definidas para 5.
Representação de entrada: Mesmos vetores de características achatados usados na rede neural BP (entrada de 700 dimensões).
Implementação: O RandomForestRegressor da biblioteca scikit-learn (versão 1.2) foi empregado com hiperparâmetros padrão, exceto onde especificado acima.

Considerações estatísticas
Para avaliar a robustez do desempenho preditivo, cada configuração do modelo foi treinada e avaliada cinco vezes com diferentes inicializações aleatórias (quando aplicável). As métricas reportadas representam os valores médios das cinco execuções, acompanhadas pelo desvio padrão para quantificar a variabilidade. Nenhuma validação cruzada foi aplicada à série temporal para preservar a ordenação temporal; em vez disso, o conjunto de validação cronológica fixa era usado para ajuste de hiperparâmetros.

Acesso restrito. Inicie sessão ou comece um teste para visualizar este conteúdo.

Resultados

O desempenho do modelo primário foi avaliado usando as métricas do conjunto de testes. Um valor alto deR 2 (0,897) e um MAE/RMSE baixo indicaram que o LSTM de duas camadas com filtragem HP capturou com sucesso a dinâmica de forças do método de rolagem CTMO. A comparação com os modelos de referência mostrou que os modelos filtrados por HP superaram os modelos não filtrados, apoiando o benefício de separar componentes de tendência e cíclico para o aprendizado de LSTM. As métricas de desempenho do modelo também m...

Acesso restrito. Inicie sessão ou comece um teste para visualizar este conteúdo.

Discussão

Os resultados demonstram que integrar uma arquitetura de Memória Longa de Curto Prazo de duas camadas com filtragem de Hodrick–Prescott melhora substancialmente a previsão da aplicação da força no Método Tradicional Chinês de Rolamento de Osteopatia Mongol. Comparado com modelos LSTM de camada única e não filtrados, o modelo combinado proposto capturou de forma mais eficaz tanto dependências temporais de longo prazo quanto componentes de tendência subjacentes nos sinais de força, levando...

Acesso restrito. Inicie sessão ou comece um teste para visualizar este conteúdo.

Divulgações

Os autores não têm conflitos de interesse a declarar.

Agradecimentos

Este artigo foi apoiado pela Fundação Nacional de Ciências Naturais da China (10561151).

Acesso restrito. Inicie sessão ou comece um teste para visualizar este conteúdo.

Materiais

Lista de materiais utilizados neste artigo
NomeEmpresaNúmero de catálogoComentários
Artificial human forearm modelNão especificadoNão disponívelModelo de treinamento padrão usado como superfície receptora para manipulação por rolagem
Keras (R package)RStudio/PositCRAN: kerasAPI de aprendizagem profunda usada para construção do modelo LSTM; versão 2.10
mFilter (R package)RStudio/PositCRAN: mFilterUsado para filtragem Hodrick-Prescott; função hpfilter com freq = 100
Multi-channel hand grip strength test systemZhejiang Changxian Co. Ltd. TekscanSistema de luva de 24 sensores para aquisição de dados de força mecânica a uma taxa de amostragem de 100 Hz
neuralnet (R package)RStudio/PositCRAN: neuralnetUsado para treinar o modelo de rede neural de backpropagation (BP) de linha de base
NVIDIA GeForce RTX 3060 GPUNVIDIA CorporationRTX 3060 (12 GB VRAM)GPU para treinamento acelerado de rede neural
Personal computer (Intel Core i7-12700, 32 GB RAM)Intel Corporationi7-12700Workstation rodando Windows 11 para todos os experimentos computacionais
Python (scikit-learn)Python Software Foundationscikit-learn 1.2Implementação RandomForestRegressor para o modelo de linha de base da floresta aleatória
R statistical softwareR Core TeamVersão 4.2Ambiente principal de computação estatística para pré-processamento de dados, modelagem e visualização
randomForest (R package)RStudio/PositCRAN: randomForestImplementação alternativa de floresta aleatória em R
TensorFlowGoogle LLCVersão 2.10Framework de aprendizagem profunda de backend para treinamento de rede LSTM

Reimpressões e permissões

Solicitar permissão para reutilizar o texto ou as figuras deste artigo JoVE

Solicitar permissão

Etiquetas

Modelagem LSTMOsteopatia Chinesa MongolaOtimiza o AdamPredi o de Informa es Mec nicasAn lise de Dados SequenciaisRedu o de DimensionalidadeProcesso de Exer o de For a
Vídeo em breve

Artigos relacionados