Forschungsartikel

Langzeit-Kurzzeitgedächtnismodellierung der chinesischen traditionellen mongolischen Osteopathie-Walzmethode mit Adam und dem Hodrick-Prescott-Filter

DOI:

10.3791/70938

12. Juni 2026

In diesem Artikel

Zusammenfassung

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Diese Studie schlägt ein zweistufiges Langzeitgedächtnismodell vor, das mit Hodrick-Prescott-Filterung integriert ist, um mechanische Informationen in der traditionellen Chinesischen Mongolischen Osteopathie genau vorherzusagen und dabei eine hohe Genauigkeit bei experimentellen Kraftanstrengungsdaten zu erzielen.

Zusammenfassung

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Die Erfassung und Vorhersage mechanischer Informationen war wichtig für die Digitalisierung der chinesischen traditionellen Mongolischen Osteopathie. Die Gewinnung periodischer und trendorientierter mechanischer Informationen aus dem Kraftausübungsprozess stellte eine erhebliche Herausforderung bei der präzisen mechanischen Informationsvorhersage dar. Um dieser Herausforderung zu begegnen, führte dieser Artikel ein doppelschichtiges Long Short-Term Memory (LSTM)-Netzwerk ein, das mit Hodrick-Prescott (HP)-Filterung integriert ist und HP-Filtertechniken mit LSTM kombiniert, um die Genauigkeit der mechanischen Informationsvorhersage zu verbessern. Diese Forschung basierte auf experimentell gesammelten Daten zur mechanischen Informationsanalyse, bei der die Dimensionsreduktion auf den gesammelten Daten basierend auf den primären Gelenken bei der Kraftanwendung durchgeführt wurde. Konkret wurden drei Sensordatenpunkte aus insgesamt 24 als zentrale Eingabefunktionen ausgewählt. LSTM wurde eingesetzt, um langfristige Abhängigkeiten in sequentiellen Daten zu erfassen. In dieser Untersuchung wurde der Adam-Optimierungsalgorithmus verwendet, um die Hyperparameter des Modells zu feinjustieren und so eine optimale Leistung zu gewährleisten. Die experimentellen Ergebnisse unterstrichen die Wirksamkeit der vorgeschlagenen Methodik, was sich in einem Bestimmungskoeffizienten (R2) von 0,897, einem mittleren absoluten Fehler von 0,025 und einem Wurzel-Mittel-Quadrat-Fehler von 0,031 zeigt. Eine vergleichende Analyse mit alternativen Schätzmethoden bestätigte zudem die Stabilität, Genauigkeit und Verallgemeinerungsmöglichkeiten des zweischichtigen LSTM-Netzwerks, ergänzt durch HP-Filterung.

Einleitung

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Die chinesische traditionelle mongolische Osteopathie, auch bekannt als chinesische traditionelle mongolische Noharahu-Therapie, ist ein manueller therapeutischer Ansatz, bei dem der Praktizierende verschiedene manipulative Techniken auf bestimmte Körperteile anwendet, um mechanische Quantifizierung und Fertigkeitsstandardisierung zu ermöglichen, und sie wird klinisch zur Bruchreduktion angewendet. Als typische Mikrogestenmanipulation zeigte Agora1 , dass die Kraftanwendung der mongolischen Noharahu-Therapie sich deutlich von der der traditionellen chinesischen Medizin (TCM) unterscheidet. In China wurde die mongolische Osteopathie als Teil der traditionellen Medizin anerkannt, und die Osteopathieausbildung wurde in den Schutz des immateriellen Kulturerbes und in Vollzeitstudiengänge integriert. Laut Yao et al.2 umfassen die charakteristischen Merkmale osteopathischer Manipulation sowohl kinematische als auch mechanische Eigenschaften. Kinematische Merkmale beziehen sich auf die morphologischen Aspekte manipulativer Bewegungen, wie die operativen Wesentlichkeiten von Schwingtechniken – "Schultern absenken, Ellbogen senken und Handgelenke aufhängen." Mechanische Eigenschaften beziehen sich im Kontext dieser Studie speziell auf die Zeitreihenwellenform der angelegten Kraft, einschließlich Kraftstärke, Frequenz, Amplitude, Geschwindigkeit und deren dynamischer Variationsmuster, die zusammen die grundlegenden Anforderungen einer "anhaltenden, kraftvollen, gleichmäßigen und sanften" Kraftanwendungbilden 3.

Die mechanischen Eigenschaften der osteopathischen Manipulation sind von Natur aus komplex und stammen aus der integrierten Kraftausübung mehrerer Gelenke, die hohe Anforderungen an die koordinierte Krafterzeugung und die entsprechenden Fähigkeiten der Schultern, Ellbogen, Handgelenke, unteren Extremitäten, Lendenwirbelsäule und Rücken des Praktizierenden stellt. Beim Lehren und Training in osteopathischer Manipulation haben Dozenten oft Schwierigkeiten, die Eigenschaften und wissenschaftlichen Grundlagen der Techniken allein mit beschreibender Terminologie zu vermitteln. Ebenso fällt es den Schülern schwer, die Feinheiten und Feinheiten der Manipulationen vollständig zu erfassen und innerhalb kurzer Zeit Kompetenz zu erreichen. Um diese Einschränkung zu beheben, hat die Forschung zu den Eigenschaften osteopathischer Manipulation verschiedene fortschrittliche Sensortechnologien genutzt, um die Merkmalsparameter der Techniken zu messen und zu quantifizieren. Durch systematische Datenanalyse validiert diese Forschung klinische Erfahrung, deckt die inhärenten biomechanischen Prinzipien der Techniken auf und übersetzt letztlich die Ergebnisse in pädagogische Anwendungen, wodurch die Studierenden ein tieferes Verständnis der Prinzipien manipulativer Operationen entwickeln können. Die Forschung speziell zur mongolischen Osteopathie bleibt jedoch im Vergleich zu den umfangreicher untersuchten TCM-Tuina-Techniken begrenzt, und die Standardisierung der Ausbildungsprotokolle für die mongolische Osteopathie befindet sich noch in einem frühen Stadium. Ellwood und Carnes4 zeigten, dass die Anwendung von Computertechnologie zur Sammlung mechanischer Informationen von Experten und zur Extraktion von Manipulationsmerkmalen eine objektive Referenz für die Standardisierung und standardisierte Anwendung der traditionellen Osteopathie bieten kann.

Jüngste Fortschritte bei flexiblen Kraftsensortechnologien haben neue Möglichkeiten für die objektive Messung und Quantifizierung traditioneller Manipulationstechniken geschaffen. Neuartige, flexible sechsachsige Kraft-/Drehmomentsensoren, kalibriert mit tiefen neuronalen Netzen, haben Messfehler unter 0,751 % im vollen Maßstab erreicht und wurden erfolgreich in Anwendungen der Massagephysiotherapiedemonstriert 5. Ähnlich haben optisch-taktile hybride Sensorsysteme die gleichzeitige Erfassung von Kraft-/Drehmomentdaten über sechs Achsen und die anatomische Kontaktstellen-Identifikation ermöglicht, wobei R2 ≥ 0,87 für die Kraftschätzung und eine Genauigkeit von über 97 % bei der Manövererkennung6 erreicht wurden. Diese technologischen Entwicklungen bilden die Grundlage für die präzise Erfassung mechanischer Informationen in der osteopathischen Manipulationsforschung. Daher besteht die Notwendigkeit, die wissenschaftliche Modellierung und systematische Wissensübertragung in der Mongolischen Osteopathie durch die Integration moderner Sensor- und Computermethoden voranzutreiben.

Deep Learning hat die Zeitreihenprognose revolutioniert und traditionelle statistische Methoden bei der Modellierung komplexer nichtlinearer Dynamiken und langfristiger Abhängigkeiten, wie sie in realen zeitlichen Daten vorkommen, übertroffen 7,8. Unter den Deep-Learning-Architekturen haben sich Long Short-Term Memory (LSTM)-Netzwerke als besonders effektive Werkzeuge zur Erfassung zeitlicher Abhängigkeiten in sequentiellen Daten etabliert und wurden in verschiedenen Bereichen wie Finanzen, Gesundheitswesen, Energiemanagement und Klimamodellierungweit verbreitet eingesetzt. Eine umfassende Übersicht von über 150 Studien zeigte, dass LSTM-basierte Ansätze, insbesondere solche, die mit dem Adam-Optimierer verbessert wurden, die Prognosegenauigkeit um bis zu 14 % im Vergleich zu traditionellen Methodenverbessern 9. Im Bereich der Kraftvorhersage speziell führten Zhang et al.10 einen LSTM-basierten RNN-Ansatz zur Echtzeit-Vorhersage von Anregungskräften in der Steuerung von Wellenenergiekonvertern ein. Li et al.7 illustrierten ein Encoder-Decoder-Bi-LSTM mit Teacher Forcing für die kurzfristige Vorhersage von Schiffsrollbewegungen. Zhu et al.8 nutzten ein auf Transferlernen basierendes Residual-LSTM mit zeitlicher Musteraufmerksamkeit für die Rad-Schiene-Kraftinversion.

Die Hauptbeiträge dieser Studie sind wie folgt:
Ein neuartiges hybrides Modellierungsframework, das Hodrick–Prescott-Filterung mit einer doppelschichtigen LSTM-Architektur kombiniert und speziell darauf ausgelegt ist, Kraftanstrengungsmuster in der mongolischen Osteopathie-Walzmethode vorherzusagen.
Eine umfassende vergleichende Bewertung des vorgeschlagenen Modells anhand mehrerer Baseline-Architekturen, einschließlich einschichtiger LSTM, Nicht-HP-Varianten, PCA-LSTM, BP-neuronalem Netzwerk und Random Forest, zeigt die Überlegenheit des HP-verbesserten zweischichtigen LSTM zur Vorhersage von nichtstationären Kraftsignalen.
Empirische Validierung unter Verwendung experimentell gesammelter mechanischer Sensordaten, die eine reproduzierbare Methodik und Benchmark-Ergebnisse für die Digitalisierung traditioneller osteopathischer Manipulationstechniken liefert.

Verwandte Werke
Im Kontext der traditionellen therapeutischen Manipulationsdigitalisierung werden neuronale Netze zunehmend zur Merkmaleextraktion und zur Klassifikation von Kraftmustern eingesetzt. Li et al.6 und Lu et al.11 schlugen mechanische Methoden zur Vorhersage von Informationssequenzen auf Basis von LSTM für tragbare Massageroboter vor. Lv et al.12 entwickelten einen iterativen Optimierungsansatz, der BP-neuronale Netzwerke mit genetischen Algorithmen für Akupunktur-Koordinatenvorhersage und Verhaltensplanung in TCM-Massagerobotern kombiniert. Midea Group Co. Ltd.13 patentierte einen Massageroboter mit maschinellem Blick, während Moll et al.14 und Mo et al.15 die Verwendung von konvolutionalen neuronalen Netzwerken zur Klassifikation spezifischer Bewegungsinformationen demonstrierten. Sayapin16 schlug ein sensorbasiertes neuronales Netzwerk vor, um mechanische Indikatoren aus Handbewegungen zu sammeln und zu identifizieren. Basierend auf dem Entwicklungsstand des Vereinigten Königreichs17 und Deutschlands18 könnte die Digitalisierung der Mongolischen Osteopathie für Bildungszwecke von großer Bedeutung sein. Allerdings hat keine dieser Studien speziell die einzigartigen Kraftanwendungsmuster der Mongolischen Osteopathie-Walzmethode behandelt.

Hybride Ansätze, die Signalzerlegung mit Deep Learning kombinieren, haben erhebliche Verbesserungen bei der Prognosegenauigkeit für nichtstationäre Zeitreihen gezeigt. Der Hodrick-Prescott-(HP)-Filter, ursprünglich für die wirtschaftliche Zeitreihenanalyse vorgeschlagen, zerlegt ein Signal in seinen Bestandstrend und zyklische Komponenten19. Jüngste Studien haben HP-Dekomposition erfolgreich in Verbindung mit neuronalen Netzen in verschiedenen Bereichen angewendet. Ein Hybridmodell, das HP-Filterung mit RNNs und ARIMA kombiniert, erreichte Reduktionen bei MAPE, RMSE und MAE von 9,70 % bis 56,23 % im Vergleich zu eigenständigen neuronalen Netzen für die Strombedarfsprognose20. In der Inflationsprognose wurde festgestellt, dass HP-Filterung Rauschen am effizientesten eliminiert und zyklische Dynamiken betont, sodass Ensemblemodelle R2 > 0,99 erreichen und neuronale Netze R2 > 0,9321 erreichen. Ähnlich wurde HP-Filter-basierte Zerlegung kombiniert mit flipper-verlustgesteuertem LSTM erfolgreich auf probabilistische Gitter-Kohlenstoffintensitätsvorhersage angewandt4. Durch die Analyse der Muster, die in diesen unterschiedlichen Komponenten22,23 innewohnen, werden verschiedene Datenvorhersagetechniken angewandt, um die Komponenten Trend24 und Schwankung25,26 separat vorherzusagen, woraufhin diese Prognosen kombiniert werden, um die endgültigen Vorhersageergebnisse27 zu erhalten. Ähnliche, dekompositionsverstärkte LSTM-Strategien haben auch in anderen nichtstationären Zeitreihenbereichen, wie der Finanzprognose28, Wirksamkeit gezeigt.

Trotz dieser Fortschritte in der LSTM-basierten Zeitreihenvorhersage und der nachgewiesenen Wirksamkeit der HP-Filterung als Vorverarbeitungstechnik hat nach unserem besten Wissen keine vorherige Studie HP-Filterung mit einer mehrschichtigen LSTM-Architektur speziell für die Vorhersage von Kraftanwendungsmustern bei traditionellen osteopathischen Manipulationen integriert – insbesondere im Kontext der chinesischen traditionellen Mongolischen Osteopathie-Rolling-Methode. wobei die nichtstationären Eigenschaften der Kraftausübung einzigartige Modellierungsherausforderungen darstellen. Die vorliegende Studie schließt diese Lücke, indem sie ein doppelschichtiges LSTM-Modell mit HP-Filterung einführt, das auf experimentell gesammelten Kraftdaten eines erfahrenen Praktikers validiert wird.

Zugriff eingeschränkt. Bitte melden Sie sich an oder starten Sie eine Testversion, um diesen Inhalt anzuzeigen.

Protokoll

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

LSTM-Netzwerke
Ein rekurrentes neuronales Netzwerk (RNN) war eine Art neuronales Netzwerk, das den Wert im nächsten Zeitschritt anhand der vorherigen Beobachtungen in einer Zeitreihe vorhersagen konnte. RNNs verarbeiteten jeweils eine Beobachtung aus einer Zeitreihe und speicherten historische Informationen aus der Zeitreihe, indem sie kontinuierlich einen "Zustandsvektor" in der verborgenen Schicht anpassten. Obwohl das Ziel der RNNs darin bestand, historische Informationen in Zeitreihen zu erlernen, waren RNNs aufgrund des Gradienten-Null-Problems bei der Verwendung des Backpropagation-Algorithmus nicht für die Verarbeitung längerer Zeitreihen geeignet. Das Long Short-Term Memory (LSTM)-Netzwerk ist eine Variante von RNN, die das Gradientenverschwindungsproblem während des Trainings adressiert und es in der Lage macht, längere Zeitreihen zu verarbeiten. Im Vergleich zu Standard-RNNs verfügen LSTMs über drei zusätzliche Gate-Steuereinheiten: das Eingangsgatter, das Vergessengatter und das Ausgangsgatter. Abbildung 1 zeigt die grundlegende Struktur des LSTM und seines Kernarchitekturrahmens, der aus fünf wesentlichen Komponenten besteht: drei sigmoiden Aktivierungsfunktionen und zwei hyperbolischen Tangential- (tanh)-Aktivierungsfunktionen. Bemerkenswert war, dass die links positionierte Sigma-Funktion eine zentrale Rolle bei der Regulierung der Informationsübertragung aus dem vorangegangenen Zeitschritt übernimmt und die Funktionen der Filterung und Verfeinerung der Informationen zur Unterstützung dieses regulatorischen Prozesses erfüllt, wie in der folgenden Gleichung erläutert:

Gleichung 1(1)

Abbildung 1
Abbildung 1. Fundamentale Struktur des LSTM-Netzwerks. Bitte klicken Sie hier, um eine größere Version dieser Abbildung anzusehen.

wobei das Vergessengatter als "ft" wirkte, die Eingabesequenzen als "xt" und "ht-1" die vor dem Ausgang der Einheit verborgene Information darstellt. Das Vergessengatter war dafür verantwortlich zu bestimmen, welche Informationen verworfen oder behalten werden sollten, das Eingangsgatter konnte den Zustand der Speichereinheit aktualisieren und das Ausgangsgatter konnte den Wert des nachfolgenden versteckten Zustands bestimmen. Diese drei Tore werden als ft, it und ot bezeichnet.

Gleichung 7(2)

Gleichung 8(3)

Gleichung 9(4)

Gleichung 10(5)

Gleichung 11(6)

Gleichung (3) definiert den Kandidatenzellzustand C, der durch die Tanh-Funktion erzeugt wird, welche neue Werte vorschlägt, die dem Zellzustand hinzugefügt werden sollen. Konkret wurde die Eingabe des Modells formuliert, indem die Ausgaben zweier sigmoider Funktionen mit denen der anfänglichen Tanh-Funktion integriert wurden, wie in Gleichung (5) dargestellt.

Gleichung (4) charakterisiert die rechte Sigmoid-Funktion als Anfangsausgabewert des Modells, die anschließend über die hyperbolische Tangentialfunktion (tanh) auf das Intervall [−1, 1] abgebildet wurde. Anschließend werden sowohl der resultierende Wert der Tanh-Funktion als auch die Ausgabe der sigmoidischen Funktion in ihre jeweiligen tatsächlichen Ausgabewerte umgewandelt, wie in Gleichung (6) veranschaulicht.

Im LSTM regulierte die sigmoidische Funktion die aktuellen Informationen, während die hyperbolische Tangentialfunktion (tanh) für die Verarbeitung historischer Informationen verantwortlich sein könnte. Die Integration dieser beiden Funktionen verleiht den LSTMs ihre prädiktive Stärke. Im Vergleich zu herkömmlichen RNNs liegt der Vorteil von LSTMs in ihrer ausgefeilten Architektur, die in der Lage ist, den gesamten Eingabespeicher bis zum Zeitpunkt t+1 abzufangen. Die Integrität dieses Speichers wird durch den durch die Sigmoid-Funktion erleichterten Sperrmechanismus bewahrt, wodurch sichergestellt wird, dass kritische Informationen über längere Zeiträume erhalten bleiben.

HP-Filter
Der Hodrick-Prescott-Filter (HP-Filter), der 1980 von Hodrick und Prescott vorgeschlagen wurde, wurde in der ökonomischen Analyse und zeitreihenbezogenen Analysen weit verbreitet eingesetzt. Der HP-Filter geht davon aus, dass der zu analysierende Datensatz eine Kombination aus langfristigen Veränderungen und kurzfristigen Schwankungen war, wobei die Zeitreihe Y={y1, y2, ⋯, yT} in zwei Unterreihen zerlegt wird: die langfristige Trendreihe G={g1, g2, ⋯, gT} und die kurzfristige Fluktuationsreihe S={s1, s2, ⋯, sT}. Die langfristige Trendreihe gT, wobei t=1,2,⋯,T ist, wird durch Minimierung folgender Ausdruck abgeleitet:

Gleichung 13(7)

Dabei steht T für die Anzahl der Stichproben in der Zeitreihe yty, und λ ist größer als 0, bekannt als der Glättungsparameter, der die Gewichte der Terme Gleichung 14 und Gleichung 15angibt. Wenn λ=0, ist die langfristige Trendreihe G, die das Minimierungsproblem erfüllt, gleich der ursprünglichen Reihe Y. Mit steigendem Wert von λ nimmt die Gesamtzahl der Änderungen in der langfristigen Trendreihe im Vergleich zu denen der ursprünglichen Reihe ab, was bedeutet, dass eine größere λ zu einer glatteren langfristigen Trendreihe führt. Wenn λ sich dem Unendlichen nähert, ähnelt die langfristige Trendreihe einer linearen Funktion. Die kurzfristige Fluktuationsreihe kann erhalten werden, indem man die langfristige Trendreihe von der ursprünglichen Zeitreihe subtrahiert, d. h. S=Y-G.

Vor der Anwendung des HP-Filters war es unerlässlich, einen geeigneten Glättungsparameter λ auszuwählen, da verschiedene Glättungsparameter unterschiedliche langfristige Trends und kurzfristige Schwankungen bestimmen. Gemäß früheren verwandten Studien ist der Wert von λ in dieser Studie auf 100 gesetzt.

Teilnehmervorbereitung und ethische Anerkennung
Die ethische Genehmigung wurde vom Ethischen Überprüfungsausschuss der Inneren Mongolei Medizinischen Universität eingeholt (Nr. YKD202001041) vor jeglicher Datenerhebung. Ein hauptamtlicher Forscher vom College of Mongolian Medicine der Inneren Mongolei Medical University, der sich mit der chinesischen traditionellen Mongolischen Osteopathie (CTMO) auskennt, wurde eingestellt. Eine schriftliche informierte Zustimmung wurde vom Teilnehmer eingeholt. Alle Verfahren folgten den Grundsätzen der Erklärung von Helsinki.

Ausrüstungsaufbau und Kalibrierung
Ein mehrkanaliges Handgriff-Festigkeitstestsystem mit 24 mechanischen Sensoren wurde verwendet, um mechanische Parameter der CTMO-Walzmethode zu erfassen (siehe Abbildung 2 und Abbildung 3 für Systemlayout und Sensorpositionierung). Alle 24 Kraftsensoren wurden gemäß den Anweisungen des Herstellers kalibriert. Die Datenerfassungssoftware war so konfiguriert, dass sie Daten mit einer Abtastfrequenz von 100 Hz aufzeichnete und Echtzeitkraftmessungen in Newtons (N) darstellte. Die Aufzeichnungsdauer wurde pro Versuch auf 60 Sekunden festgelegt.

Abbildung 2
Abbildung 2. Mehrkanal-Handgriff-Testsystem. Bitte klicken Sie hier, um eine größere Version dieser Abbildung anzusehen.

Abbildung 3
Abbildung 3. Massage-Manipulationsaufnahme-Schnittstelle basiert auf dem Multi-Channel-Griffkrafttestsystem. Bitte klicken Sie hier, um eine größere Version dieser Abbildung anzusehen.

Datenerfassung
Der Teilnehmer wurde angewiesen, den instrumentierten Handschuh anzuziehen und die übliche Startposition einzunehmen. Das Modell des künstlichen menschlichen Unterarms wurde auf einer stabilen, horizontalen Fläche vor dem Teilnehmer platziert. Beim Start der Datenerfassungssoftware führte der Teilnehmer die CTMO-Rollmanipulation kontinuierlich auf dem vorgesehenen Bereich des Unterarmmodells für 1 Minute durch. Die Rohdatendatei wurde in einem strukturierten Format (z. B. .csv oder .txt) gespeichert, das Zeitstempel und Kraftmessungen aller 24 Sensoren enthielt. Dieses Verfahren wurde wiederholt, bis insgesamt 150 unabhängige Studien abgeschlossen waren. Der Teilnehmer ruhte sich mindestens 30 Sekunden zwischen den Studien aus, um die durch Ermüdung verursachte Variabilität zu minimieren. R (Version 4.2) wurde anschließend verwendet, um Bewegungsregeln und Gelenkbewegungswinkel zu berechnen und die Betriebseigenschaften der Technik zusammenzufassen.

Sensorauswahl mittels Merkmalsvisualisierung
Die Rohkraftdaten aller 24 Sensoren über alle Versuche hinweg wurden in R geladen. Die mittlere Kraftstärke und Varianz für jeden Sensor wurden über den gesamten Datensatz berechnet. Ein Blasenfüllungsdiagramm wurde mit dem ggplot2-Paket in R erstellt, um den relativen Beitrag jeder Fingerphalanx/Metakarpal zur Gesamtkraftbelastung darzustellen. Basierend auf diesem Diagramm (Abbildung 4) zeigten die Sensoren 8 (proximale Phalanx des kleinen Fingers), 13 (Mittelfinger distale Phalanx) und 2 (distale Phalanx des Zeigefingers) die höchsten Kraftstärken und Variabilität und wurden daher als primäre Eingabemerkmale für die spätere Modellierung ausgewählt.

Abbildung 4
Abbildung 4. Blasenfüllungsdiagramm der Knöchel bei der Rollmethode. (1) proximale Phalanx des Zeigefingers; (2) distale Phalanx des Zeigefingers; (3) Mittelhandkarpal des Zeigefingers; (4) mittlere Phalanx des Zeigefingers; (5) proximale Phalanx des Ringfingers; (6) distale Phalanx des Ringfingers; (7) Ringfinger-Metakarpalphalanx; (8) Proximale Phalanx des kleinen Fingers; (9) distale Phalanx des kleinen Fingers; (10) Mittelhandknochen des kleinen Fingers; (11) mittlere Phalanx des kleinen Fingers; (12) proximale Phalanx des Mittelfingers; (13) Mittelfinger distale Phalanx; (14) Metakarpal des Mittelfingers; (15) mittlere Phalanx des Mittelfingers. Bitte klicken Sie hier, um eine größere Version dieser Abbildung anzusehen.

Datenvorverarbeitung für Zeitreihenmodellierung
Die Zeitreihen-Kraftdaten F8(t), F13(t) und F2(t) für die ausgewählten Sensoren wurden aus dem Rohdatensatz extrahiert. Eine normalisierte Zeitvariable T wurde erzeugt, indem die Aufzeichnungszeitstempel auf das Intervall [0'1] skaliert wurden. Folgende Formel wurde verwendet:

Gleichung 21

Wo t der ursprüngliche Zeitstempel in Sekunden war. Für jeden Versuch wurden die Kraftdaten und die normalisierte Zeit zu einem multivariaten Zeitreihendatensatz der Dimensionen N × 4 verkettet, wobei N die Anzahl der Zeitschritte (6.000 Schritte für einen 60-Sekunden-Versuch bei 100 Hz) war und die Spalten [T'F8'F 13'F 2] entsprachen.

Hodrick–Prescott (HP) Filterung
Der Hodrick–Prescott-Filter wurde unabhängig voneinander auf jedes der drei Kraftsignale F8, F13 und F2 angewendet. Der Glättungsparameter wurde auf λ = 100 gesetzt. Dieser Wert wurde basierend auf der ungefähr jährlichen/zyklischen Natur des langfristigen Krafttrends gewählt, der in den ersten 2.000 Datenpunkten beobachtet wurde (wie in Abbildung 5 dargestellt), und galt als geeignet zur Erhaltung biomechanischer Krafteigenschaften.

Abbildung 5
Abbildung 5. Vergleich der HP-Filtereffekte mit λ = 100 und λ = 10.000 auf den ersten 2.000 Datenpunkten von Sensor 8. Bitte klicken Sie hier, um eine größere Version dieser Abbildung anzusehen.

Implementierungshinweis: Die hpfilter-Funktion aus dem mFilter-Paket in R wurde mit dem Argument Freq = 100 verwendet.

Für jedes Sensorsignal wurden zwei Komponenten erhalten: die Trendkomponente G(t) und die zyklische Komponente C(t), wobei Gleichung 32. Die endgültige Eingabefeature-Matrix wurde durch Verkettung der normalisierten Zeit mit dem HP-gefilterten Trend und den zyklischen Komponenten der drei ausgewählten Sensoren konstruiert. Dies führte zu einem Datensatz mit N × 7 Dimensionen: Gleichung 34. Der Datensatz wurde chronologisch in Training (70 %), Validierungs- (15 %) und Test-Teilmengen (15 %) unterteilt. Kritisch: Ein zufälliges Mischen der Zeitreihen wurde vermieden, um zeitliche Leckage zu verhindern. Das Testset enthielt die letzten 15 % der aufgezeichneten Zeitsequenz.

Bau des zweischichtigen LSTM-Modells mit HP-Filterung
Die Rechenumgebung wurde mit TensorFlow (Version 2.10) und der Keras-API in R eingerichtet. Die neuronale Netzarchitektur wurde wie folgt definiert:
Eingabeschicht: Form = (Sequenzlänge'7), wobei sequence_length die Anzahl der Zeitschritte pro Eingangsprobe war (es wurden 100 Schritte verwendet).
Erste LSTM-Schicht: Einheiten = 50, return_sequences = WAHR. Die Tanh-Aktivierungsfunktion wurde für den wiederkehrenden Schritt verwendet, und das Sigmaid für die Gate-Aktivierungen.
Zweite LSTM-Schicht: Einheiten = 50, return_sequences = FALSCH.
Vollständig zusammenhängende (dichte) Schicht: Einheiten = 1 (zur Vorhersage von univariaten Kräften). Der vollständige Arbeitsablauf des Doppelschicht-LSTM-Modells mit HP-Filterung, von der Datenvorverarbeitung bis zur endgültigen Vorhersage, ist in Abbildung 6 dargestellt. Das Ausgangsziel war der Kraftwert am Sensor 8 im nächsten Zeitschritt (Ein-Schritt-voraus-Vorhersage).

Abbildung 6
Abbildung 6. Doppelschichtige LSTM-Anwendungs-Workflow-Grafik. Bitte klicken Sie hier, um eine größere Version dieser Abbildung anzusehen.

Das Modell wurde mit dem Adam-Optimierungsalgorithmus mit folgenden Hyperparametern kompiliert: Lernrate: 0,001; Zerfallsrate: 0,001; Verlustfunktion: Mittlerer quadratierter Fehler (MSE). Das Modell wurde über 20 Epochen trainiert, mit einer Chargengröße von 32. Early Stopping wurde mit einer Geduld von 5 Epochen implementiert, um den Validierungsverlust zu überwachen, um Überanpassungen zu verhindern. Eine Abbruchrate von 0,2 wurde zwischen den LSTM-Schichten zur Regularisierung angewendet. Die Trainingsdaten wurden nur auf Batch-Ebene innerhalb jeder Epoche – nicht in der sequentiellen Reihenfolge – gemischt, um zeitliche Kohärenz aufrechtzuerhalten, während Stochastizität für den Gradientenabstieg eingeführt wurde.

Konfiguration des Testdatensatzes
Um die prädiktive Leistung der vorgeschlagenen Modelle zu bewerten, wurde der vorverarbeitete Datensatz chronologisch in drei Teilmengen unterteilt: Training (70 %), Validierung (15 %) und Test (15 %). Die chronologische Aufteilung sorgte dafür, dass keine zukünftigen Informationen in den Ausbildungsprozess durchsickerten. Der Testsatz bestand aus den letzten 2.000 Zeitschritten × 3 Sensoren = 6.000 Datenpunkten der aufgezeichneten Sequenz, was etwa 20 Sekunden kontinuierlicher Kraftausübungsdaten bei der ursprünglichen Abtastrate von 100 Hz entspricht. Zur Bewertung längerdaueriger Vorhersagefähigkeiten wurde eine verlängerte Testsequenz von 1.200 Sekunden (120.000 Zeitschritte) konstruiert, indem 20 aufeinanderfolgende 60-Sekunden-Versuche chronologisch angeordnet wurden, wobei die zeitliche Ordnung erhalten blieb. Die Kraftkontinuität zwischen den verketteten Versuchen wurde überprüft, um keine abrupten Übergänge zu gewährleisten.

Leistungskennzahlen
Drei Standard-Regressionsmetriken wurden berechnet, um die Vorhersagegenauigkeit zu quantifizieren:

Bestimmungskoeffizient (R2): Definiert als Gleichung 37, wobei yi bzw Gleichung 39. den tatsächlichen und den vorhergesagten Kraftwert bezeichnen, und Gleichung 40 der Mittelwert der tatsächlichen Werte ist. R2 misst den Anteil der Varianz in den vom Modell erklärten Kraftdaten.

Mittlerer absoluter Fehler (MAE): Definiert als Gleichung 41. MAE liefert die durchschnittliche Magnitude der Vorhersagefehler in Einheiten von Newton (N).

Root Mean Square Error (RMSE): Definiert als Gleichung 42. RMSE ist empfindlich gegenüber großen Fehlerabweichungen und wird in Newton (N) angegeben.

Alle Metriken wurden auf dem unsichtbaren Testsatz berechnet, nachdem alle Normalisierungs- oder Skalierungstransformationen, die während der Vorverarbeitung angewendet wurden, rückgängig gemacht wurden.

Vergleichende Basismodelle
Um das vorgeschlagene zweischichtige LSTM mit Hodrick–Prescott (HP)-Filterung zu vergleichen, wurden folgende alternative Modelle unter identischen Trainings-, Validierungs- und Testsplits implementiert und evaluiert. Hyperparameter für alle neuronalen Netzwerkmodelle wurden mithilfe des Validierungssets optimiert, um einen fairen Vergleich sicherzustellen.

Einschichtiges LSTM ohne HP-Filterung
Architektur: Eine einzelne LSTM-Schicht mit 50 versteckten Einheiten, gefolgt von einer vollständig verbundenen dichten Schicht mit einem einzelnen Ausgangsneuron.
Eingabefunktionen: Rohkraftdaten von den Sensoren 8, 13 und 2 sowie normalisierte Zeit (4-dimensionale Eingabe).
Training: Adam-Optimierer mit Lernrate = 0,001, Verfall = 0,001, Batchgröße = 32, trainierte für 20 Epochen mit frühzeitigem Stoppen (Geduld = 5) überwachte Validierungsverlust.

Doppelschichtiges LSTM ohne HP-Filterung
Architektur: Zwei gestapelte LSTM-Schichten, jede mit 50 versteckten Einheiten. Die erste LSTM-Schicht gab vollständige Sequenzen zurück, und die zweite LSTM-Schicht gab nur den finalen versteckten Zustand zurück. Es folgte eine dichte Ausgangsschicht mit einem Neuron.
Eingabefunktionen: Wie oben (vierdimensionale rohe Krafteingaben).
Trainingsparameter: Identisch mit der einschichtigen LSTM-Konfiguration.

Einschichtiges LSTM mit HP-Filterung
Architektur: Eine einzelne LSTM-Schicht mit 50 versteckten Einheiten, gefolgt von einer dichten Ausgangsschicht.
Eingabefunktionen: HP-dekomponierter Trend und zyklische Komponenten für die Sensoren 8, 13 und 2 sowie normalisierte Zeit T (7-dimensionale Eingabe, wie im Protokoll beschrieben).
Trainingsparameter: Gleich wie oben.

PCA-LSTM
Dimensionsreduktion: Die Hauptkomponentenanalyse (PCA) wurde auf die 7-dimensionale, HP-gefilterte Merkmalsmatrix angewandt, um drei Hauptkomponenten zu extrahieren, die zusammen >95 % der Varianz im Merkmalssatz erklärten.
Architektur: Eine einzelne LSTM-Schicht mit 50 versteckten Einheiten, die die drei Hauptkomponenten-Zeitreihen als Eingabe einnimmt.
Trainingsparameter: Gleich wie oben.

Backpropagation (BP) neuronales Netzwerk
Architektur: Ein Feedforward-neuronales Netzwerk mit einer versteckten Schicht mit 64 Neuronen und ReLU-Aktivierung. Die Ausgangsschicht enthielt ein einzelnes lineares Neuron.
Eingabedarstellung: Die Zeitreihendaten wurden in Merkmalsvektoren fester Länge abgeflacht (100 Zeitschritte × 7 Merkmale = 700 Eingabedimensionen).
Training: Adam-Optimierer mit Lernrate = 0,001, mittlerer quadratischer Fehlerverlust, trainiert für 100 Epochen mit einer Batch-Größe von 64. Frühes Stoppen mit Geduld = 10 wurde angewendet.

Random Forest Regressor
Algorithmus: Ensemble von 100 Entscheidungsbäumen mit einer maximalen Tiefe von 10 und minimalen Stichproben pro Split, gesetzt auf 5.
Eingabedarstellung: Die gleichen abgeflachten Merkmalsvektoren wie für das BP-Neuralnetz (700-dimensionaler Eingang).
Implementierung: Der RandomForestRegressor aus der scikit-learn-Bibliothek (Version 1.2) wurde mit Standard-Hyperparametern verwendet, außer in den oben genannten Fällen.

Statistische Überlegungen
Um die Robustheit der prädiktiven Leistung zu bewerten, wurde jede Modellkonfiguration fünfmal trainiert und mit unterschiedlichen zufälligen Initialisierungen (sofern zutreffend) ausgewertet. Die gemeldeten Kennzahlen stellen die Mittelwerte über die fünf Durchläufe hinweg dar, begleitet von der Standardabweichung zur Quantifizierung der Variabilität. Es wurde keine Kreuzvalidierung auf die Zeitreihen angewendet, um die zeitliche Ordnung zu bewahren; stattdessen wurde der feste chronologische Validierungssatz für die Hyperparameter-Abstimmung verwendet.

Zugriff eingeschränkt. Bitte melden Sie sich an oder starten Sie eine Testversion, um diesen Inhalt anzuzeigen.

Ergebnisse

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Die Leistung des Primärmodells wurde anhand der Testset-Metriken bewertet. Ein hoherR2-Wert (0,897) und ein niedriger MAE/RMSE zeigten, dass das zweischichtige LSTM mit HP-Filterung die Kraftdynamik der CTMO-Rolling-Methode erfolgreich erfasste. Der Vergleich mit den Basismodellen zeigte, dass die HP-gefilterten Modelle die nicht-gefilterten Modelle übertrafen, was den Vorteil unterstützt, Trend- und zyklische Komponenten für das LSTM-Lernen zu trennen. Auch die Leistungskennzahlen des Modells verbesserten sic...

Zugriff eingeschränkt. Bitte melden Sie sich an oder starten Sie eine Testversion, um diesen Inhalt anzuzeigen.

Diskussion

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Die Ergebnisse zeigen, dass die Integration einer zweischichtigen Langzeitgedächtnisarchitektur mit Hodrick–Prescott-Filterung die Vorhersage der Kraftanwendung in der chinesischen traditionellen mongolischen Osteopathie-Rolling-Methode erheblich verbessert. Im Vergleich zu einschichtigen und ungefilterten LSTM-Modellen erfasste das vorgeschlagene kombinierte Modell sowohl langfristige zeitliche Abhängigkeiten als auch zugrunde liegende Trendkomponenten in Kraftsignalen effektiver, was z...

Zugriff eingeschränkt. Bitte melden Sie sich an oder starten Sie eine Testversion, um diesen Inhalt anzuzeigen.

Offenlegungen

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Die Autoren haben keine Interessenkonflikte zu erklären.

Danksagungen

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Dieses Papier wurde von der National Natural Science Foundation of China (10561151) unterstützt.

Zugriff eingeschränkt. Bitte melden Sie sich an oder starten Sie eine Testversion, um diesen Inhalt anzuzeigen.

Materialien

Liste der in diesem Artikel verwendeten Materialien
NameUnternehmenKatalognummerKommentare
Artificial human forearm modelNicht spezifiziertNicht verfügbarStandard-Trainingsmodell, das als Empfängeroberfläche für Rollmanipulation verwendet wird
Keras (R-Paket)RStudio/PositCRAN: kerasDeep Learning API, die für die LSTM-Modellkonstruktion verwendet wird; Version 2.10
mFilter (R-Paket)RStudio/PositCRAN: mFilterVerwendet für Hodrick-Prescott-Filterung; Funktion hpfilter mit freq = 100
Mehrkanaliges HandgriffstärkentestsystemZhejiang Changxian Co. Ltd. Tekscan24-Sensor-Handschuhsystem für die Erfassung mechanischer Kraftdaten mit einer Abtastrate von 100 Hz
neuralnet (R-Paket)RStudio/PositCRAN: neuralnetVerwendet für das Training des Backpropagation (BP) neuronalen Netz-Basislinienmodells
NVIDIA GeForce RTX 3060 GPUNVIDIA CorporationRTX 3060 (12 GB VRAM)GPU für beschleunigte neuronale Netz-Trainings
Personal Computer (Intel Core i7-12700, 32 GB RAM)Intel Corporationi7-12700Workstation mit Windows 11 für alle Berechnungsexperimente
Python (scikit-learn)Python Software Foundationscikit-learn 1.2RandomForestRegressor-Implementierung für das Random Forest Basislinienmodell
R statistische SoftwareR Core TeamVersion 4.2Primäres statistisches Computing-Umfeld für Datenvorverarbeitung, Modellierung und Visualisierung
randomForest (R-Paket)RStudio/PositCRAN: randomForestAlternative Random-Forest-Implementierung in R
TensorFlowGoogle LLCVersion 2.10Backend-Deep-Learning-Framework für LSTM-Netzwerktraining

Nachdrucke und Genehmigungen

Genehmigung beantragen, um den Text oder die Abbildungen dieses JoVE-Artikels zu verwenden

Genehmigung beantragen

Schlagwörter

LSTM ModellierungChinesisch Mongolische OsteopathieAdam OptimierungVorhersage mechanischer InformationenSequenzdatenanalyseDimensionalit tsreduktionKraftaus bungs
Video demnächst verfügbar

Verwandte Artikel