$$\rightleftharpoonup{xx}$$
$$\longleftharp{xx}$$,
$$\longrightharp{xx}$$,
L’électroencéphalogramme (EEG) est un outil essentiel à la fois dans la recherche en neurosciences et dans la pratique clinique, offrant des informations précieuses sur l’activité électrique du cerveau. Les données EEG au repos, en particulier, sont largement utilisées pour étudier diverses affections neurologiques et psychiatriques, telles que les accidents vasculaires cérébraux, la fibromyalgie et la douleur neuropathique chronique. Malgré son application généralisée, l’analyse des données EEG nécessite un prétraitement rigoureux pour éliminer les artefacts et le bruit, garantissant ainsi l’intégrité et la fiabilité des résultats 1,2,3. Au fil des ans, l’EEG a été inestimable pour fournir des mesures non invasives et à haute résolution temporelle de l’activité cérébrale, ce qui le rend indispensable pour l’étude des processus dynamiques du cerveau 4,5. Cependant, les signaux EEG bruts sont souvent contaminés par une variété de sources de bruit qui peuvent obscurcir les signaux neuronaux d’intérêt, compliquant ainsi l’interprétation des données6.
Les signaux EEG sont très sensibles à la contamination par des sources telles que l’activité musculaire, les mouvements oculaires et les interférences électriques7. Ces artefacts peuvent obscurcir les signaux neuronaux, faisant du prétraitement une étape critique de l’analyse EEG. Ce processus implique généralement la conversion de format de fichier en plusieurs étapes, le sous-échantillonnage, le filtrage, le rejet d’artefacts, l’analyse indépendante des composants (ICA) et l’exclusion des composants liés au bruit 8,9. Chaque étape contribue à améliorer la qualité du signal et à s’assurer que les données reflètent fidèlement l’activité neuronale10. La complexité de ces processus nécessite l’utilisation d’algorithmes et d’outils logiciels sophistiqués pour garantir que le prétraitement est à la fois efficient et efficace11.
L’un des principaux défis du prétraitement des données EEG est la variabilité des données, qui peut différer considérablement entre les sujets et les sessions d’enregistrement10,12. Cette variabilité est due à des différences dans les caractéristiques physiologiques et anatomiques des sujets, ainsi qu’à des variations dans les conditions expérimentales et l’équipement utilisé. De plus, l’absence de protocoles de prétraitement normalisés peut entraîner des incohérences dans l’analyse et l’interprétation des données13,14. Bien que plusieurs pipelines et scripts de prétraitement soient disponibles, beaucoup d’entre eux sont soit adaptés à des ensembles de données spécifiques, soit manquent de documentation complète, ce qui les rend moins accessibles à l’ensemble de la communauté des chercheurs14. Des plateformes comme GitHub hébergent de nombreux scripts et plugins de prétraitement EEG, facilitant le partage et l’amélioration collaborative de ces outils15. Cependant, la nature fragmentée de ces ressources souligne la nécessité d’un pipeline de prétraitement modifiable robuste, efficace et standardisé qui peut être largement appliqué à différents ensembles de données et contextes de recherche16. Un tel pipeline permettrait non seulement d’améliorer la reproductibilité des études EEG, mais aussi de fournir une base sur laquelle la communauté des chercheurs pourrait s’appuyer et s’adapter à des besoins spécifiques17.
En plus d’EEGLAB, qui constitue la base de PIPEMAT-RS en raison de sa vaste base d’utilisateurs et de son intégration avec MATLAB, d’autres boîtes à outils de traitement EEG sont également largement utilisées sur le terrain. Par exemple, MNE-Python est une plate-forme open source basée sur Python qui offre des fonctionnalités avancées pour la localisation des sources, les analyses de l’espace des capteurs et l’intégration avec les flux de travail d’apprentissage automatique. FieldTrip, une boîte à outils basée sur MATLAB comme EEGLAB, est connue pour son environnement de script flexible et sa prise en charge complète des analyses temps-fréquence et de connectivité. Bien que ces plateformes offrent des alternatives puissantes, elles nécessitent généralement des courbes d’apprentissage plus abruptes et des compétences de programmation plus avancées. PIPEMAT-RS a été conçu pour faire le lien entre l’accessibilité et la transparence, en particulier pour les chercheurs à la recherche d’une solution modifiable et modulaire pour le prétraitement de l’EEG à l’état de repos à l’aide d’EEGLAB. Néanmoins, la structure conceptuelle de PIPEMAT-RS peut être adaptée à d’autres boîtes à outils si nécessaire, favorisant ainsi l’interopérabilité et la personnalisation dans différents environnements logiciels.
Plusieurs pipelines de prétraitement EEG automatisés ont été développés ces dernières années, tels que RELAX18, Automagic19, APP20 et PREP7. Ces pipelines intègrent des algorithmes avancés pour la suppression des artefacts et le nettoyage des données, utilisant souvent des stratégies basées sur l’ICA avec une transparence ou une personnalisation limitée pour les utilisateurs non experts. Par exemple, RELAX introduit une méthode de nettoyage ICA en plusieurs étapes qui améliore le rejet des artefacts, mais s’appuie sur des configurations complexes qui peuvent ne pas être facilement modifiables21. En revanche, PIPEMAT-RS est conçu pour fournir une alternative flexible, transparente et accessible sur le plan éducatif, permettant aux chercheurs de comprendre et d’ajuster manuellement chaque étape de prétraitement. Cette transparence permet à PIPEMAT-RS d’être utilisé à la fois comme outil de recherche et d’enseignement tout en conservant rigueur et reproductibilité. De plus, PIPEMAT-RS met l’accent sur la documentation, l’exécution modulaire et l’adaptabilité à travers les ensembles de données, des caractéristiques qui sont souvent sous-estimées ou absentes dans d’autres pipelines.
D’un point de vue économique, le développement et la mise en œuvre d’un pipeline de prétraitement standardisé et modifiable pour les données EEG peuvent avoir des impacts significatifs. Le marché mondial des appareils EEG était évalué à environ 1,2 milliard USD en 2020 et devrait croître à un taux de croissance annuel composé (TCAC) de 7,5 % de 2021 à 202822. Des pipelines de prétraitement efficaces, en particulier ceux qui sont modifiables et modulaires, peuvent réduire le temps et les coûts associés à l’analyse des données, un élément important à prendre en compte dans les essais cliniques à grande échelle et la recherche en santé publique. En minimisant les erreurs humaines et en automatisant les tâches répétitives, ces pipelines peuvent améliorer la précision de l’analyse des données EEG et conduire à des résultats de recherche plus fiables13. Cela peut à son tour accélérer le développement de nouveaux outils de diagnostic et d’interventions thérapeutiques, ce qui pourrait réduire les coûts des soins de santé et améliorer les résultats pour les patients1.
Cet article vise à présenter et à valider un pipeline intégré de prétraitement standardisé et modifiable pour l’EEG à l’état de repos à l’aide de MATLAB (PIPEMAT-RS). Conçu pour être à la fois robuste et efficace, ce pipeline modifiable est polyvalent et peut être largement appliqué à divers ensembles de données et scénarios de recherche. Les sept étapes complètes comprennent la conversion de format de fichier, le sous-échantillonnage, le filtrage, le rejet d’artefacts, l’analyse indépendante des composants (ICA) et l’exclusion des composants liés au bruit, le tout intégré dans un flux de travail cohérent23,24. Le développement de PIPEMAT-RS a été guidé par la nécessité de relever les défis courants du prétraitement EEG et de fournir un outil que les chercheurs peuvent utiliser pour rationaliser leurs processus d’analyse de données25. En s’intégrant aux pratiques couramment adoptées sur le terrain et en tirant parti des capacités de MATLAB, PIPEMAT-RS vise à offrir un cadre fiable, modifiable et convivial pour prendre en charge le prétraitement des données EEG26.
Pour valider l’efficacité de PIPEMAT-RS, nous l’avons appliqué dans plusieurs études. Dans une étude, PIPEMAT-RS a été utilisé pour étudier les biomarqueurs EEG chez les patients victimes d’un AVC, identifiant des corrélations significatives entre la fonction motrice inadaptée et les profils dépressifs27. Une autre étude a appliqué PIPEMAT-RS pour analyser les signatures neuronales de la compensation cérébrale chez les patients victimes d’un AVC à l’aide de l’EEG et de la TMS, révélant ainsi des informations essentielles sur les mécanismes adaptatifs du cerveau après l’AVC28. Une validation supplémentaire provient d’une étude qui a exploré les adaptations et les compensations neuronales chez les patients atteints de fibromyalgie29. De plus, une autre étude a démontré comment les bandes delta et thêta dans l’EEG au repos servent de mécanismes compensatoires dans la douleur neuropathique chronique30.
Ces études mettent collectivement en évidence l’utilité de PIPEMAT-RS dans le traitement et l’analyse des données EEG, établissant ainsi son efficacité dans diverses conditions et applications. En fournissant une approche standardisée, ce pipeline améliore non seulement la reproductibilité des études EEG, mais facilite également l’adoption plus large de méthodes de prétraitement cohérentes dans la communauté des chercheurs. À travers cet article, nous visons à apporter une ressource précieuse au domaine, en promouvant une analyse plus précise et plus fiable des données EEG16,17. Ce faisant, nous espérons soutenir l’avancement de la recherche en neurophysiologie et le développement de nouvelles approches thérapeutiques pour les affections neurologiques et psychiatriques.
Les étapes fondamentales de prétraitement utilisées dans PIPEMAT-RS sont ancrées dans des méthodes robustes et largement validées qui sont devenues essentielles dans la recherche EEG pour garantir la qualité et la reproductibilité des données 2,8,14. Bien que ces méthodologies soient bien établies, elles restent cruciales en raison de leur efficacité à traiter les artefacts et le bruit EEG courants, ce qui continue de soutenir des analyses fiables dans toutes les études. Cependant, peu d’études ont récemment fourni un pipeline standardisé entièrement documenté et adapté à l’EEG au repos. En intégrant ces techniques éprouvées à des avancées récentes, telles que ICLabel pour la classification automatisée des artefacts, PIPEMAT-RS offre une approche contemporaine et structurée qui améliore la reproductibilité et l’accessibilité pour les chercheurs, répondant ainsi à un besoin continu de flux de travail de prétraitement rigoureusement documentés sur le terrain.
Bien que le pipeline PIPEMAT-RS suive les étapes de prétraitement couramment utilisées dans les études EEG, sa documentation sous la forme d’un article scientifique comble une lacune importante dans la littérature. De nombreuses études EEG reposent sur des méthodes de prétraitement similaires, mais manquent souvent d’une description complète, étape par étape, qui permet une reproductibilité totale et une facilité d’adoption par d’autres chercheurs. En détaillant chaque composant de PIPEMAT-RS et en présentant une séquence standardisée pour l’analyse EEG à l’état de repos, ce travail vise à améliorer la transparence, à minimiser la variabilité de l’utilisateur et à fournir un cadre reproductible applicable à toutes les études. Plutôt que d’introduire de nouvelles méthodes, cette contribution vise à servir de guide pédagogique et pratique qui aide à normaliser les pratiques de prétraitement et à améliorer l’accessibilité pour un large éventail de chercheurs EEG, en particulier ceux qui travaillent avec des données à l’état de repos.
Le prétraitement des données EEG est une étape critique qui influence considérablement la qualité et la fiabilité des analyses ultérieures. Le pipeline intégré de prétraitement pour l’EEG à l’état de repos à l’aide de MATLAB (PIPEMAT-RS) a été développé pour relever les défis courants du prétraitement des données EEG en fournissant une approche complète et standardisée applicable à divers ensembles de données. Ce pipeline structuré et modifiable se compose de sept étapes clés : i) Conversion du format de fichier ; ii) Montage EEG ; iii) Sous-échantillonnage et filtrage ; iv) Rejet et réréférencement d’artefacts ; v) l’analyse en composantes indépendantes (ICA) ; vi) Classification ICLabel ; vii) Normalisation des données. Chaque étape est méticuleusement conçue pour améliorer la qualité du signal et faciliter l’extraction d’informations significatives à partir de données EEG brutes.
L’une des caractéristiques essentielles de PIPEMAT-RS est que chaque étape de prétraitement se termine par l’enregistrement de l’ensemble de données sous un nom de fichier distinct. Cette structure garantit que, pour chaque fichier traité, une version dérivée correspondant à chaque étape spécifique est générée. Cette approche systématique permet aux utilisateurs d’accéder aux données à n’importe quel point du pipeline de prétraitement en sept étapes. Les fichiers enregistrés incluent des identificateurs qui indiquent clairement l’étape de prétraitement, ce qui facilite le suivi et la gestion des données tout au long du flux de travail.
PIPEMAT-RS commence par la conversion de format de fichier, où les fichiers de données EEG brutes sont transformés dans un format compatible MATLAB. Cette conversion est essentielle pour le traitement transparent des données dans l’environnement de calcul robuste de MATLAB. Ensuite, l’étape de montage EEG attribue des emplacements spatiaux précis à chaque électrode sur le cuir chevelu sur la base de systèmes de placement d’électrodes standardisés. Ces informations spatiales sont cruciales pour l’interprétation précise des données EEG dans les études neurophysiologiques.
Ensuite, le pipeline applique un sous-échantillonnage et un filtrage pour réduire le taux d’échantillonnage des données et éliminer le bruit tout en conservant les composantes de fréquence pertinentes pour la recherche neurophysiologique. Le sous-échantillonnage réduit la charge de calcul et les besoins de stockage sans compromettre la qualité des données. Le filtrage supprime des composants de fréquence spécifiques connus pour être associés à des artefacts, préservant ainsi les signaux neuronaux essentiels.
Par la suite, le rejet et le reréférencement de l’artefact sont effectués. Cette étape identifie et supprime les segments de données contaminés par des sources de bruit telles que les clignements d’yeux, l’activité musculaire et le mouvement des électrodes. Des algorithmes de rejet automatique des artefacts sont utilisés pour minimiser les interventions manuelles, réduire le risque d’erreur humaine et augmenter l’efficacité du prétraitement. Le réréférencement des données à la moyenne de toutes les électrodes permet d’atténuer l’influence d’une seule électrode et fournit une référence stable pour les signaux EEG.
L’étape ICA (Independent Component Analysis) affine encore les données en séparant les signaux mixtes en leurs sources indépendantes. Cette décomposition facilite l’identification et l’élimination des artefacts tels que les clignements d’yeux, les artefacts musculaires et le bruit de ligne. L’ICA est une technique puissante qui garantit que les données restantes reflètent avec précision l’activité neuronale sous-jacente.
Enfin, la classification ICLabel est appliquée pour identifier et supprimer automatiquement les composants classés comme artefacts. ICLabel attribue des étiquettes probabilistes à des composants indépendants, en les classant comme activité cérébrale, activité musculaire, clignements, battements cardiaques, bruit de ligne ou bruit de canal. Les composants ayant une forte probabilité de représenter l’activité cérébrale sont conservés, tandis que ceux identifiés comme des artefacts sont supprimés. Cette approche automatisée réduit considérablement les efforts manuels et garantit une classification cohérente et objective entre les ensembles de données.
Chacune de ces étapes de prétraitement est essentielle pour améliorer la qualité des données EEG. En standardisant le flux de travail de prétraitement, PIPEMAT-RS minimise la variabilité introduite par les différentes méthodes de prétraitement, facilitant ainsi la comparaison des résultats entre les études. L’implémentation du pipeline dans MATLAB, une plateforme largement utilisée dans la communauté des neurosciences, garantit l’accessibilité et la facilité d’intégration dans les flux de travail de recherche existants.
Le développement de PIPEMAT-RS a été guidé par des pratiques couramment adoptées en matière d’analyse de données EEG, intégrant des méthodes et des techniques validées dans des recherches antérieures. Chaque étape a été soigneusement conçue et rigoureusement testée pour s’assurer de son efficacité à améliorer la qualité des données (figure 1). Cette approche globale améliore non seulement la fiabilité des données EEG, mais soutient également l’identification de marqueurs neurophysiologiques essentiels à la compréhension de diverses affections neurologiques et psychiatriques.