Conception de l’étude
Avant tout recrutement ou collecte de données, le protocole de l’étude a été examiné et approuvé par le Comité d’éthique de la recherche de l’Université de Malaisie (ID d’approbation : UUM20259910). Toutes les procédures impliquant des participants humains ont été menées conformément aux exigences institutionnelles et à la Déclaration d’Helsinki. Les participants ont donné leur consentement éclairé électronique avant de saisir le questionnaire, et aucune information personnelle identifiable n’a été exportée pour analyse.
Cette étude a utilisé une expérience en ligne randomisée entre sujets pour examiner la perception du risque et la vérification des informations sur les catastrophes chez des étudiants universitaires chinois après exposition à des publications simulées sur les réseaux sociaux. À la suite de recherches sur la désinformation basée sur lastimulation 12, la conception a manipulé des indices d’information prédéfinis plutôt que de se reposer uniquement sur une exposition rétrospective auto-déclarée. L’expérience utilisait une structure factorielle 2 × 2 × 2 avec trois facteurs : indice de source, véracité de l’information et ton émotionnel. Les cellules source officielle + informations trompeuses représentaient des postes fictifs à l’apparence d’officiels ou usurpés d’un officiel créés uniquement pour l’expérience ; Ils ne représentaient pas une véritable agence de gestion des urgences diffusant de fausses informations.
La procédure d’étude est illustrée à la Figure 1. Les participants ont effectué un dépistage d’éligibilité, un consentement éclairé électronique, des mesures de référence, une affectation aléatoire, une exposition à un post simulé, une évaluation post-exposition, une tâche de vérification, un débriefing et un dépistage de la qualité des données. Chaque participant n’a vu qu’un seul article afin d’éviter les effets d’apprentissage dans toutes les conditions. La structure factorielle et les cellules de randomisation sont présentées dans le Tableau 1.
Les participants ont d’abord effectué un dépistage d’admissibilité et un consentement éclairé électronique, suivis d’une mesure de base, d’une affectation aléatoire au niveau individuel à l’une des huit cellules expérimentales, de l’exposition à une publication simulée liée à une catastrophe sur les réseaux sociaux, d’une évaluation post-exposition, d’une évaluation de vérification basée sur des tâches, d’un débriefing immédiat, d’un contrôle de la qualité des données et d’une analyse statistique finale. Le flux de travail ne montre que les étapes procédurales et de présélection et ne présente pas de résultats empiriques.
Participants et recrutement
Les participants étaient des étudiants à temps plein de premier ou de troisième cycle inscrits dans des universités chinoises continentales. Les critères d’éligibilité étaient : âge de 18 ans ou plus, inscription actuelle à l’université, capacité à lire le chinois simplifié, et utilisation régulière d’au moins une plateforme de réseaux sociaux. Les participants ont été exclus s’ils avaient moins de 18 ans, n’étaient pas actuellement inscrits en tant qu’étudiants universitaires, avaient participé au test pilote, soumis un questionnaire incomplet, échoué à l’item de contrôle d’attention, rempli le questionnaire en un temps irréaliste court, ou montraient des réponses variées sur les items de l’échelle.
Le recrutement s’est fait via des groupes d’avis universitaires, des canaux d’annonce des cours et des réseaux d’associations étudiantes. L’avis de recrutement décrivait l’étude comme une recherche sur l’évaluation par les étudiants universitaires des informations en ligne sur les catastrophes. Elle n’a pas révélé avant la participation que certains articles contenaient des éléments trompeurs, car la divulgation anticipée aurait modifié la tâche de vérification. L’utilisation d’étudiants universitaires chinois était justifiée car cette population est fréquemment confrontée à de la désinformation sur les réseaux sociaux et rapporte des incertitudes lors de l’évaluation de la crédibilité enligne 13.
Détermination de la taille de l’échantillon
La taille d’échantillon cible était fixée avant la collecte des données. L’étude visait à conserver au moins 400 réponses valides, avec environ 50 participants dans chacune des huit cellules expérimentales. Cette cible supportait les comparaisons factorielles, les tests d’interaction et les analyses de sensibilité après la suppression des réponses invalides. Environ 460 étudiants ont été invités à accepter des questionnaires incomplets, des contrôles d’attention ratés et des réponses de faible qualité.
Étant donné que les associations entre la perception du risque et le comportement de recherche d’information d’urgence sont généralement modestes entaille 14, l’étude a conservé une taille de cellule suffisamment grande pour stabiliser les estimations de l’effet principal et de l’interaction. L’équilibre de randomisation entre les huit cellules a été évalué à l’aide de tests chi-carrés pour les variables de référence catégoriques et d’ANOVA unidirectionnelle pour les variables de base continues avant l’ajustement des modèles primaires.
La planification de la puissance et de la sensibilité a été définie avant analyse. Avec un échantillon cible retenu d’au moins 400 participants et huit cellules randomisées, l’étude a été suffisamment alimentée pour des effets principaux faibles à modérés dans les modèles factoriels. La conception n’était pas propulsée pour formuler des affirmations confirmatrices solides concernant les interactions à trois, la médiation, la modération ou les effets de régression logistique des sous-groupes. Ainsi, les analyses d’interaction, de médiation, de modération et de vérification binaire de la précision ont été traitées comme secondaires ou exploratoires et interprétées après les modèles factoriels primaires.
Matériaux expérimentaux
Huit publications simulées sur les réseaux sociaux ont été créées pour le design 2 × 2 × 2. Chaque article décrivait une situation plausible liée à une catastrophe pertinente pour les étudiants universitaires, incluant de fortes pluies, des inondations urbaines, des perturbations temporaires des transports, des rappels de sécurité sur le campus ou une préparation aux situations d’urgence à court terme. Les publications utilisaient une mise en page de type capture d’écran similaire à celle des publications publiques sur les réseaux sociaux chinois et contenaient une étiquette source, un titre, un court texte, un horodatage, des indicateurs d’engagement et des éléments d’interface simples. Aucun lieu de catastrophe réel, victime réelle, événement d’urgence réel, annonce officielle réelle ou poste d’agence publique identifiable n’a été utilisé.
Les versions précises contenaient des informations cohérentes en interne et des conseils de protection proportionnés, tels que la vérification des mises à jour officielles, l’évitement des routes inondées et la préparation des nécessités de base. Les versions trompeuses utilisaient des affirmations de menace exagérées, une attribution vague, des prédictions non étayées ou des déclarations d’urgence nonvérifiables 15. La condition de source officielle utilisait une étiquette fictive de type gestion d’urgence vérifiée, tandis que la condition de source par les pairs utilisait un compte étudiant ou pair transféré ordinaire. Les noms sources, les emplacements, les horodatages, les indicateurs d’engagement et les détails de l’interface étaient fictifs. Des descriptions intégrales des huit stimuli sont fournies dans le tableau 2 afin que les lecteurs puissent évaluer l’indépendance de la source, la véracité et les manipulations du ton.
Tests pilotes de stimuli
Un test pilote a été mené avec 30 étudiants universitaires remplissant les mêmes critères d’éligibilité mais n’ayant pas été inclus dans l’expérience principale. Les participants ont évalué chaque publication en termes de réalisme, d’intensité émotionnelle, de crédibilité des sources, de clarté de formulation et de précision perçue à l’aide d’échelles à 5 points. Ils ont également indiqué si un article semblait faire référence à un véritable événement catastrophe récent ou à une véritable annonce gouvernementale.
Les tests pilotes ont été utilisés pour vérifier le réalisme et la clarté de la manipulation plutôt que pour rendre les publications trompeuses manifestement fausses, car la désinformation peut encore être mal jugée même dans des conditions de traitementattentives 16. Les stimuli étaient révisés lorsque la formulation était floue, le contraste émotionnel trop faible, la formulation de la menace excessive ou le contenu semblait trop proche d’un événement réel.
Trois items de manipulation-vérification ont été conservés dans le questionnaire principal. Les participants ont identifié si le message semblait provenir d’une source officielle ou non officielle, s’il paraissait exact ou douteux, et à quel point la formulation paraissait émotionnellement menaçante. Les participants n’étaient pas exclus uniquement parce qu’ils avaient mal jugé la véracité d’un article, puisque le mauvais jugement faisait partie du phénomène mesuré. L’exclusion n’était appliquée que lorsque la reconnaissance de manipulation ratée survenait avec un comportement de réponse invalide, comme un échec à la vérification de l’attention ou des réponses par schémas.
Procédure expérimentale
L’expérience a été menée via une plateforme d’enquête en ligne accessible par smartphone ou ordinateur du 3 mars 2026 au 21 mars 2026. Après avoir ouvert le lien, les participants ont consulté une page électronique de consentement éclairé décrivant l’objectif général, la participation volontaire, le temps estimé d’achèvement, les procédures de confidentialité, un léger inconfort potentiel lié au contenu lié à la catastrophe, et le droit de se retirer avant soumission. Les participants ont confirmé qu’ils avaient au moins 18 ans et ont accepté de participer avant de saisir le questionnaire.
Les participants ont d’abord complété les mesures de référence, notamment les caractéristiques démographiques, l’utilisation quotidienne des réseaux sociaux, les expériences passées lors de catastrophes, la perception d’une littératie informationnelle et la confiance générale dans les informations officielles d’urgence. La plateforme a ensuite assigné aléatoirement chaque participant à l’une des huit cellules expérimentales en utilisant une randomisation intégrée au niveau individuel. Les participants ont visionné un post simulé et n’ont pas pu revenir aux pages précédentes après avoir terminé la section post-exposition.
Immédiatement après l’exposition, les participants ont complété des mesures de risque perçu, de crédibilité perçue, de réponse émotionnelle, d’intention de vérification et d’intention de partage. La tâche de vérification nécessitait des choix comportementaux concrets plutôt que de simples évaluations d’intention, car la confiance des jeunes utilisateurs dans la détection de la désinformation ne se traduit pas nécessairement par une identification précise dans des environnements numériquesréalistes 17. Les participants sélectionnaient les actions de vérification à partir d’une liste fixe avant de passer à la page de débriefing.
À la fin du questionnaire, tous les participants ont reçu un débriefing immédiat. La page indiquait que le post avait été créé à des fins de recherche, notait que certaines versions contenaient des éléments trompeurs, et rappelait aux participants de vérifier les allégations liées aux catastrophes via les canaux officiels de gestion des urgences avant de le partager. Les participants ont également été invités à ne pas copier, sauvegarder ou transmettre tout matériel de stimulation en dehors de l’étude.
Mesures
La perception du risque a été mesurée avec cinq éléments portant sur la gravité perçue, la probabilité, la pertinence personnelle, l’impact sur le campus ou la communauté, et la nécessité de précaution. Ces items reflétaient la vision établie de la perception du risque comme un jugement subjectif impliquant les conséquences perçues, l’incertitude et lacontrôlabilité 18. Les réponses ont été enregistrées sur une échelle de Likert à 5 points, allant de 1 = fortement en désaccord à 5 = fortement d’accord. Des scores plus élevés indiquaient un risque perçu plus élevé.
La crédibilité perçue a été mesurée avec quatre éléments évaluant si l’article semblait crédible, exact, digne de confiance et digne d’intérêt. L’intention de vérification a été mesurée avec quatre éléments : la volonté de vérifier les canaux officiels, la recherche de preuves à l’appui, la comparaison de plusieurs sources et le report avant la confirmation. Le partage de l’intention a été mesuré par trois items évaluant la volonté de republier, de transmettre à des camarades ou de rappeler aux autres en fonction du post. L’intention de vérification des faits était traitée comme un concept distinct car des recherches antérieures sur les réseaux sociaux la relient à la littératie journalistique et aux jugementsde confiance 19.
La littératie informationnelle a été mesurée avant l’exposition avec six éléments portant sur l’évaluation des sources, la vérification croisée des habitudes, la reconnaissance des titres trompeurs, la conscience du cadrage émotionnel, la capacité à distinguer les informations officielles des non officielles, et la volonté de consulter des sources faisant autorité. L’expérience antérieure des catastrophes a été mesurée à partir de deux éléments : l’expérience personnelle des catastrophes naturelles ou des perturbations d’urgence, ainsi que des recherches antérieures en ligne d’informations liées aux catastrophes. La confiance générale dans les informations officielles d’urgence a été mesurée avec trois éléments.
Le comportement de vérification a été noté à l’aide d’une règle de réponses multiples basée sur les tâches. Les participants pouvaient choisir l’une des huit actions suivantes : consulter un site officiel de gestion des urgences, rechercher un compte gouvernemental vérifié, comparer la déclaration avec des médias reconnus, consulter la page d’avis d’urgence de l’université, demander à un ami non spécifié, lire uniquement les commentaires, transférer d’abord puis vérifier ensuite, ou ne rien faire20. Les quatre premières actions étaient codées comme des actions de vérification fiables, et chacune recevait un point ; ces quatre dernières actions étaient codées comme passives, peu fiables ou de partage prématuré et n’ont reçu aucun point. Le score de comportement de vérification continue variait donc de 0 à 4. Une variable binaire de précision de vérification était codée comme 1 lorsqu’un participant sélectionnait au moins une action de vérification fiable et ne sélectionnait pas le transfert avant la vérification. Les définitions des variables, les numéros d’éléments, les règles de codage et la construction des scores sont fournies dans le tableau 3.
Contrôle qualité des données
Le contrôle qualité des données a été effectué avant l’analyse statistique. Sur 460 réponses soumises ou initiées, 34 ont été exclues et 426 ont été conservées pour analyse. La séquence d’exclusion a été fixée à l’avance : inéligibilité d’âge, statut non-étudiant, questionnaire incomplet, participation au test pilote, échec au contrôle d’attention, temps de complétion irréaliste court et réponse structurée. Le temps d’achèvement était considéré comme irréaliste s’il était inférieur à un tiers du temps médian d’achèvement. Les réponses en ligne droite n’étaient supprimées que lorsqu’elles apparaissaient avec des échecs d’attention ou des temps de complétion irréalistes et courts.
Les soumissions dupliquées ou suspectes ont été examinées à l’aide d’indicateurs d’enquête non identifiants, incluant des schémas de réponse répétés et un timing anormal de soumission. Aucun nom, numéro d’identification étudiante, numéro de téléphone, nom de compte sur les réseaux sociaux, image faciale, localisation précise, adresse IP ou identifiant d’appareil n’a été exporté pour analyse. Les cas dont les valeurs manquantes sur les variables de résultat primaires ont été exclus de l’analyse principale. Comme le questionnaire exigeait la complétion des items expérimentaux principaux avant soumission, l’absence dans les variables primaires était attendue minimale. Les critères de sélection et les définitions opérationnelles sont listés dans le tableau 4.
Considérations éthiques
L’étude n’a utilisé que la dissimulation limitée pour la présence d’éléments trompeurs dans certains articles. Elle ne dissimulait pas le sujet général, le type de tâche, la nature volontaire, les procédures de confidentialité ni un léger inconfort possible. Cette dissimulation était nécessaire pour préserver la validité de la tâche de vérification et a été suivie d’un débriefing immédiat. Les documents liés aux catastrophes ont évité les lieux réels, les vraies victimes, les cas d’urgence réels, les images graphiques et les annonces gouvernementales réelles car une gestion irresponsable de la désinformation d’urgence peut accroître l’anxiété et interférer avec une réponse publiqueappropriée 21.
L’ensemble de données anonymisé ne contenait que des variables de recherche et des codes participants générés aléatoirement. Les exportations brutes d’enquêtes, les données analytiques filtrées, les fichiers de codes, les documents de relance et la syntaxe statistique étaient stockés séparément sur un ordinateur protégé par mot de passe accessible uniquement à l’équipe de recherche. Aucune information personnelle identifiable n’a été exportée, analysée ou partagée.
Analyse statistique
L’analyse statistique a été réalisée à l’aide des IBM SPSS Statistics version 27.0 et R version 4.3. Les variables continues étaient résumées en moyennes et écarts-types. Les variables catégorielles étaient résumées en fréquences et pourcentages. La cohérence interne des échelles multi-items a été évaluée à l’aide de l’alpha de Cronbach, α ≥ 0,70 étant considérée comme acceptable pour une analyse au niveau du groupe.
Avant les tests d’hypothèse, des tests de manipulation étaient examinés. Les tests t à échantillons indépendants ont comparé l’intensité émotionnelle perçue entre des conditions neutres et des conditions à haut risque. Les tests du Chi carré ont examiné la reconnaissance des indices officiels versus des sources pairs. Les évaluations de précision perçues ont été comparées entre des publications exactes et trompeuses. L’équilibre de randomisation a été examiné sur les huit cellules expérimentales avant l’ajustement des modèles de résultats.
Les principaux critères étaient la perception du risque, la crédibilité perçue, l’intention de vérification, l’intention de partage et le score de comportement de vérification basé sur la tâche continu. La variable de précision binaire de vérification, les termes d’interaction au-delà des contrastes bidirectionnels planifiés, les modèles de médiation, de modération et de robustesse ont été traités comme secondaires ou exploratoires. Des modèles factoriels ANOVA et généraux linéaires ont été utilisés pour des résultats primaires continus. Des termes d’interaction bidirectionnelle et tridirectionnelle ont été inclus pour examiner si l’effet de la véracité de l’information variait selon le signal source ou le ton émotionnel. La régression logistique a été utilisée pour la précision de la vérification binaire, avec des rapports de chances et des intervalles de confiance à 95 % rapportés.
Les modèles de médiation et de modération ont été traités comme des analyses secondaires. La crédibilité perçue a été testée comme médiateur entre le signal de la source et l’intention de vérification. La perception du risque a été testée comme médiateur entre le ton émotionnel et le partage de l’intention. La littératie informationnelle a été testée comme modérateur de l’association entre la crédibilité perçue et le partage de l’intention. Parce que les réponses à la désinformation sont façonnées par l’évaluation cognitive, le jugement de confiance et le partage de motivation plutôt que par la précision du messageseule, ces modèles ont été interprétés selon les modèles factoriels primaires. Les effets indirects ont été estimés à l’aide de 5 000 rééchantillonnages bootstrap.
Les contrôles de robustesse ont été réalisés en trois étapes. Premièrement, les modèles principaux ont été répétés après avoir exclu les participants ayant échoué à un élément de manipulation-contrôle. Deuxièmement, les modèles ont été ajustés selon le genre, le niveau d’éducation, l’utilisation quotidienne des réseaux sociaux, l’expérience antérieure de catastrophe et la confiance de base dans les informations officielles d’urgence. Troisièmement, le comportement de vérification a été analysé à la fois comme un score continu et comme une variable binaire de précision. La signification statistique pour les critères primaires a été fixée à p < 0,05. Les analyses secondaires ont été interprétées par la direction de l’effet, les intervalles de confiance et la cohérence avec les modèles primaires plutôt que par des valeurs p marginales seules. Les tailles d’effet ont été rapportées en et au carré partiel, d de Cohen, coefficients standardisés ou rapports de cotes selon le type de modèle.
Gestion des données et reproductibilité
L’ensemble de données analytique anonymisé contenait une ligne par participant et une colonne par variable. Il comprenait le code des participants, l’état expérimental, les variables démographiques, les mesures de référence, les éléments de manipulation-vérification, les résultats post-exposition, les indicateurs de comportement de vérification, les scores composites et les indicateurs d’exclusion. Les codes participants étaient générés aléatoirement et n’étaient pas liés à l’identité de l’élève.
Les scores composites ont été calculés en faisant la moyenne des items valides dans chaque échelle après confirmation de la direction des items. Des scores plus élevés indiquaient systématiquement des niveaux plus élevés du construit mesuré. Le codage inversé n’était appliqué que lorsque le texte de l’élément l’exigeait. Le journal de nettoyage des données documentait toutes les exclusions, les décisions de recodage, les calculs de score composite et les spécifications du modèle. Le package de reproductibilité comprenait un ensemble de données analytique anonymisé, un codebook, des descriptions de stimulus, un journal de dépistage et une syntaxe statistique. Une documentation transparente de la conception des stimulos, de la randomisation, des règles d’exclusion, des procédures de notation et de la syntaxe analytique a été maintenue pour soutenir la reproductibilité dans la désinformation et la recherche en communicationdes risques 23.