Rétention des participants et profil du travail sur le terrain
Un total de 480 questionnaires a été obtenu lors du travail de terrain mené aux grottes de Longmen. Après un tri selon les critères d'éligibilité et des vérifications de qualité des données, 430 questionnaires ont été retenus pour l'analyse, ce qui correspond à un taux de réponse valide de 89,6 %. L'échantillon final valide dépassait le seuil minimal préétabli de 400 questionnaires valides. Les cas exclus comprenaient des échecs d'éligibilité, des échecs aux contrôles d'attention, des complétions trop rapides, des profils de réponse linéaires ou quasi invariants, des réponses en double et d'autres problèmes survenus pendant le travail de terrain. Lorsqu'un questionnaire remplissait plusieurs critères d'exclusion, la règle de protocole applicable la plus précoce était utilisée comme catégorie principale d'exclusion. Le flux de sélection, allant de 480 questionnaires bruts à 430 cas valides, est présenté dans Figure 2.
Les cas retenus étaient répartis entre les trois points prévus pour l'enquête publique. La zone de sortie des visiteurs a contribué à 139 cas valides, la zone de repos publique située en dehors du parcours principal de visite à 146 cas, et la zone de service aux visiteurs près du point de connexion de transport à 145 cas. Les premiers visiteurs représentaient 55,6 % des cas valides, tandis que les visiteurs réguliers représentaient 44,4 %. Les participants à des visites de groupe organisées représentaient 23,0 %, un taux resté en dessous de la limite de surveillance prédéfinie. La répartition du travail sur le terrain et le profil des visiteurs sont présentés dans Tableau 6.
Répartition des constructions et diagnostics de mesure
Les scores des construits ont montré une dispersion suffisante pour l'analyse. Les scores moyens variaient entre 3,258 et 3,415, et les écarts types allaient de 0,837 à 0,892. Aucun construit ne présentait d'effet plafond marqué selon les vérifications de dispersion prédéfinies. L'effet de surpopulation perçue a été conservé dans son sens d'origine, de sorte qu'un score plus élevé indiquait une impression plus forte de surpopulation, et non une expérience plus positive du visiteur.
L'alpha de Cronbach variait de 0,699 pour la surpopulation perçue à 0,812 pour le comportement autodéclaré de voyage responsable. Toutes les variables latentes atteignaient soit le seuil de fiabilité acceptable, soit la règle de fiabilité limite. La surpopulation perçue a été jugée marginalement fiable car son alpha était légèrement inférieur à 0,70. Elle a été conservée car les corrélations corrigées entre les éléments et le total global atteignaient le seuil du protocole, et la variable latente était nécessaire pour représenter les conditions de pression des visiteurs sur un site patrimonial à fort afflux.
L'analyse factorielle confirmatoire à neuf facteurs a soutenu la structure de mesure prévue. Les indices d'ajustement du modèle étaient acceptables : χ2 (398) = 712,4, CFI = 0,932, TLI = 0,918, RMSEA = 0,043 et SRMR = 0,052. Les saturations factorielles standardisées variaient de 0,56 à 0,84. Les valeurs de fiabilité composite allaient de 0,702 à 0,842. La variance moyenne extraite se situait entre 0,453 et 0,575, la valeur la plus faible correspondant à l'impression de surpeuplement.
Les vérifications de validité discriminante n'ont pas indiqué de chevauchement sévère des construits. La valeur maximale de HTMT était de 0,642, en dessous du seuil de revue préspecifié. L'attitude à la conservation, la disposition à la conservation et le comportement déclaré de voyage responsable sont restés distinguables dans le modèle de mesure. Le premier facteur non tourné expliquait 18,7 % de la variance totale, en dessous du seuil de dépistage de méthode commune de 40 %. Ce résultat a été considéré uniquement comme un résultat de dépistage et non comme une preuve d'absence de biais de méthode commune. La corrélation la plus forte entre les construits était entre l'attitude à la conservation et la disposition à la conservation, r = 0,432, et aucune paire de construits n'a dépassé le seuil de redondance de 0,70. Les principaux diagnostics de mesure sont résumés dans le tableau 7. Les résultats complets de fiabilité au niveau des items, les saturations de AC, CR, AVE, HTMT ainsi que les corrélations inter-construits sont fournis dans le tableau supplémentaire 1, le tableau supplémentaire 2 et le tableau supplémentaire 3.
Résultats du modèle et vérifications de sensibilité
Le protocole a produit des sorties de régression et de modélisation de cheminement interprétables, sans multicollinéarité importante. Les trois modèles de régression ont montré un pouvoir explicatif modéré. Le modèle d'attitude à la conservation avait un R2 = 0,267 et un R2 ajusté = 0,224. Le modèle de volonté de conservation avait un R2 = 0,333 et un R2 ajusté = 0,292. Le modèle de comportement autodéclaré en matière de voyage responsable avait un R2 = 0,275 et un R2 ajusté = 0,228. Ces valeurs se situaient dans la plage plausible prédéfinie pour des données transversales sur le comportement des visiteurs.
Le modèle de cheminement a suivi la séquence prévue : prédicteurs liés au site → attitude de conservation → volonté de conservation → comportement déclaré de voyage responsable. L'ajustement du modèle était acceptable : CFI = 0,927, TLI = 0,904, RMSEA = 0,049 et SRMR = 0,041. Les estimations des chemins principaux étaient interprétables. L'attitude de conservation était positivement associée à la volonté de conservation, β = 0,276. L'attitude de conservation et la volonté de conservation étaient positivement associées au comportement déclaré de voyage responsable, avec β = 0,232 et β = 0,271 respectivement. L'effet indirect de l'attitude de conservation sur le comportement déclaré de voyage responsable, transmis par la volonté de conservation, était de 0,075, avec un intervalle de confiance bootstrap à 95 % de 0,036 à 0,122. Les coefficients de régression complets, les estimations des chemins, les effets indirects, les effets totaux et les fichiers de sortie du modèle sont fournis dans le fichier supplémentaire 3, le tableau supplémentaire 4 et le tableau supplémentaire 5.
Les diagnostics de régression n'ont pas révélé de multicolinéarité importante. Les valeurs de VIF variaient de 1,012 à 1,422, en dessous du seuil prédéfini de 3,00. Les diagnostics relatifs aux cas influents ne justifiaient pas l'exclusion de données des modèles principaux. Les observations signalées par la distance de Cook ont été conservées dans l'analyse principale et évaluées lors des analyses de sensibilité.
Les vérifications de sensibilité ont confirmé la stabilité des résultats du protocole. Aucun questionnaire valide n'a dépassé le seuil de temps d'achèvement de 1 800 s. Après l'exclusion des participants aux visites de groupe organisées, l'utilisation d'un score de construit fondé sur la médiane et l'élimination des cas signalés par la distance de Cook, les directions principales des coefficients ont été conservées. Selon les différentes spécifications de sensibilité, le coefficient standardisé pour l'attitude à la conservation → volonté de conservation variait de 0,261 à 0,290, l'attitude à la conservation → comportement déclaré de voyage responsable variait de 0,198 à 0,260, et la volonté de conservation → comportement déclaré de voyage responsable variait de 0,243 à 0,298. Les résultats complets des vérifications de sensibilité sont fournis dans le tableau supplémentaire 6.
Résumé des produits du protocole
Le flux de travail a produit un échantillon analytique valide dépassant le nombre minimal préétabli d'échantillons requis, avec des questionnaires complétés répartis sur l'ensemble des points d'enquête prévus. L'échantillon retenu comprenait une variabilité concernant le profil des visiteurs et leur mode de déplacement, et la proportion de visiteurs en groupes organisés est restée dans les limites de surveillance fixées. Les vérifications des mesures ont soutenu l'utilisation de scores au niveau des construits : la majorité des construits ont atteint le seuil de fiabilité, la perception de la surfréquentation a été conservée comme étant marginalement fiable, et le modèle à neuf facteurs CFA ont montré un ajustement acceptable, et les vérifications de validité discriminante ont confirmé la distinction entre l'attitude de conservation, la disposition à la conservation et le comportement déclaré de voyage responsable.
Les résultats du modèle ont permis de démontrer que le protocole pouvait produire des preuves analysables et vérifiables concernant le comportement des visiteurs. Les résultats de la régression et du modèle de cheminement étaient interprétables, le test de l'effet indirect était disponible pour la séquence planifiée attitude–volonté–comportement, et les vérifications de sensibilité n'ont pas modifié le sens des associations principales. Ces résultats appuient l'utilisation procédurale du flux de travail pour des enquêtes auprès des visiteurs de sites patrimoniaux avec un minimum de perturbation, plutôt que de servir de preuve observationnelle directe du comportement des visiteurs. L'ensemble des données anonymisées, des questionnaires, des documents d'étude complémentaires, du script d'analyse, des résultats complets des modèles, ainsi que les données brutes de toutes les figures et tableaux ont été déposés dans Zenodo (DOI : https://doi.org/10.5281/zenodo.21640066).

Figure 1 : Flux du protocole pour l'enquête auprès des visiteurs des grottes de Longmen. Le flux illustre la séquence utilisée dans ce protocole, allant de la conception du questionnaire, du test pilote, de l'interception des visiteurs en zone publique, de la passation du questionnaire et de la verrouillage des données brutes, au contrôle de qualité, au calcul des scores des construits, à la validation des mesures, à l'estimation du modèle, aux analyses de sensibilité et à l'archivage des fichiers d'étude. Veuillez cliquer ici pour visualiser une version agrandie de cette figure.

Figure 2 : Flux de tri des questionnaires pour l'échantillon analytique final. Le diagramme illustre la transition de 480 questionnaires bruts à 430 questionnaires valides après le dépistage d'éligibilité, l'examen des contrôles d'attention, le tri selon le temps de complétion, la détection des réponses linéaires, l'inspection des réponses en double et des vérifications de qualité liées au terrain. Les exclusions sont comptabilisées selon le motif principal d'exclusion lorsqu'une pluralité de conditions d'avertissement est présente. Veuillez cliquer ici pour afficher une version agrandie de cette figure.
Tableau 1 : Structure du questionnaire et carte des construits pour l'enquête auprès des visiteurs des grottes de Longmen. Ce tableau résume les définitions des construits, les abréviations, les codes des items, le nombre d'items, le sens de notation, la position analytique, ainsi que la source ou la base d'adaptation utilisée pour mesurer la volonté des visiteurs en matière de conservation et leurs comportements déclarés de voyage responsable. La formulation complète des items est fournie dans le Fichier supplémentaire 1. Tous les items substantiels ont été notés sur une échelle allant de 1 = tout à fait en désaccord à 5 = tout à fait d'accord. Le PC a été conservé dans son sens d'origine ; un score PC plus élevé indique une impression plus forte de surfréquentation. Veuillez cliquer ici pour télécharger ce tableau.
Tableau 2 : Calendrier des travaux sur le terrain et plan d'échantillonnage systématique par interception. Ce tableau présente la période officielle de collecte des données, les points de sondage publics, les plages horaires quotidiennes, l'intervalle d'échantillonnage, l'objectif brut d'échantillons, le nombre minimal requis d'échantillons valides, les plages de surveillance de la composition des visiteurs, les règles de suspension et les variables d'enregistrement des travaux sur le terrain. Veuillez cliquer ici pour télécharger ce tableau.
Tableau 3 : Critères d'éligibilité, vérifications d'attention et règles de contrôle de qualité. Ce tableau présente les critères d'éligibilité, les règles de vérification d'attention, les seuils de temps d'achèvement, les règles de réponse linéaire, les contrôles de réponses en double, les codes d'exclusion et les décisions concernant les données conservées avant le calcul des scores des construits. Veuillez cliquer ici pour télécharger ce tableau.
Tableau 4 : Plan de codage des variables et de calcul des scores de construit. Ce tableau définit les règles de codage pour l'identifiant du répondant, les variables démographiques, les variables liées aux déplacements, les enregistrements d'enquête, les variables de contrôle d'attention, les items à échelle de Likert, les scores de construit et le statut d'exclusion. Tous les scores de construit restent sur l'échelle originale de 1 à 5. L'imputation des valeurs manquantes au niveau des items n'a pas été utilisée, car tous les champs du questionnaire principal étaient obligatoires. Veuillez cliquer ici pour télécharger ce tableau.
Tableau 5 : Seuils diagnostiques prédéfinis utilisés avant l'interprétation du modèle. Ce tableau présente les seuils applicables à la fiabilité, à la rétention des items, à l'analyse factorielle confirmatoire, à la validité discriminante, au dépistage des biais liés à la méthode commune, aux vérifications de la distribution, à l'examen des corrélations, à la multicollinéarité, aux diagnostics des cas influents, à la plausibilité du modèle, aux tests de significativité et à l'interprétation des effets indirects. CFA = analyse factorielle confirmatoire ; CFI = indice de qualité d'ajustement comparatif ;
TLI = indice de Tucker-Lewis ; RMSEA = racine carrée de l'erreur quadratique moyenne d'approximation ; SRMR = résidu carré moyen standardisé ; CR = fiabilité composite ; AVE = variance moyenne extraite ; HTMT = rapport hétérotrait-monotrait ; VIF = facteur d'inflation de la variance. Veuillez cliquer ici pour télécharger ce tableau.
Tableau 6 : Répartition du travail sur le terrain et caractéristiques démographiques de l'échantillon valide. Ce tableau résume la répartition des questionnaires valides selon le point d'enquête, la fenêtre temporelle, la période d'enquête, le sexe, le groupe d'âge, le niveau d'éducation, le revenu mensuel personnel, le statut de visite et le mode de déplacement. Les pourcentages ont été calculés à partir de l'échantillon analytique final, n = 430. Les pourcentages peuvent ne pas s'additionner à 100,0 en raison des arrondis. Veuillez cliquer ici pour télécharger ce tableau.
Tableau 7 : Résumé de la distribution des construits, des diagnostics de mesure, des sorties de modèle et des vérifications de sensibilité. Ce tableau résume les statistiques descriptives au niveau des construits, les valeurs alpha de Cronbach, les indices d'ajustement de l'ACF, la fiabilité composite, la variance moyenne extraite, l'HTMT, les résultats du dépistage des biais de méthode commune, l'ajustement du modèle de régression, l'ajustement du modèle de cheminement, les tests des effets indirects, les diagnostics de multicolinéarité et la stabilité des vérifications de sensibilité. Les résultats complets de la fiabilité au niveau des items, les saturations de l'ACF, la matrice de l'HTMT, les corrélations entre construits, les coefficients de régression, les estimations des chemins, les effets indirects, les effets totaux et les sorties des vérifications de sensibilité sont fournis dans le Fichier supplémentaire 3. HK = connaissance du patrimoine ; PHV = valeur perçue du patrimoine ; PA = attachement au lieu ; PMQ = qualité perçue des messages pro-environnementaux ; PC = encombrement perçu ; FSW = soutien aux installations et services ; CA = attitude à la conservation ; CW = volonté de conservation ; RTB = comportement autodéclaré de voyage responsable. La variable PC a été conservée dans son sens d'origine ; une valeur plus élevée de PC indique un encombrement perçu plus important. Veuillez cliquer ici pour télécharger ce tableau.
Fichier supplémentaire 1 : Questionnaire et documents relatifs au consentement. Ce fichier contient le questionnaire final, la page d'information et de consentement éclairé, les questions de dépistage d'éligibilité, les éléments de contrôle d'attention, l'enregistrement de l'affichage sur la plateforme de questionnaire, ainsi que le compte rendu de l'étude pilote.Veuillez cliquer ici pour télécharger ce fichier.
Fichier supplémentaire 2 : Carnets de terrain et enregistrements de gestion des données. Ce fichier contient le formulaire de journal de terrain, le registre d'attribution des rôles, le journal de gestion des données, le formulaire de journal d'exclusion et la structure du codebook.Veuillez cliquer ici pour télécharger ce fichier.
Fichier supplémentaire 3 : Matériaux pour l'analyse et la reproductibilité. Ce fichier fournit le jeu de données d'analyse anonymisé, le script d'analyse, la sortie de la fonction sessionInfo(), les résultats de fiabilité au niveau des items, les sorties de CFA, la matrice HTMT, la matrice de corrélation entre les construits, les sorties de régression, les sorties du modèle de cheminement, les sorties des effets indirects, les sorties des vérifications de sensibilité, le classeur complet des sorties du modèle, ainsi que la liste de contrôle des données sources des figures et tableaux.Veuillez cliquer ici pour télécharger ce fichier.
Tableau supplémentaire 1 : Statistiques descriptives et résultats de fiabilité au niveau des items. Toutes les corrélations corrigées entre item et total étaient ≥0,30. PC = densité perçue.Veuillez cliquer ici pour télécharger ce fichier.
Tableau supplémentaire 2 : Pondérations CFA standardisées, CR et AVE. CFA = analyse factorielle confirmatoire ; CR = fiabilité composite ; AVE = variance moyenne extraite.Veuillez cliquer ici pour télécharger ce fichier.
Tableau supplémentaire 3 : Matrice de corrélation inter-constructs. HK = connaissance du patrimoine ; PHV = valeur perçue du patrimoine ; PA = attachement au lieu ; PMQ = qualité perçue du message pro-environnemental ; PC = densité perçue ; FSW = soutien aux infrastructures et services ; CA = attitude en faveur de la conservation ; CW = disposition à la conservation ; RTB = comportement de voyage responsable auto-déclaré.Veuillez cliquer ici pour télécharger ce fichier.
Tableau supplémentaire 4 : Résultats complets des régressions. Les variables de contrôle comprenaient le sexe, le groupe d'âge, le niveau d'éducation, le revenu mensuel personnel, le statut de première visite et le mode de transport. VIF = facteur d'inflation de la variance.Veuillez cliquer ici pour télécharger ce fichier.
Tableau supplémentaire 5 : Résultats des modèles de cheminement et des effets indirects. CA = attitude à la conservation ; CW = volonté de conservation ; RTB = comportement autodéclaré de voyage responsable.Veuillez cliquer ici pour télécharger ce fichier.
Tableau supplémentaire 6 : Vérifications de sensibilité des résultats principaux du modèle. CA = attitude à la conservation ; CW = volonté de conservation ; RTB = comportement autodéclaré de voyage responsable.Veuillez cliquer ici pour télécharger ce fichier.
Tableau supplémentaire 7 : Liste de contrôle des données sources des figures et des tableaux. Veuillez cliquer ici pour télécharger ce fichier.