Diseño del estudio
Antes de cualquier reclutamiento o recogida de datos, el protocolo del estudio fue revisado y aprobado por el Comité de Ética en Investigación de la Universidad de Malaya (ID de aprobación: UUM20259910). Todos los procedimientos que involucraron a participantes humanos se llevaron a cabo de acuerdo con los requisitos institucionales y la Declaración de Helsinki. Los participantes proporcionaron su consentimiento informado electrónico antes de introducir el cuestionario y no se exportó información personal identificable para su análisis.
Este estudio utilizó un experimento aleatorizado entre sujetos en línea para examinar la percepción de riesgos y la verificación de información sobre desastres entre estudiantes universitarios chinos tras la exposición a publicaciones simuladas en redes sociales. Tras la investigación de desinformación basada enestímulos 12, el diseño manipuló pistas de información predefinidas en lugar de basarse únicamente en la exposición auto-reportada retrospectiva. El experimento utilizó una estructura factorial de 2 × 2 × 2 con tres factores: pista de fuente, veracidad de la información y tono emocional. Las células de fuente oficial + información engañosa representaban publicaciones ficticias de aspecto oficial o suplantadas por oficiales creadas exclusivamente para el experimento; No representaban a una agencia real de gestión de emergencias que emitía información falsa.
El procedimiento del estudio se muestra en la Figura 1. Los participantes completaron el cribado de elegibilidad, consentimiento electrónico informado, medidas de referencia, asignación aleatoria, exposición a una publicación simulada, evaluación postexposición, tarea de verificación, informe y cribado de calidad de datos. Cada participante vio solo una publicación para evitar efectos de aprendizaje en distintas condiciones. La estructura factorial y las celdas de aleatorización se presentan en la Tabla 1.
Los participantes completaron primero el cribado de elegibilidad y el consentimiento informado electrónico, seguido de la medición inicial, asignación aleatoria a nivel individual a una de las ocho células experimentales, exposición a una publicación simulada relacionada con un desastre en redes sociales, evaluación post-exposición, evaluación de verificación basada en tareas, informe inmediato, cribado de calidad de datos y análisis estadístico final. El flujo de trabajo solo muestra pasos procedimentales y de selección y no presenta resultados empíricos.
Participantes y reclutamiento
Los participantes eran estudiantes a tiempo completo de grado o posgrado matriculados en universidades de China continental. Los criterios de elegibilidad eran tener 18 años o más, matriculación universitaria actual, capacidad para leer chino simplificado y uso regular de al menos una red social. Se excluyó a los participantes si tenían menos de 18 años, no estaban matriculados actualmente como estudiantes universitarios, se habían unido a la prueba piloto, presentado un cuestionario incompleto, suspendido el ítem de la verificación de atención, completado el cuestionario en un tiempo irrealmente corto o mostrado respuestas por patrón en los ítems de la escala.
El reclutamiento se realizó a través de grupos de aviso universitarios, canales de anuncio de cursos y redes de asociaciones estudiantiles. El aviso de reclutamiento describía el estudio como una investigación sobre la evaluación de la información online sobre desastres por parte de estudiantes universitarios. No reveló antes de la participación que algunas publicaciones contenían elementos engañosos, porque la divulgación previa cambiaría la tarea de verificación. El uso de estudiantes universitarios chinos se justificó porque esta población se encuentra con frecuencia con desinformación en redes sociales y reporta incertidumbre al evaluar la credibilidad enlínea 13.
Determinación del tamaño de la muestra
El tamaño objetivo de la muestra se estableció antes de la recogida de datos. El estudio pretendía retener al menos 400 respuestas válidas, con aproximadamente 50 participantes en cada una de las ocho células experimentales. Este objetivo soportaba comparaciones factoriales, pruebas de interacción y análisis de sensibilidad tras eliminar respuestas inválidas. Se invitó aproximadamente a 460 estudiantes a permitir cuestionarios incompletos, revisiones de atención fallidas y respuestas de baja calidad.
Dado que las asociaciones entre la percepción del riesgo y el comportamiento de búsqueda de información en emergencias suelen ser modestas entamaño 14, el estudio mantuvo un tamaño de célula lo suficientemente grande como para estabilizar las estimaciones del efecto principal y de interacción. El balance aleatorio entre las ocho celdas se evaluó utilizando pruebas de chi-cuadrado para variables categóricas de referencia y ANOVA unidireccional para variables de base continuas, antes de ajustar los modelos primarios.
La planificación de potencia y sensibilidad se definía antes del análisis. Con una muestra objetivo retenida de al menos 400 participantes y ocho células aleatorizadas, el estudio contó con un efecto adecuado para efectos principales de pequeños a moderados en modelos factoriales. El diseño no se basó para hacer afirmaciones confirmatorias sólidas sobre interacciones a tres, mediación, moderación o efectos de subgrupos de regresión logística. Por lo tanto, los análisis de interacción, mediación, moderación y verificación binaria de precisión se trataron como secundarios o exploratorios e interpretaron a partir de los modelos factoriales primarios.
Materiales experimentales
Se crearon ocho publicaciones simuladas en redes sociales para el diseño 2 × 2 × 2. Cada publicación describía una situación plausible relacionada con un desastre relevante para los estudiantes universitarios, incluyendo lluvias intensas, inundaciones urbanas, interrupciones temporales en el transporte, recordatorios de seguridad en el campus o preparación ante emergencias a corto plazo. Las publicaciones usaban un diseño tipo captura de pantalla similar a las publicaciones chinas en redes sociales públicas y contenían una etiqueta de fuente, un titular, un breve texto principal, una marca de tiempo, indicadores de interacción y elementos de interfaz sencillos. No se utilizó ningún lugar real del desastre, ni víctima real, evento de emergencia real, anuncio oficial real ni publicación identificable de una agencia pública.
Las versiones precisas contenían información internamente coherente y consejos de protección proporcionados, como comprobar las actualizaciones oficiales, evitar carreteras inundadas y preparar las necesidades básicas. Las versiones engañosas usaban afirmaciones exageradas de amenaza, atribuciones vagas, predicciones no fundamentadas o declaraciones de urgencia noverificables 15. La condición de fuente oficial usaba una etiqueta ficticia de gestión de emergencias verificada, mientras que la condición de fuente entre pares usaba una cuenta normal de estudiante o compañero reenviada. Los nombres de origen, ubicaciones, marcas de tiempo, indicadores de compromiso y detalles de la interfaz eran ficticios. Las descripciones completas de los ocho estímulos se proporcionan en la Tabla 2 para que los lectores puedan evaluar la independencia de la fuente, la veracidad y las manipulaciones tonales.
Prueba piloto de estímulos
Se realizó una prueba piloto con 30 estudiantes universitarios que cumplían los mismos criterios de elegibilidad pero no fueron incluidos en el experimento principal. Los participantes valoraron cada publicación en cuanto a realismo, intensidad emocional, credibilidad de la fuente, claridad en la redacción y precisión percibida utilizando escalas de 5 puntos. También indicaron si alguna publicación parecía referirse a un evento real reciente de desastre o a un anuncio gubernamental real.
Las pruebas piloto se utilizaron para comprobar el realismo y la claridad de la manipulación en lugar de hacer que publicaciones engañosas fueran obviamente falsas, porque la desinformación puede seguir siendo mal juzgada incluso bajo condiciones de procesamientoatento 16. Los estímulos se revisaban cuando la redacción era poco clara, el contraste emocional era demasiado débil, la redacción de amenazas era excesiva o el contenido parecía demasiado similar a un evento real.
Se mantuvieron tres ítems de manipulación-verificación en el cuestionario principal. Los participantes identificaron si la publicación parecía provenir de una fuente oficial o no oficial, si parecía precisa o dudosa, y cuán amenazante emocionalmente resultaba la redacción. Los participantes no fueron excluidos solo por juzgar mal la veracidad de una publicación, ya que el juicio erróneo formaba parte del fenómeno medido. La exclusión se aplicaba solo cuando se producía un reconocimiento fallido de manipulación junto con un comportamiento de respuesta inválido, como una prueba de atención fallida o respuestas con patrones.
Procedimiento experimental
El experimento se llevó a cabo a través de una plataforma de encuestas en línea accesible desde smartphone u ordenador desde el 3 de marzo de 2026 hasta el 21 de marzo de 2026. Tras abrir el enlace, los participantes consultaron una página electrónica de consentimiento informado que describía el propósito general, la participación voluntaria, el tiempo estimado de finalización, los procedimientos de confidencialidad, la posible leve incomodidad por contenido relacionado con desastres y el derecho a retirarse antes de la entrega. Los participantes confirmaron que tenían al menos 18 años y aceptaron participar antes de introducir el cuestionario.
Los participantes completaron primero las medidas de referencia, incluyendo características demográficas, uso diario de redes sociales, experiencias previas con desastres, percepción de alfabetización informacional y confianza general en la información oficial de emergencia. La plataforma asignó aleatoriamente a cada participante una de las ocho celdas experimentales utilizando aleatorización integrada a nivel individual. Los participantes vieron una publicación simulada y no pudieron volver a páginas anteriores tras completar la sección post-exposición.
Inmediatamente después de la exposición, los participantes completaron medidas de riesgo percibido, credibilidad percibida, respuesta emocional, intención de verificación e intención de compartir. La tarea de verificación requirió elecciones conductuales concretas en lugar de solo valoraciones de intención, porque la confianza de los usuarios jóvenes en detectar desinformación no se traduce necesariamente en una identificación precisa en entornos digitalesrealistas 17. Los participantes seleccionaron acciones de verificación de una lista fija antes de pasar a la página de informe.
Al final del cuestionario, todos los participantes recibieron un informe inmediato. La página indicaba que la publicación fue creada con fines de investigación, señalaba que algunas versiones contenían elementos engañosos y recordaba a los participantes que verificaran las afirmaciones relacionadas con desastres a través de canales oficiales de gestión de emergencias antes de compartirla. También se instruyó a los participantes a no copiar, guardar ni reenviar ningún material de estímulo fuera del estudio.
Medidas
La percepción del riesgo se midió con cinco ítems que cubrían la gravedad percibida, la probabilidad, la relevancia personal, el impacto en el campus o la comunidad, y la necesidad de precaución. Estos ítems reflejaban la visión establecida de la percepción del riesgo como un juicio subjetivo que implica consecuencias percibidas, incertidumbre ycontrolabilidad 18. Las respuestas se registraron en una escala de Likert de 5 puntos, desde 1 = fuertemente en desacuerdo hasta 5 = totalmente de acuerdo. Puntuaciones más altas indicaban un mayor riesgo percibido.
La credibilidad percibida se midió con cuatro ítems que evaluaron si la publicación parecía creíble, precisa, fiable y digna de confianza. La intención de verificación se midió con cuatro ítems: la disposición a consultar los canales oficiales, buscar pruebas que lo respalden, comparar múltiples fuentes y retrasar el reenvío antes de la confirmación. La intención de compartir se midió con tres ítems que evaluaban la disposición a republicar, reenviar a compañeros o recordar a otros basándose en la publicación. La intención de verificación de hechos se trató como un concepto separado porque investigaciones previas en redes sociales la vinculan con la alfabetización informativa y los juicios de confianza19.
La alfabetización informacional se midió antes de la exposición con seis ítems que cubrían la evaluación de fuentes, la verificación cruzada de hábitos, el reconocimiento de titulares engañosos, la conciencia del encuadre emocional, la capacidad para distinguir información oficial de la no oficial y la disposición a consultar fuentes autorizadas. La experiencia previa en desastres se midió con dos ítems: la experiencia personal de desastres naturales o interrupciones de emergencias y búsquedas previas en línea de información relacionada con desastres. La confianza general en la información oficial de emergencia se midió con tres elementos.
El comportamiento de verificación se calificó utilizando una regla de respuesta múltiple basada en tareas. Los participantes podían seleccionar cualquiera de ocho acciones: consultar una página web oficial de gestión de emergencias, buscar una cuenta gubernamental verificada, comparar la afirmación con medios reconocidos, consultar la página de aviso de emergencia de la universidad, preguntar a un amigo no especificado, leer solo comentarios, reenviar primero y comprobar después, o no hacernada 20. Las primeras cuatro acciones se codificaron como acciones de verificación fiables, y cada una recibió un punto; Las últimas cuatro acciones se codificaron como respuestas pasivas, poco fiables o de compartición prematura y no recibieron puntos. Por tanto, la puntuación de comportamiento de verificación continua osciló entre 0 y 4. Una variable binaria de precisión de verificación se codificaba como 1 cuando un participante seleccionaba al menos una acción de verificación fiable y no seleccionaba reenvío antes de la verificación. Las definiciones de variables, números de ítem, reglas de codificación y construcción de puntuación se proporcionan en la Tabla 3.
Control de calidad de datos
El control de calidad de los datos se completó antes del análisis estadístico. De 460 respuestas presentadas o iniciadas, 34 fueron excluidas y 426 se conservaron para análisis. La secuencia de exclusión se fijó de antemano: inelegibilidad por edad, condición de no estudiante, cuestionario incompleto, participación en el examen piloto, fallo en la comprobación de atención, tiempo de finalización irrealmente corto y respuesta con patrones. El tiempo de finalización se consideraba irrealmente corto si era inferior a un tercio del tiempo medio de finalización. Las respuestas lineales solo se eliminaban cuando aparecían junto con pruebas de atención fallidas o tiempos de finalización irrealmente cortos.
Las presentaciones duplicadas o sospechosas fueron evaluadas utilizando indicadores de encuesta no identificativos, incluyendo patrones de respuesta repetidos y tiempos de envío anormales. No se exportaron nombres, números de identificación de estudiantes, números de teléfono, nombres de cuentas de redes sociales, imágenes faciales, ubicaciones precisas, direcciones IP o identificadores de dispositivos para su análisis. Los casos con valores faltantes en variables de resultado primarias fueron excluidos del análisis principal. Dado que el cuestionario requería completar los ítems experimentales principales antes de la entrega, se esperaba que la ausencia en las variables primarias fuera mínima. Los criterios de selección y las definiciones operativas se enumeran en la Tabla 4.
Consideraciones éticas
El estudio utilizó ocultación limitada solo para la presencia de elementos engañosos en algunas publicaciones. No ocultaba el tema general, el tipo de tarea, la naturaleza voluntaria, los procedimientos de confidencialidad ni la posible leve incomodidad. Este ocultamiento fue necesario para preservar la validez de la tarea de verificación y fue seguido por un informe inmediato. Los materiales relacionados con desastres evitaron ubicaciones reales, víctimas reales, casos de emergencia reales, imágenes gráficas y anuncios gubernamentales reales porque el manejo irresponsable de la desinformación de emergencia puede aumentar la ansiedad e interferir con la respuesta públicaadecuada 21.
El conjunto de datos anonimizado contenía únicamente variables de investigación y códigos de participantes generados aleatoriamente. Las exportaciones de encuestas en bruto, datos analíticos filtrados, archivos de libros de códigos, materiales de estímulo y sintaxis estadística se almacenaban por separado en un ordenador protegido por contraseña accesible solo para el equipo de investigación. No se exportó, analizó ni compartió información personal identificable.
Análisis estadístico
El análisis estadístico se realizó utilizando las versiones 27.0 y R 4.3 de IBM SPSS Statistics. Las variables continuas se resumieron como medias y desviaciones estándar. Las variables categóricas se resumieron como frecuencias y porcentajes. La consistencia interna de escalas de varios ítems se evaluó utilizando el alfa de Cronbach, considerando α ≥ 0,70 aceptable para el análisis a nivel de grupo.
Antes de la prueba de hipótesis, se examinaban las pruebas de manipulación. Las pruebas t de muestras independientes compararon la intensidad emocional percibida entre condiciones neutrales y de alto riesgo. Las pruebas de chi-cuadrado examinaron el reconocimiento de las señales oficiales frente a las de fuentes de su par. Se compararon las valoraciones de precisión percibidas entre publicaciones precisas y engañosas. Se examinó el balance aleatorio en las ocho células experimentales antes de ajustar los modelos de resultado.
Los resultados principales fueron percepción del riesgo, credibilidad percibida, intención de verificación, intención de compartir y la puntuación continua de comportamiento de verificación basada en tareas. La variable binaria de verificación de precisión, los términos de interacción más allá de los contrastes bidireccionales planificados, los modelos de mediación, moderación y robustez se trataron como secundarios o exploratorios. Se utilizaron modelos ANOVA factoriales y generales lineales para resultados primarios continuos. Se incluyeron términos de interacción bidireccional y tripartita para examinar si el efecto de la veracidad de la información variaba según la pista de la fuente o el tono emocional. Se utilizó regresión logística para la precisión binaria de la verificación, reportándose razones de probabilidades e intervalos de confianza del 95%.
Los modelos de mediación y moderación se trataron como análisis secundarios. La credibilidad percibida fue puesta a prueba como mediador entre la pista de la fuente y la intención de verificación. La percepción del riesgo se evaluó como mediador entre el tono emocional y la intención de compartir. Se evaluó la alfabetización informacional como moderador de la asociación entre la credibilidad percibida y la intención de compartir. Debido a que las respuestas a la desinformación se forman por la evaluación cognitiva, el juicio de confianza y el compartir motivación en lugar de la precisión del mensajesola, estos modelos se interpretaron a partir de los modelos factoriales primarios. Se estimaron efectos indirectos utilizando 5.000 remuestreos bootstrap.
Las comprobaciones de robustez se realizaron en tres pasos. Primero, se repitieron los modelos principales tras excluir a los participantes que fallaron en ningún ítem de manipulación-comprobación. En segundo lugar, los modelos se ajustaron por género, nivel educativo, uso diario de redes sociales, experiencia previa de desastres y confianza base en la información oficial de emergencias. En tercer lugar, el comportamiento de verificación se analizó tanto como una puntuación continua como una variable binaria de precisión. La significación estadística para los resultados primarios se estableció en p < 0,05. Los análisis secundarios se interpretaron mediante la dirección del efecto, intervalos de confianza y consistencia con los modelos primarios, en lugar de solo por valores p marginales. Los tamaños de efecto se informaron como eta al cuadrado parcial, d de Cohen, coeficientes estandarizados o razones de probabilidades según el tipo de modelo.
Gestión de datos y reproducibilidad
El conjunto de datos analítico anonimizado contenía una fila por participante y una columna por variable. Incluía código de participantes, condición experimental, variables demográficas, medidas de referencia, ítems de manipulación-comprobación, resultados post-exposición, indicadores de comportamiento de verificación, puntuaciones compuestas y indicadores de exclusión. Los códigos de los participantes se generaron aleatoriamente y no estaban vinculados a la identidad del estudiante.
Las puntuaciones compuestas se calcularon promediando los ítems válidos dentro de cada escala tras confirmar la dirección del ítem. Puntuaciones más altas indicaban consistentemente niveles más altos del constructo medido. La codificación inversa se aplicaba solo cuando la redacción del ítem lo requería. El registro de limpieza de datos documentaba todas las exclusiones, decisiones de recodificación, cálculos de puntuaciones compuestas y especificaciones del modelo. El paquete de reproducibilidad incluía el conjunto de datos analítico anonimizado, el libro de códigos, descripciones de estímulos, registro de cribado y sintaxis estadística. Se mantuvo una documentación transparente del diseño de estímulos, la aleatorización, las reglas de exclusión, los procedimientos de puntuación y la sintaxis del análisis para apoyar la reproducibilidad en la investigación de desinformación y comunicaciónde riesgos 23.