方法文章

将基于课程的竞赛融入战略管理教学:一项可复现的课程改进方案

DOI:

10.3791/72235

2026年8月18日

本文内容

摘要

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

本方案通过分阶段的团队任务、结构化反馈、评分者培训、实施保真度监控以及独立的学生层面和团队层面结果评估,将诊断—决策—辩护竞赛流程融入本科阶段的战略管理教学中。

摘要

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

战略管理教学要求学生将分析框架应用于不确定、资源受限且存在权衡的商业情境中。当课程竞赛被组织为一个结构化的教学系统,而非单一的展示活动时,可有效支持这一学习过程。本文描述了一项可复现的教学方案,用于在本科阶段的战略管理课程中整合一个分为三个阶段的课程内竞赛。该方案遵循为期16周的教学流程,包括基线评估、核心讲授、企业案例引入、小组组建、战略诊断、战略决策模拟或决策表填写、最终战略答辩、课程后评估以及课程回顾。该教学机制融合了分阶段练习、企业案例学习、结构化形成性反馈、小组责任机制、口头答辩以及基于评分量规的打分方式。通过本地化实施的过程指标,对课堂互动、案例设计完整性、反馈及时性、任务与量规的一致性、学生参与度以及实施保真度进行监控。分别分析学生层面的学习成果、小组层面的竞赛结果、评分者一致性、缺失数据模式、人工智能使用披露情况以及分数虚高预警模式,以避免分析单位错误。所报告的代表性结果应被解读为来自回顾性、非随机化教育记录比较的情境特异性实施产出,而非因果有效性的证据。该方案为在课程改进周期内设计、实施、记录、评估和优化融合竞赛的战略管理教学提供了可审计的操作流程。

引言

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

战略管理课程要求学生超越概念记忆。学生必须在信息不完整和优先事项相互冲突的条件下,应用诸如行业结构、竞争优势、资源配置、战略选择及实施等理念。竞争定位理论解释了企业在外部约束条件下如何选择自身定位1,而基于资源的观点则强调影响战略选择的企业特有资源与能力2。这些视角使得战略管理适合采用应用型教学设计,使学生能够诊断商业情境、做出战略决策、论证所选方案,并在获得反馈后修正其推理过程。讲座和孤立的案例讨论仍然具有价值,但可能无法充分揭示学生如何应对不确定性、权衡取舍以及实施中的限制因素。只有当课程内竞赛与课程目标、任务顺序、评分标准和反馈循环紧密结合时,才能营造出更高要求的学习环境。若缺乏这些要素,竞赛可能奖励的是展示时的自信或任务分工能力,而非战略思维能力。

以往关于商业游戏和模拟的研究表明,这些活动若要作为教育方法而非课堂娱乐发挥作用,必须具备明确的规则、决策周期、评估依据以及总结反思环节3,4。主动学习的效果也取决于任务设计,而不仅仅是活动本身。学生可能看似投入,但实际上仍停留在对概念的浅层应用。因此,一个结构化的战略管理竞赛应要求学生分析情境、论证决策、获得形成性反馈、修正推理过程,并阐明实施方案。这一过程体现了主动学习的原则,因为学生是在自主构建、检验和改进其推理能力,而不仅仅是被动接受讲授5。同时,这也符合体验式学习的特点,因为竞赛循环将具体案例接触、反思性分析、决策制定与改进后的行动紧密联系在一起6

已发表的商业模拟与竞赛报告在程序细节上差异较大。一些报告描述了模拟或竞赛的使用,但在团队组建、任务分阶段、反馈时机、评分者培训、评分量规构建、缺失数据处理以及个人与团队成果的区分等方面提供的信息有限。以往的综述和分类研究也表明,商业游戏并非单一的教学方法;它们在规则、仿真度、学习者角色、决策结构、技术应用、评估设计和复盘程序等方面均存在差异7,8。因此,一个可重复的战略管理实验方案不仅需要说明竞赛的发生,还需明确竞赛如何融入课程,以及其实施过程如何被监控。

本方案最好被理解为一种集成了多重要素的竞争性课程改进体系。预期的教学效果不能仅仅归因于竞争环节,因为该方案还包括企业案例接触、反复练习、结构化反馈、团队责任机制、公开答辩、评分者校准以及系统性的课程回顾。竞争元素在教育上具有价值,因为它能创造截止期限、比较机制、责任要求和公开论证的需求,但这些要素是有意与分阶段的学习任务和评估控制相结合的。该教学程序在三个方面区别于传统的体验式、基于模拟以及基于竞赛的战略管理教学方法。第一,竞争贯穿诊断、决策和最终答辩三个阶段,而非集中于一次最终展示。第二,在解读学习成果之前,会先监控实施的保真度。第三,将学生个体层面的学习成果与团队层面的竞赛结果分开。这一区分至关重要,因为一个团队在最终答辩中可能表现良好,但部分成员的个体学习水平却有限。团队学习需要责任机制、互动交流和共同推理,而不仅仅是团队成员身份9。因此,本方案采用团队章程、过程记录日志、同伴贡献评估表、评分者培训、评分者一致性核查以及分数虚高预警规则。

该方案作为常规教学活动,在中国科学技术大学珠海学院商学院的本科战略管理课程中实施。实施该方案的课程班为2025-2026学年秋季学期的SM-2025-F01班。对照组为历史对照组,即2024–2025学年秋季学期的SM-2024-F01班。实施方案的课程班共招收96名学生;在获得伦理审批后、纳入研究数据集之前,有94名学生提供了书面或电子形式的同意书,授权将去标识化的课程记录用于研究;其中2名学生因在第8周前退课或缺乏任何有效的课程后评估结果而被排除,最终纳入分析的方案组为92名学生。历史对照班共招收92名学生;在获得伦理审批后、进行回顾性数据提取前,有90名学生同意将其去标识化的课程记录用于研究;根据相同的缺失数据和退课排除标准,2名学生被排除,最终纳入分析的对照组为88名学生。

两个队列均由大学三年级的商科学生组成,专业包括工商管理、市场营销、电子商务和国际商务。实验组队列包括51名女性和41名男性学生,平均年龄为20.4 ± 0.7岁;对照组队列包括49名女性和39名男性学生,平均年龄为20.5 ± 0.8岁。实验组队列中有27名学生、对照组队列中有24名学生报告曾有竞赛经验。在最终分析前,实验组队列的失访率为4.2%,对照组队列为4.3%。实验组队列中缺失的数据包括:2份基线知识测试、3份课程后知识测试、4份课程后学习调查问卷以及4份不完整的竞赛任务记录。对照组队列中缺失的数据包括:3份基线知识测试、4份课程后知识测试、5份课程后学习调查问卷以及70份不完整的竞赛任务记录,原因是历史课程未包含完整的三阶段竞赛流程。

对照组接受了传统的基于案例的战略管理教学,但未包含完整的三阶段竞赛流程。两个组别均由同一位教师授课。两个组别在课程学习目标、核心战略管理主题、知识评估覆盖范围、个人案例分析评估以及最终课程评分结构方面均保持一致。实验组额外接受了企业案例包、分阶段的竞赛任务、结构化的反馈循环、正式的团队过程记录、评分者培训流程以及实施保真度监控。本文将该方案描述为一种可重复的课程改进方法,而非对其因果有效性提出的主张。代表性结果展示了该方案所产生的实施情况、教学质量和学生层面、团队层面的表现、评分信度、缺失数据及问题排查输出等类型的数据。由于该比较属于历史性的、非随机化的且具有特定情境性的,因此组间差异应被解读为在特定实施背景下课程改进的证据,而非证明课程内竞赛本身单独导致了所观察到的结果。

本方案的总体目标是帮助教师设计、记录、评估和优化融入竞赛的战略管理教学。通过将教学活动、学生产出、评分量规、实施记录和课程评审决策相互关联,该方案支持学习保障工作的开展10。同时,该方案也回应了游戏化教学与竞争性学习研究中的关切:当过度强调动机而忽视任务设计、反馈质量及评估有效性的充分关注时,游戏化元素可能产生不一致的教学效果11,12。预期产出包括实施记录、本地可操作的教学质量指标、学生层面的学习成果、团队层面的竞赛结果、评分者一致性证据、人工智能使用披露文件、缺失数据记录以及问题排查记录。

方案

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

本研究使用两个队列的去标识化教育记录已获得中国珠海科学技术学院教学研究伦理委员会批准(批准号:20260507001;批准日期:2026年5月7日)。该批准涵盖方案队列和历史对照队列,包括常规课程记录、调查问卷、课堂观察、团队过程记录、竞赛成绩、评分者评分、学习平台记录以及去标识化的成绩册变量。16周的课程在数据提取用于研究之前,已作为常规的战略管理教学实施,且在获得伦理批准之前,未提取、编码、分析或报告任何可识别的研究数据集。在获得伦理批准后、纳入数据集之前,已获取学生关于去标识化课程记录用于研究的书面或电子知情同意。课程参与与研究数据使用相互分离;未同意参与研究的学生仍正常完成课程,但其数据不纳入研究分析。同意记录与成绩册分开保存,身份代码文件仅限数据管理员访问,且仅在提交成绩、确认同意、分配代码并删除直接标识信息及可识别的自由文本评论后,才生成用于分析的数据集。

1. 建立融合竞赛的课程改进方案。

  1. 将本方案定义为一个为期16周、融合竞赛机制的本科《战略管理》课程改进流程。教学机制采用分阶段的“诊断—决策—答辩”循环,将战略分析、基于证据的决策、反馈、团队责任、口头答辩和课程回顾有机衔接。
  2. 通过课堂互动、案例设计完整性、反馈及时性、任务与评分标准的一致性以及学生参与度来定义教学质量;通过计划活动完成率、企业案例或案例课次完成率、任务完成率、反馈周转时间、评分标准完成率、课堂观察完成率以及评分员培训完成率来定义实施保真度。仅在信度和维度证据支持的前提下,才对指标进行汇总。
  3. 在课程实施前,对学习成果、教学活动、竞赛任务、评分标准、反馈节点和结果测量工具进行对齐,以保持建构性一致性13
  4. 设定课程主讲教师、竞赛协调员、企业联络人、课堂观察员、评分员协调员和数据管理员等角色。在规模较小的教学项目中,教学角色可合并担任,但数据管理员应尽可能与最终评分及研究数据集的准备工作相分离。
  5. 准备一个版本受控的课程实施文件夹,包含教学大纲、案例文件、手册、任务模板、评分标准、观察表单、调查问卷、团队记录、评分表、反馈日志、人工智能使用披露表以及版本控制记录。在获得伦理审查批准后,建立一个研究可重复性文件夹,包含审批记录、知情同意验证记录、去标识化日志、去标识化数据集、数据字典、数据清洗日志、分析脚本、统计输出结果、图表源文件、表格以及补充文件(图1材料表;操作模板见 补充文件1)。

figure-protocol-1
图1:整合竞争机制的战略管理课程改进方案的工作流程。该流程图展示了从课程准备到16周常规课程实施、常规教学记录生成、成绩提交、经伦理批准的研究用途准备、知情同意验证、去标识化、数据集锁定、数据分析、结果报告、问题排查及课程优化的完整流程。图中将常规教学活动与成绩提交后的研究数据提取和分析过程进行了区分。请点击此处查看此图的放大版本。

2. 招募学生队列并准备研究数据集。

  1. 纳入正式注册参加所选本科战略管理课程班级的学生。记录学校名称、学年、学期、班级、队列类型、专业、年级、教学周数、课时数、注册人数、同意参与的样本量、排除标准、最终分析样本量、人口统计学信息、先前竞赛经历、失访情况以及缺失数据的数量。
  2. 将接受完整竞赛整合教学方案的班级定义为方案队列,将接受传统基于案例的战略管理教学(不含完整的三阶段竞赛流程)的历史班级定义为对照队列。记录两个队列是否由同一教师授课,以及学习成果、考核覆盖范围、个人案例分析要求和评分结构是否具有可比性。
  3. 在获得伦理审查批准后,核实学生的知情同意情况,分配非可识别的学生和团队编码,移除直接标识信息,并应用表1中的纳入、排除及缺失数据处理规则。
  4. 纳入至少拥有一项有效课程后测结果的同意参与者。若某学生缺少任一知识测试数据,则将其排除于配对知识分析;若某学生三项任务记录全部缺失,则将其排除于与竞赛相关的分析。其余符合条件的分析应保留其可用记录。
  5. 将缺失的研究数据编码为 NA。除非零分在经批准的课程政策下代表实际课程得分,否则不得赋值为零。为每个队列创建参与者流程记录。
项目操作定义应用规则数据集变量分析意义
目标课程在选定学期开设的本科战略管理课程纳入正式注册该课程班次的学生course_section界定符合条件的教学人群
方案队列接受完整竞赛整合式课程改进方案的班级编码为1cohort_type方案队列
历史对照队列接受传统案例教学法战略管理课程、未实施完整三阶段竞赛流程的历史班级编码为0cohort_type非随机化历史对照队列
正式注册学生出现在官方课程名单中视为潜在合格对象eligible_status研究用途筛选前的必要条件
研究知情同意学生在伦理审批后提供书面或电子形式的同意,允许使用去标识化的课程记录仅将同意参与的学生纳入研究数据集consent_status未同意的学生正常完成课程,但不纳入研究分析
课程参与无论是否同意参与研究,均完成常规课程学习活动允许所有注册学生上课、组队、完成课程任务并获得成绩course_participation_status区分教学参与与研究参与
有效的课程后结果至少有一个有效的课程后结果数据可用在相关结果数据可用的情况下纳入分析outcome_available支持可用案例分析
课程中途前退课学生在第8周前退课从最终研究数据集中排除withdrawal_status减少暴露不完全偏倚
基线知识测试缺失第1周知识测试缺失编码为NApre_knowledge_missing仅从配对知识分析中排除
课程后知识测试缺失第16周知识测试缺失编码为NApost_knowledge_missing仅从配对知识分析中排除
两次知识测试均缺失基线和课程后知识得分均缺失从知识得分分析中排除knowledge_pair_status若其他数据可用,仍可保留用于其他合格分析
课程后调查缺失匿名课程后调查缺失编码为NAsurvey_missing在客观绩效分析中予以保留
缺失一至两项竞赛任务记录缺失一至两项任务或对应项目记录除非课程政策规定记为零分,否则将缺失记录编码为NAtask_score_missing保留可用的任务或对应项目记录
三项竞赛任务记录全部缺失任务1、任务2或任务3均无有效记录从与竞赛相关的分析中排除competition_completion若其他结果数据可用,仍可保留用于非竞赛相关分析
重复记录同一学生代码出现多行记录在核对源文件后保留经核实的最终记录duplicate_check分析前必须解决
标识符泄露出现姓名、学号、电话号码、电子邮件、平台账户、设备标识符或可识别的自由文本评论分析前需移除标识符identifier_check数据集在去标识化前不得进行分析
最终分析样本在排除和缺失数据规则处理后,具有可用数据的同意参与者报告最终人数及排除原因analysis_sample用于参与者流程报告的必要信息

表1:队列结构、纳入标准、排除标准和缺失数据处理规则。 本表定义了研究方案队列、历史对照队列、入组标准、研究使用许可、排除标准、缺失数据处理方法以及分析样本的构建方式。

3. 实施16周的课程安排。

  1. 课程持续16个教学周,包含32个课堂授课学时,以及约24–30个独立团队合作学时。需分别记录授课学时、团队合作时间、案例互动、反馈、排练及评估时间。
  2. 第1周进行课程说明会、基线知识测试和基线参与度调查,作为常规课程活动。讲解课程流程、任务顺序、评估规则、数据保护原则,以及去标识化记录后续用于研究的说明。第2–3周讲授核心战略管理内容,并在第4–15周期间进行短期概念强化。
  3. 第4周发放企业案例包和竞赛手册,内容包括任务顺序、提交规则、评分标准、反馈时间表、团队责任、学术诚信规定、人工智能使用披露要求、口头核查程序及申诉流程。
  4. 第5–6周实施任务1,并于第7周7个日历日内返回反馈。要求在开展任务2之前完成战略问题陈述的修订14。第8–10周实施任务2,第11周安排企业导师或结构化案例辅导,第12–15周实施任务3。
  5. 第16周进行课程结束后的知识测试、课后调查、数据审核和课程回顾,作为常规课程活动。在获得伦理审批、确认知情同意、成绩提交后,方可导出、编码、去标识化并仅用于研究目的的数据分析(见Table 2)。
    暂停节点:若团队分配、案例文件、手册、评分标准、人工智能披露表、任务模板或数据记录表尚未完备,则在第4周后暂停。为研究报告目的,须待伦理审批、知情同意确认、成绩提交、去标识化及数据集锁定全部完成后,方可暂停并开始分析。
活性教学重点学生或团队成果必需记录质量检查
第1周课程简介与基线评估课程流程、评估规则、基础知识测试、基础参与度调查基线知识测试;基线调查出勤;基线测试文件;基线调查文件;课程简介记录确认基线评估完成,并将常规课程记录与后续研究用途分离
第2周核心战略管理教学 I环境分析,行业分析,竞争对手分析课堂练习工作表出勤;工作表记录检查工作表完成情况
第3周核心战略管理教学 II内部资源分析、战略选择、实施规划、绩效评估简短病例讨论回应出勤;病例讨论记录在竞赛启动前确认核心概念
第4周企业案例介绍与竞赛说明案例包装、手册、任务顺序、评分标准、人工智能披露、团队规则、申诉程序团队名单;团队章程;人工智能使用声明团队名单;团队章程;手册访问记录;案例访问记录若案例文件、手册、评分标准、团队记录、任务模板或人工智能使用表单不完整,则暂停
第5周任务1开始战略性诊断报告结构与证据要求草拟战略诊断报告团队过程日志;咨询记录确认团队角色分配
第6周任务1提交战略诊断、产业与内部分析、证据应用最终任务1报告投稿记录;报告文件识别缺失或格式不正确的提交内容
第7周任务1 反馈基于评分标准的反馈与修改指导修订后的战略问题陈述反馈日志;反馈处理记录暂停如果 >15% 的报告未能达到规定的结构要求
第8周任务2开始决策表、模拟假设、决策变量初始战略决策表团队过程日志;观察记录确认对决策变量的理解
第9周战略决策优化市场定位、资源分配、实施顺序、风险假设修订版决策表执教记录;观察核对表检查基于证据的合理性
第10周任务2提交最终战略决策逻辑最终任务2决策表任务2得分;提交记录;决策表文件检查投稿完整性
第11周企业或结构化案例辅导基于战略困境的导师指导或案例反馈导师反馈表;团队修订计划企业参与日志;学生问题;反思记录确认出席及反思完成情况
第12周任务3开始最终答辩格式、执行摘要、幻灯片结构、问答&A 规则撰写演示文稿提纲团队过程日志;人工智能披露更新使用同行贡献表检查工作量分配平衡
第13周最终答辩准备战略一致性、可行性、风险控制、证据应用草拟幻灯片文稿;执行摘要辅导记录;观察检查表确认诊断-选择-实施关联
第14周排练与评分者校准排练答辩与评分员培训排练演示评分员培训记录;初步评分标准检查确认评分校准
第15周最终策略答辩8分钟报告和5分钟问答&A最终幻灯片演示文稿;执行摘要;口头答辩任务3评分;评分者评分;Q&A 注释计算重叠主观评分的组内相关系数
第16周课程结束后评估与课程回顾课程后知识测试,课程后调查,课程评审,常规数据审核课程后知识测试;课程后调查问卷课程后测试文件;调查文件;课程评价记录在成绩提交、伦理审批、知情同意验证、数据去标识化及数据集锁定完成之前,暂停科研分析

表2:为期16周的竞赛融合型战略管理课程实施方案时间表。 本表格总结了16周课程中每周的方案活动、教学重点、学生或团队产出、所需记录以及质量控制检查点。

4. 准备企业案例和竞赛材料。

  1. 从公开、匿名或企业授权的教学材料中选择一个主要企业案例和两个可选的辅助案例。针对每个案例,筛选其行业背景、管理决策问题、资源限制、战略权衡、实施挑战以及可衡量的结果。采用“案例设计完整性”作为标准,而非“案例真实性”,除非具备独立验证依据。
  2. 当无法获取企业授权材料时,准备一个匿名的示范案例。明确说明行业、企业规模、客户群体、竞争压力、资源限制、战略决策、实施风险以及预期结果。在未经书面许可的情况下,删除所有保密的企业信息,包括公司名称、确切财务数据、客户信息、员工信息、专有数据和战略文件。案例模板详见补充文件1
  3. 准备手册、任务模板、同伴贡献表、团队过程日志、反馈记录表、人工智能使用披露表、口头核查记录表、评分量规以及版本控制表。允许在语言润色、格式调整、语法检查、一般性头脑风暴和幻灯片布局优化中披露使用人工智能工具;禁止使用人工智能替代学生自主完成的诊断分析、证据选择、决策论证、风险分析、实施规划或口头答辩。
  4. 设计评分量规时,应优先评估战略推理能力而非文本表达的 polished 程度。将证据运用、权衡分析、实施可行性、内部一致性以及口头答辩表现与展示形式分开评分。在第4周前上传手册、模板、量规、案例材料、人工智能使用规则以及申诉程序。

5. 组建学生团队并分配团队角色。

  1. 组建由4至6名学生组成的团队。当可获取且符合院校课程政策时,可根据课程基线表现、专业、性别或先前竞赛经验进行分层分组。
  2. 在任务1开始前为每位学生分配一个主要角色。要求每个团队提交团队章程,并维护一份过程日志,记录角色分配、沟通规则、贡献期望、截止日期、人工智能使用责任、出勤情况、决策内容、所查阅的证据、未解决的问题以及后续行动。
  3. 在项目中期和最终阶段收集同伴贡献评分,以识别贡献不均的情况。在辅导、排练或最终答辩期间,通过随机选取学生,要求其用自己的语言阐述团队的诊断结论、证据基础、决策逻辑、风险假设或实施方案,进行个别口头考核。

6. 进行基线评估。

  1. 在第1周,在引入企业案例和竞赛任务之前,作为常规课程评估的一部分,实施基线战略管理知识测试。
  2. 使用包含24道题目的测试,评分范围为0至100分,涵盖环境分析、行业与竞争对手分析、内部资源分析、战略选择、实施规划以及战略评估。蓝图、题目开发规则、评审表和评分规则详见补充文件1
  3. 设计A卷和B卷,两份试卷在主题覆盖范围、题目形式、认知层次、分数区间、预期难度和评分规则方面相匹配,内容等效但不完全相同。邀请两名战略管理课程教师和一名商科教育评估专家对题目的相关性、清晰度、认知层次和主题覆盖范围进行评审,并在分析样本之外对24名学生进行两份试卷的试测。
  4. 在可行的情况下,保留难度值在0.30–0.80之间、区分度值高于0.20的题目。当KR-20或Cronbach’s α系数≥0.70时,视为内部一致性可接受。当试测中两份试卷的平均分差异≤3分且标准化差异<0.20时,视为两份试卷可用于配对使用。
  5. 在可行的情况下采用交叉平衡设计。将一半学生在基线阶段分配使用A卷、课程结束后使用B卷,另一半学生则在基线阶段使用B卷、课程结束后使用A卷。若采用固定顺序施测,需将其记录为研究局限性之一。
  6. 在知识测试完成后实施基线参与度调查。使用5点量表记录学生对战略管理的兴趣、对课程实用性的感知、案例分析自信心、参与团队任务的意愿、团队合作准备度以及先前的竞赛经验。除非信度和维度证据支持合成总分,否则应将概念上不同的项目分别分析。
  7. 在常规课程实施过程中记录基线出勤情况、知识测试完成情况、调查完成情况以及所使用的试卷版本。在获得伦理审批、确认知情同意、分配编码并去除直接标识信息后,导出基线数据仅用于研究目的。

7. 开展基于企业案例的战略管理教学。

  1. 通过简短讲座、引导式讨论、小组练习题和简要决策练习,开展基于案例的教学。运用主动学习任务,引导学生从概念理解逐步过渡到分析、决策、团队讨论和反思15
  2. 在条件允许时,邀请企业管理人员、创业者或行业导师参与。至少在授课前7天向其提供课程目标、学生水平、案例主题、保密要求、讨论重点及时间投入等信息。若无法安排现场导师,可采用匿名化或公开的案例简报替代。
  3. 呈现一个涉及市场不确定性、竞争压力、商业模式调整、资源限制、实施障碍或风险控制等非保密性战略问题。要求每个小组利用结构化练习表,识别问题本身、证据基础、备选方案、潜在风险及推荐决策。
  4. 要求每个小组提交一篇300–500字的反思报告,将案例问题与一个战略管理概念及一项实际竞争决策相联系。在企业参与日志中记录导师背景、案例来源、出勤情况、学生提问、练习表完成情况和反思报告提交情况。通过体验式学习活动,在整个竞赛周期中关联案例学习、反思、决策与修订过程16

8. 实施三阶段教学竞赛。

  1. 在第4周举行正式竞赛说明会。讲解任务流程、时间安排、评分标准、反馈规则、学术诚信要求、人工智能使用披露、口头核查程序以及申诉程序。
  2. 在第5至6周实施任务1,要求提交一份1,500–2,000字的战略诊断报告,内容涵盖行业分析、竞争对手分析、内部资源分析、战略问题诊断、证据运用以及初步建议。须在7个日历日内返回反馈意见,并以修订后的战略问题陈述作为任务2的起点。
  3. 在第8至10周实施任务2,形式为战略决策模拟或结构化决策表单,内容包括市场定位、资源分配、定价或成本逻辑、实施顺序、风险假设以及预期成果。
  4. 在第12至15周实施任务3,即最终战略答辩。要求提交8–12页的演示文稿、1,000–1,500字的执行摘要、8分钟的口头陈述以及5分钟的问答环节。须确认答辩内容能够衔接任务1的诊断结果、任务2的决策逻辑、实施计划、风险控制措施以及预期成果。
  5. 对全部三项任务采用100分制评分标准,并依据表3中的结构与评分维度进行评分。
    暂停节点:在任务1评分结束后,若超过15%的提交材料未遵循规定结构,或评分者发现评分描述不清晰时,应暂停流程。在任务2开始前,须修订任务说明或评分者指导文件。
任务所需输出主要内容评分评分维度
任务1:战略诊断报告第5–6周1,500–2,000词团队报告行业分析,竞争对手分析,内部资源分析,战略问题诊断,证据应用,初步建议100行业与市场分析,20
内部资源分析,20
战略问题诊断,20
证据使用,20
书面逻辑与清晰度,20
任务2:战略决策模拟或决策表第8至10周结构化团队决策表市场定位、资源分配、定价或成本逻辑、实施顺序、风险假设、预期结果100战略一致性,25
市场逻辑,20
操作可行性,20
风险分析,20
决策依据,15
任务3:最终策略答辩第12至15周8–12页幻灯片,1,000–1,500字执行摘要,8分钟报告,5分钟问答&A战略诊断,战略选择,实施计划,风险控制,预期成效100战略诊断,20
战略选择,25
实施可行性,20
创新,15
证据使用,10
口头答辩,10

表3:三阶段教学竞赛结构与评分维度。 本表定义了三项竞赛任务、实施周次、所需产出、主要内容要求、总分及评分维度。

9. 标准化评分并培训评分人员。

  1. 在人员允许的情况下,至少招募两名评分员进行主观评分;当无法提供第二名评分员时,记录为单评分员评分。
  2. 对评分员进行培训,内容包括评分量规、描述性指标、校准样本、常见评分错误、人工智能披露规则以及口头核查标准。评分员需独立评分两个校准样本,并对评分差异超过10分的情况进行讨论。
  3. 培训结束后锁定评分量规,并在整个实施周期中使用同一版本。当两名或以上评分员对同一份样本评分时,计算组内相关系数(ICC)。若ICC ≥ 0.75,则视为可接受;若ICC < 0.75或评分差异超过10分,则需进行评分校正。保留原始评分、校正后评分及校正记录。
  4. 采用基于量规的评分方式以明确评分期望并支持形成性评估17。具体操作请遵循补充表S1中的评分员培训、评分一致性及校正流程。

10. 收集教学质量和实施保真度数据。

  1. 通过课堂互动、案例设计完整性、反馈及时性、任务与评分标准的一致性以及学生参与度来评估教学质量。除非信度和维度证据支持合并,否则应分别分析各项指标。
  2. 使用“案例设计完整性”而非“案例真实性”,除非有独立的真实性验证可用。
  3. 通过计划活动完成率、企业或案例会话完成率、任务提交率、反馈处理周期、评分量表完成率、观察完成率以及评分者培训完成率来衡量实施保真度。
  4. 处理 表 4 将预定义的操作性质量控制规则而非未经外部验证的截断值作为阈值。这些阈值在研究分析前,依据初步可行性、教学团队共识以及工作量限制而设定。
  5. 使用指标、数据来源、阈值、预警规则和纠正措施 表 4. 其他故障排除步骤详见 补充表 S2.
  6. 当完成的计划周活动比例≥85%,协议队列中≥85%的学生完成全部三项任务,≥80%的反馈在7个日历日内收回,所有主要评分量表均已完成,且必要的观察记录可获取时,视为实施充分。当任务完成率 <75%,反馈超过14个日历日 >20% 的投稿,ICC 是 <0.75,或 >25% 的计划观测数据缺失。
类别指标数据来源时间点量表正向信号或阈值预警规则纠正措施
实施保真度计划活动完成情况课程实施日志第1–16周% 完成≥85% 的计划活动已完成<85% 完成审查遗漏的课程并修订进度控制
实施保真度企业实践或结构化案例课程企业参与日志第11周已实施 / 未实施计划课程已实施,或由结构化案例辅导替代计划课程缺失且无替代采用匿名案例课程或结构化案例辅导
实施保真度三阶段任务序列完成情况提交记录第6、10、15周% 学生≥85% 的协议队列学生完成全部三项任务<75% 完成全部任务简化说明并增加进度检查
实施保真度反馈及时性反馈日志第7、10、15周日历天数≥80% 的反馈在7天内返回>20% 的反馈在14天后返回缩短反馈表单并分散评分工作量
实施保真度观察完成情况观察表单第1–16周% 计划观察≥75% 的计划观察已完成>25% 的计划观察缺失增加备用观察员和固定观察时间表
评分质量评分者一致性评分者得分任务1子集和任务3答辩ICCICC ≥0.75ICC <0.75重新培训评分者,明确评分描述,校正受影响的分数
教学质量课堂互动观察清单选定课程1–5 分均值 ≥3.50 或提升 ≥0.30均值 <3.50加强讨论引导和促进策略
教学质量案例设计完整性案例检查清单第4周前0–5 或 1–5 分均值 ≥4.00均值 <3.50修订案例背景、决策问题、约束条件和后果
教学质量任务与评分标准一致性一致性检查清单第4周前及课程结束后回顾0–5 或 1–5 分均值 ≥4.00均值 <3.50修订任务-输出-评分标准-反馈的一致性
教学质量学生参与度出勤、参与、日志、调查项目第1–16周项目级或 1–5 分提升 ≥0.30 分下降 >0.30 分减轻负担过重,明确期望,增加形成性支持
学习成果战略管理知识基线与课程后测试第1周和第16周0–100均值提升 ≥5 分提升 <3 分审查教学覆盖范围、项目一致性及测试等效性
学习成果个体案例分析能力案例分析评分标准学期后期0–100协议队列优势 ≥3 分无优势或下降增加案例分析练习和带注释的示例
团队成果团队竞赛表现竞赛评分标准第6、10、15周0–100各任务间持续进步最终得分高但前期表现薄弱检查评分膨胀并重新平衡评分标准以强调推理能力
学生感知满意度课程后调查第16周1–5 分均值 ≥4.00均值 <3.50审查工作量、任务清晰度、反馈质量及团队协作
学生感知实际相关性课程后调查第16周1–5 分均值 ≥4.00均值 <3.50提高案例具体性及与真实战略决策的联系
工作量安全竞赛压力课程后调查第16周1–5 分或 %高压力学生 ≤20%高压力学生 >20%减少任务重叠并调整截止时间间隔
解释性警示天花板效应基线测试和调查第1周0–100 或 1–5基线知识 ≤85 且满意度 ≤4.50知识 >85 或满意度 >4.50谨慎解释微小提升
解释性警示评分膨胀团队与个体成果学期末模式判断团队进步伴随个体学习证据团队得分提升但个体学习未提升加强个体责任和基于推理的评分
团队过程同伴贡献均衡性同伴贡献表单中期和最终阶段1–5 分无重复性重大失衡一名或多名成员反复被评为极低要求重新分配角色并由教师介入检查
学术诚信人工智能使用透明度人工智能使用披露与口头核查每项主要任务已披露 / 未披露人工智能使用按机构规定披露未披露或不当使用人工智能执行机构学术诚信程序并明确人工智能使用规则

表4:实施保真度、教学质量和结果解释及故障排除指标。 本表列出了实施保真度指标、教学质量指标、学生层面和团队层面的结果指标、评分质量指标、解释阈值、预警规则以及纠正措施。

11. 收集课程结束后的结果数据。

  1. 在第16周使用与基线测试等效但非完全相同的课后形式,进行课后战略管理知识测试。
  2. 使用涵盖问题识别、证据运用、战略逻辑、可行性及书面表达清晰度的评分量规,收集学期末个人案例分析得分。除非已实施真实的基线案例分析评估,否则应将其报告为课后表现指标。
  3. 收集任务1至任务3的团队得分,并将其与个体层面的学习成果分开保存。
  4. 通过匿名的课后调查收集学员在满意度、感知的实践相关性、反馈有用性、团队协作、竞争压力、工作量以及感知进步方面的数据。除非信度和维度证据支持合成一个总分,否则不得将各项目合并为单一分数。
  5. 仅在成绩提交后收集最终课程成绩。在获得伦理审批、确认知情同意、分配编码并去除直接标识信息和可识别评论后,方可导出仅用于研究的课后记录。
    暂停节点:在最终成绩提交、获得伦理审批、完成知情同意验证、将同意名单与研究数据集分离且确认去标识化完成之前,暂停所有研究分析工作。

12. 清理并合并去标识化的数据集。

  1. 在获得伦理审批并核实知情同意后,创建去标识化的学生层面、团队层面和课程环节层面的数据集。检查重复记录、不可能的数值、缺失代码、不一致的团队代码以及直接标识信息。
  2. 仅通过团队代码合并学生层面与团队层面的数据。使用补充文件1中的模板和补充表S3中的变量字典对所有数据集进行清理和编码。
  3. 将缺失值编码为NA。除非课程政策明确规定某项要求可通过补考评估或记为零分,否则不得替换缺失的结果。在成对知识分析中,仅排除缺少知识测试的学生;在与竞赛相关的分析中,排除缺少全部三项竞赛任务的学生。其他符合条件的分析应保留可用记录。
  4. 保存清理后的数据集、数据字典、数据清理日志、可用于分析的文件以及锁定的输出文件。仅可通过带日期的更正日志修改已锁定的数据。

13. 分析实施的忠实度、教学质量和学习成果。

  1. 在解读学习成果之前,应先分析实施保真度。当未达到保真度阈值时,应谨慎解读结果差异。
  2. 对连续变量报告描述性统计,对分类变量报告频数,包括队列类型、主要分组、先前竞赛经验、任务完成情况、缺失数据类别以及方案队列的奖项等级。仅当对照队列采用相同奖项结构时,才报告其奖项等级。
  3. 根据具体情况,使用独立样本 t 检验、卡方检验或 Fisher 精确检验比较基线特征,以描述基线可比性,而非因果等效性。
  4. 使用配对样本 t 检验或 Wilcoxon 符号秩检验比较队列内部的知识变化。使用独立样本 t 检验、Mann-Whitney U 检验、协方差分析(ANCOVA)或校正基线差异的回归模型比较不同队列间的课程后结果。所有队列比较均应解释为特定情境下的教育记录分析,而非因果估计。
  5. 当分析多个时间点数据时,使用重复测量模型或混合效应模型。对于重复测量,纳入学生层面的随机效应;当学生嵌套于团队中时,还应纳入团队层面的随机效应或聚类稳健标准误。
  6. 将团队层面的结果与学生层面的结果分别分析。除非已处理聚类问题,否则不得将团队得分视为独立的个体观测值。
  7. 对主要均值差异报告 Cohen’s d,其中 0.20、0.50 和 0.80 分别解释为小、中和大效应。尽可能报告 95% 置信区间,并在敏感性分析中比较完整案例与可用案例的结果。
  8. 保存统计脚本、软件输出、图表源文件及最终表格。提交所有表格为单独的可编辑文件,并归档图表源数据。

14. 解读成功与次优的实施效果。

  1. 在解释最终结果之前,先定义实施成功的标准。当达到表4中规定的核心保真度阈值时,视为协议成功实施。
  2. 只有在检查了实施保真度、评分可靠性、缺失数据模式、基线可比性以及分析单位之后,才能解释学习结果。
  3. 当实施保真度足够时,若课程后知识得分提高≥5分、学期末个体案例分析优势提高≥3分,或在5分制量表上教学过程指标提高≥0.30分,可视为积极的实施信号。
  4. 在分析前需预先定义警示模式:当基线知识得分超过85/100或基线满意度超过4.50/5时,视为存在天花板效应;当团队成绩提高但缺乏个体学习证据时,视为存在分数膨胀;当满意度下降>0.30分或>20%的学生报告高工作负荷压力时,视为存在过度竞争压力。
  5. 应将评估视为一个从实施保真度到学生反应、学习证据及课程优化的分层过程,而非单一评分18。由于研究设计采用常规教学队列、历史对照组以及回顾性去标识化课程记录,而非随机分组,因此应避免使用因果性表述。

15. 进行故障排除、方案优化与课程迭代。

  1. 在每项主要任务完成后,审查实施保真度,识别是否存在反馈延迟、团队参与度低、指令不明确、评分表不完整、观察记录缺失、案例设计不完善、评分者意见分歧或人工智能使用不当等问题。
  2. 根据补充表 S2中列出的纠正措施进行整改,包括修订指导说明、增加辅导支持、重新培训评分者、调整角色分工、优化工作负荷,或开展机构层面的学术诚信审查。
  3. 对于较短的教学周期,可将任务1和任务2合并为诊断与决策简报,同时保留最终答辩、反馈记录及保真度检查环节。对于线上、混合式或大规模多班次教学实施,应采用数字化简报、提交日志、在线口头核查、标准化反馈模板、统一评分量规、共享评分者培训、分班次观察员机制、团队仪表盘及集中化数据管理。
  4. 第16周后,需审查实施保真度、过程指标、学生学习成果、评分者记录、数据缺失模式、人工智能使用记录、学生反馈意见及教师反思。在下一轮实施前,修订教学手册、案例包、评分量规、模板、反馈时间安排及数据记录表。
  5. 在获得伦理审批并完成研究数据准备后,归档保存方案流程图、时间表、教学手册、案例文件、评分量规、观察记录表、调查工具、去标识化数据集、数据字典、分析脚本、统计结果、图表源文件、表格及补充材料。所有修订内容均须记录于版本控制表中。

结果

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

代表性结果展示了为期16周的融合竞赛型战略管理课程改进方案所产生的输出。结果按实施保真度、教学质量、学生层面结果、团队层面结果以及预定义的预警模式进行组织。由于数据来源于具有历史对照组的常规教学队列,而非随机分组,因此所有结果均应解释为特定情境下的实施与评估结果,而非有效性的因果证据。

实施保真度与教学质量

现有的教育记录数据集包括88名历史对照队列学生和92名方案队列学生。团队层面的数据集包括22个对照队列团队和23个方案队列团队。应用配对的前后知识测试规则后,保留了79名对照队列学生和84名方案队列学生用于知识增长分析。

在解读学习成果之前,首先检查了实施保真度。方案队列完成了16项计划每周活动中的15项(93.8%),而对照队列完成了16项中的13项(81.3%)。企业案例或结构化案例课程在方案队列中已完成,但未纳入完整的历史对照结构中。在方案队列中,92名学生中有88名完成了全部三项竞赛任务,占比95.7%;在对照队列中,88名学生中仅有18名拥有三项可比的基于项目评估的完整记录,占比20.5%;由于历史课程未实施完整的竞赛流程,这些记录仅用于描述性比较。在方案队列的268份提交材料中,有243份在7个日历日内收到反馈,占比90.7%;相比之下,对照队列的66份提交材料中有49份在同期内收到反馈,占比74.2%。平均反馈周转时间分别为5.8 ± 1.9天和8.4 ± 2.7天。观察任务的完成率分别为81.3%和62.5%。方案队列中两名评分者在重叠主观评分上的组内相关系数(ICC)为0.82,超过预设的0.75阈值。总体而言,方案队列达成了5项核心实施保真度指标中的5项,而对照队列仅达成5项中的2项。

在方案组中,教学质控指标更高。方案组的课堂互动得分为 3.70 ± 0.44,对照组为 3.15 ± 0.48;案例设计完整性得分为 4.08 ± 0.36 和 3.23 ± 0.42;任务与评分标准的一致性得分为 4.01 ± 0.39 和 2.30 ± 0.51。方案组的学生参与度提高了 0.42 ± 0.41 分,超过预设的 0.30 分信号阈值,而对照组仅提高了 0.07 ± 0.34 分。两组的出勤率相近,分别为 89.6% ± 5.8% 和 89.1% ± 6.2%。表5总结了这些指标。

指标数据来源预设阈值历史对照队列方案队列解释
计划每周活动完成率课程实施日志≥85%13/16 周,81.3%15/16 周,93.8%在方案队列中达成
企业或结构化案例会话实施企业参与日志≥1 次已实施会话0/1 次会话,0.0%1/1 次会话,100.0%在方案队列中达成
完整任务或映射项目记录完成率提交记录≥85%18/88 名学生,20.5%88/92 名学生,95.7%在方案队列中达成;历史记录仅作描述性参考
7 天内反馈返回率反馈日志≥80%49/66 次提交,74.2%243/268 次提交,90.7%在方案队列中达成
观察清单完成率观察表单≥75%10/16 次会话,62.5%13/16 次会话,81.3%在方案队列中达成
双评分者一致性评分者评分ICC ≥0.75无需要求ICC = 0.82在方案队列中达成
反馈周转时间反馈日志平均 ≤7 天为佳8.4 ± 2.7 天5.8 ± 1.9 天在方案队列中处于理想范围内
课堂互动水平观察清单平均值 ≥3.50 或提升 ≥0.303.15 ± 0.483.70 ± 0.44在方案队列中更高
案例设计完整性案例设计清单平均值 ≥4.00 为佳3.23 ± 0.424.08 ± 0.36在方案队列中更高
任务与评分标准一致性一致性清单平均值 ≥4.002.30 ± 0.514.01 ± 0.39在方案队列中达成
学生参与度提升出勤、日志、调查项目提升 ≥0.30 分+0.07 ± 0.34+0.42 ± 0.41在方案队列中达成
出勤率出勤记录描述性指标89.1% ± 6.2%89.6% ± 5.8%各队列间相似
核心实施保真度汇总实施指标大多数核心阈值达成5 项中有 2 项达成5 项中有 5 项达成方案按预期实施

表5:代表性实施保真度与教学品质指标。 本表报告了历史对照组与方案组的代表性实施保真度和教学品质结果,并标明是否达到了预设的操作阈值。

图2展示了实施保真度和教学质量问题概况。图2A显示了计划内每周活动的完成情况。图2B显示了三项任务序列的完成情况。图2C显示了在7个日历日内返回的反馈情况。图2D 显示了课堂互动、案例设计完整性、任务评分标准一致性以及学生参与度提升情况。图2E显示了观察任务的完成情况以及企业级或结构化案例讨论环节的完成情况。基于百分比的保真度指标和基于量表的教学指标应在各自测量量表范围内进行解读。

figure-results-1
图 2:实施保真度与教学品质概况。 本图总结了历史对照队列与方案队列的实施保真度和教学品质指标。(A)计划内每周活动完成情况。(B)完整任务或映射项目记录的完成情况,区分方案队列的完整三任务序列与历史对照队列中的映射项目记录。(C)在7个日历日内返回的反馈,反馈周转时间作为补充信息展示。(D)教学品质指标,包括课堂互动、案例设计完整性、任务评分标准一致性以及学生参与度提升。(E)观察核对表完成情况以及企业级或结构化案例会话的实施情况。请点击此处查看此图的放大版本。

学生层面的学习成果

学生层面的结果与团队层面的竞赛结果分别进行分析。在方案组中,基线知识得分为 64.18 ± 8.74,对照组为 62.37 ± 8.91,基线差异为 1.81 分(d = 0.21)。课程后的知识得分分别为 71.08 ± 8.58 和 66.41 ± 9.06,差异为 4.67 分(d = 0.53)。知识增长分别为 6.90 ± 5.41 分和 4.04 ± 5.26 分,差异为 2.86 分(d = 0.54)。方案组的知识增长超过了预设的 5 分增长阈值。

在课程后期进行的个体案例分析表现中,实验组的得分为 82.31 ± 7.06,对照组为 76.42 ± 7.38,两组相差 5.89 分(d = 0.82)。由于未实施真正的基线案例分析评估,该结果被解释为课程结束后的表现指标,而非配对增益值。学生满意度分别为 3.66 ± 0.58 和 3.34 ± 0.62(d = 0.53)。感知到的实践相关性分别为 3.91 ± 0.55 和 3.41 ± 0.59(d = 0.88)。实验组的竞争压力高于对照组,分别为 3.12 ± 0.76 与 2.48 ± 0.71(d = 0.87),但仅有 92 名实验组学生中的 13 名(占 14.1%)报告了较高的工作负荷压力,低于预设的 20% 警戒阈值。最终课程成绩被视为次要教学成果,实验组为 87.20 ± 6.10,对照组为 84.80 ± 6.70(d = 0.37)。表6汇总了学生层面和团队层面的结果。

结果层级历史对照组方案组差异效应量解释
可用的教育记录样本学生n = 88n = 92可用的去标识化课程记录
成对知识分析样本学生n = 79n = 84具有基线和课程后知识评分的学生
基线知识评分学生62.37 ± 8.9164.18 ± 8.741.810.21基线差异较小
课程后知识评分学生66.41 ± 9.0671.08 ± 8.584.670.53方案组更高
知识增益学生4.04 ± 5.266.90 ± 5.412.860.54方案组超过 ≥5 分的信号阈值
个体案例分析评分学生76.42 ± 7.3882.31 ± 7.065.890.82超过 ≥3 分的案例分析信号阈值
学生参与度增益学生+0.07 ± 0.34+0.42 ± 0.41+0.350.93超过 ≥0.30 分的信号阈值
满意度评分学生3.34 ± 0.623.66 ± 0.580.320.53方案组更高
感知的实践相关性学生3.41 ± 0.593.91 ± 0.550.50.88方案组更高
竞争压力评分学生2.48 ± 0.713.12 ± 0.760.640.87方案组压力更高
高工作量压力学生未评估竞争压力13/92, 14.1%低于20%的预警阈值
课程最终评分学生84.80 ± 6.7087.20 ± 6.102.40.37次要教育成果
团队数量团队n = 22n = 23团队层面分析单独报告
决策轮次暴露团队0.77 ± 0.81 轮5.09 ± 0.79 轮4.32未估计实施暴露指标
任务1或映射诊断评分团队69.84 ± 6.4572.18 ± 6.282.340.37团队层面差异较小
任务2或映射决策评分团队71.09 ± 6.1273.52 ± 5.912.430.4团队层面差异较小
任务3或映射最终答辩评分团队72.71 ± 6.3677.20 ± 6.044.490.72团队层面差异最大
团队最终评分团队71.21 ± 5.8174.30 ± 5.523.090.55团队层面中等差异
战略诊断维度团队14.60 ± 1.80 15.60 ± 1.70 1最终答辩评分标准维度
战略选择维度团队17.90 ± 2.20 19.10 ± 2.10 1.2最终答辩评分标准维度
实施可行性维度团队14.40 ± 1.90 15.50 ± 1.80 1.1最终答辩评分标准维度
创新维度团队10.80 ± 1.60 11.50 ± 1.50 0.7最终答辩评分标准维度
证据使用维度团队7.10 ± 1.00 7.50 ± 0.90 0.4最终答辩评分标准维度
口头答辩维度团队7.91 ± 1.10 8.00 ± 1.00 0.09最终答辩评分标准维度
同伴贡献均值团队3.72 ± 0.413.91 ± 0.360.190.49无重大团队过程失败
存在贡献不均的团队团队4/22, 18.2%3/23, 13.0%−5.2 个百分点无系统性不均模式
奖项分布团队不适用10 无奖;8 三等奖;2 二等奖;3 一等奖仅方案组
评分膨胀预警模式团队不适用2/23 团队,8.7%标记为需排查问题

表6:学生层面与团队层面的代表性结果。 本表报告了学生层面与团队层面的代表性结果,包括可获得的教育记录样本、成对的知识分析样本、知识得分、知识增长、个人案例分析得分、参与度、满意度、感知的实践相关性、工作负荷压力、课程最终得分、团队任务得分、最终答辩评分维度得分、同伴贡献、奖项分配以及预警指标。

图3展示了适用情况下带有不确定性估计的学生层面结果。图3A显示了课程前后知识得分的基线水平。图3B显示了知识掌握的提升情况。 图3C显示了个体案例分析表现。 3D展示了参与度提升、满意度以及感知的实践相关性。图3E 将最终课程得分作为次要结果进行展示。

figure-results-2
图3:学生层面的代表性学习成果。 本图分别展示个体层面的学习成果与团队层面的竞赛成果。(A)战略管理知识在课程前后的基线得分。(B)从基线到课程结束后的知识提升情况。(C)学期后期的个体案例分析得分。(D)参与度提升及调查感知指标,包括满意度和感知的实践相关性,必要时采用独立量表表示。(E)最终课程得分作为次要教育成果,以及协议队列相对于预设预警阈值的高工作负荷压力。数据以均值 ± 标准差(SD)表示(当显示 ± 值时),误差线代表标准差。在(E)中,虚线参考线表示预设的高工作负荷压力预警阈值(20%)。请点击此处查看此图的放大版本。

团队层面的竞争结果

团队层面的结果与学生层面的结果分别进行分析。在描述性报告中,对照组的案例项目记录在可获取的情况下被映射到相应的评估节点,但这些记录并不代表完成了完整的竞赛整合流程。决策轮次的参与情况被报告为一项实施程度的指标,而非学习效果的估计值。实验组队列完成了 5.09 ± 0.79 轮决策,而对照组队列完成了 0.77 ± 0.81 轮映射的决策轮次。

在方案队列中,任务1的平均得分为72.18 ± 6.28,任务2的平均得分为73.52 ± 5.91,任务3的平均得分为77.20 ± 6.04。相应的映射对照队列得分分别为69.84 ± 6.45、71.09 ± 6.12和72.71 ± 6.36。方案队列的最终团队得分为74.30 ± 5.52,对照队列为71.21 ± 5.81。最终答辩或映射最终项目评分维度如下:战略诊断,15.60 ± 1.70 和 14.60 ± 1.80;战略选择,19.10 ± 2.10 和 17.90 ± 2.20;实施可行性,15.50 ± 1.80 和 14.40 ± 1.90;创新性,11.50 ± 1.50 和 10.80 ± 1.60;证据使用,7.50 ± 0.90 和 7.10 ± 1.00;口头答辩,8.00 ± 1.00 和 7.91 ± 1.10。

仅对方案队列报告了奖项分配情况,因为对照队列未采用完整的基于奖项的竞争结构。在方案队列中,有10个团队未获得奖项,8个团队获得三等奖,2个团队获得二等奖,3个团队获得一等奖。方案队列的平均同伴贡献评分为3.91 ± 0.36,对照队列为3.72 ± 0.41。在方案队列的23个团队中,有3个团队存在贡献不均衡现象;在对照队列的22个团队中,有4个团队存在该现象。在方案队列的23个团队中,有2个团队呈现出评分虚高警告模式,占比为8.7%。

图 4展示了团队层面的结果和预警模式。图 4A显示了任务1、任务2和任务3的团队得分。图 4B显示了最终答辩评分量规各维度的得分。图 4C仅显示协议队列的奖项分布情况。图 4D显示了分数虚高预警案例。图 4E显示了同伴贡献平衡性及贡献失衡的统计数量。

figure-results-3
图 4:团队层面的竞赛结果与警示模式。 本图展示了团队层面的结果,与学生个人的学习成果分开呈现。(A) 任务阶段的团队得分,包括任务1的战略诊断、任务2的战略决策和任务3的最终答辩,其中可用的历史对照组的项目得分也一并标出。(B) 最终答辩评分量规各维度得分,包括战略诊断、战略选择、实施可行性、创新性、证据使用和口头答辩。(C) 仅显示协议队列的奖项分布情况,因为历史对照组未采用完整的基于奖项的竞赛结构。(D) 得分膨胀的警示模式,定义为最终答辩表现优异,但缺乏诊断能力支持或个体学习证据。(E) 同伴贡献得分与贡献失衡次数被作为两个独立的团队层面指标展示。请点击此处查看此图的放大版本。

次优模式与故障排除指示

在23个实验队列团队中,有两个团队表现出预定义的评分膨胀警示模式。这些团队的最终答辩评分相对较高,但任务1的诊断评分较弱,且个体知识增长低于平均水平。该模式将在下一轮课程迭代中被标记以跟进,而不会被解释为学习效果提升的证据。由于基线知识评分低于100分中的85分,且基线满意度低于5分中的4.50分,因此未观察到明显的天花板效应警示。各队列之间的出勤率相似,未发现系统性的团队贡献失衡,尽管有三个实验队列团队需要进行监测。

总体而言,代表性结果表明,该方案在三个层面产生了可解释的输出:实施保真度、学生层面的学习证据以及团队层面的竞赛表现。警示案例支持将该方案用于课程监测、故障排查以及后续的课程优化。

支持本研究的去标识化数据集已存入 figshare.com,可通过 https://doi.org/10.6084/m9.figshare.33094931 获取。该数据集包括学生层面的记录、团队层面的竞赛记录、实施指标、参与者流程记录、缺失数据审核记录以及评分者评分记录。学生标识符、知情同意记录、链接文件以及可识别身份的自由文本评论未包含在内。

补充表 S1:评分员培训、评分一致性及评分复核流程。 该表格提供了评分员分配、独立性检查、评分标准培训、校准评分、评分一致性检查、评分差异规则、复核流程、数据录入审核、评分锁定及归档流程。请点击此处下载该文件。

补充表 S2:实验方案偏差与实施不理想情况的故障排查矩阵。 本表列出了实验方案的偏差与实施不理想的情况,包括触发规则、纠正措施、所需记录及解读说明。请点击此处下载该文件。

补充表 S3:去标识化教育数据集的数据集结构与变量字典。 该表定义了学生层面、团队层面和课程环节层面的变量,包括变量代码、描述、数据类型、编码范围、数据来源以及缺失数据处理规则。请点击此处下载该文件。

补充文件 1:操作模板、评估材料和去标识化数据集工作簿。 本补充文件提供了用于支持可重复性的操作模板、评估材料、评分表、调查项目、案例设计核查、缺失数据规则、去标识化数据集工作簿结构、清理日志、分析摘要模板以及版本控制记录。请点击此处下载该文件。

讨论

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

本方案提供了一种可重复的方法,用于将教学竞赛环节整合到本科阶段的战略管理课程中。其目的并非在现有课程中额外增加一项竞赛活动,而是将竞赛转化为一种结构化的课程改进流程,该流程涵盖战略诊断、决策制定、形成性反馈、最终答辩以及课后评估。因此,其教学价值取决于整个环节的设计,而不仅仅依赖于竞赛本身的存在。基于竞赛或游戏的教学活动可能提高参与度,但当学习目标、任务产出、评分标准和数据记录未明确界定时,其教育价值便难以评估19。本方案通过明确定义教学流程、评分量规、反馈窗口、实施记录以及可用于重复研究的去标识化数据结构,解决了这一问题。

核心设计原则是目标对齐。每一项任务均与课程目标、课堂主题、学生输出成果及评分标准相关联。任务1要求学生诊断一个战略问题,任务2要求他们选择并论证一项战略决策,任务3则要求他们通过书面和口头证据为最终战略进行辩护。这种“诊断—决策—辩护”的流程旨在防止学生仅将竞赛视为单纯的展示性练习,同时也为学生在最终辩护前反复修改其推理过程提供了多次机会。该结构与基于模拟和体验式学习的研究一致,研究表明,当学生积极参与决策循环、获得反馈并解释自身选择,而非仅仅观察或走过场式地完成情景演练时,应用型学习的效果更佳20,21

为确保该方案按预期运行,必须采取若干质量控制步骤。首先,反馈必须足够及时,以便影响下一项任务。因此,7天的反馈周期被用作教学设计的要求,而不仅是一个管理目标。其次,必须监控评分质量。评分标准可以提高透明度,但前提是评分者对各项描述和证据要求有共同的理解22。为此,该方案包括评分者培训、校准评分、分差检查、组内相关系数(ICC)监测、分歧记录以及分数锁定。第三,团队表现必须与个体学习证据相区分。较高的最终答辩分数可能仅反映出色的展示能力或团队内贡献不均,而非广泛的个体学习成果。因此,该方案分别分析知识得分、个体案例分析得分、学生感知、同伴评价的贡献度以及团队得分。

该方案还包括故障排除规则,因为融合竞赛的教学方式可能会以可预见的方式失败。反馈可能延迟,团队成员的贡献可能不均衡,学生可能过于依赖展示的表面效果,而小组得分可能提高,却缺乏个体学习成效的相应证据。这些风险通过反馈日志、同伴贡献记录、人工智能使用披露表、口头核查、评分者一致性输出以及分数膨胀预警规则进行监控。其中,人工智能使用披露和口头核查环节尤为重要,因为学生可能使用数字工具进行语言润色、格式调整或头脑风暴,但仍需证明其自身的策略性思维能力。该方案并不禁止所有人工智能辅助,但要求必须披露使用情况,并保护核心学习任务:学生必须能够解释诊断依据、证据、决策逻辑、实施风险以及最终建议。

该方案在不同机构间具有可调整性,但其核心步骤顺序应予以保留。若无法获得商业模拟平台,可使用结构化决策表作为模拟环节的替代方案。若企业导师无法到场,可采用匿名案例、公开案例简报或录制的导师评述作为替代。大班教学可能需要设立并行的评审小组和标准化反馈模板,而小班教学则可允许更长的答辩环节。这些调整均应予以记录,因为课程改进方案不仅取决于教学设计本身,还依赖于实施的保真度、教师支持、评估条件以及数据的完整性23。基本要求是课程必须保持诊断、决策、答辩、反馈与评估这一连贯的流程顺序。

应承认若干局限性。本研究为课程改进方案,而非随机对照试验。因此,方案组与对照组之间的差异应被解读为具有代表性的实施与评估结果,而非有效性因果证据。历史对照组或平行对照组可能在学生构成、课堂动态、机构时间节点或评估条件方面存在差异。此外,最终课程成绩也是次要结果,因其可能包含竞赛任务以外的常规课程内容。同时,团队层面的结果不能替代学生个体的学习成果。上述局限性通过分别报告实施保真度、教学质控指标、学生个体结果、团队层面结果、工作负荷压力及警示模式加以解决24

该方案最适合需要将概念性知识与应用型管理判断相结合的课程。战略管理是一个天然适用的场景,因为学生需要分析环境、评估资源、比较战略选择,并论证实施决策的合理性。相同的结构也可调整用于创业学、市场营销战略、创新管理、商业模式设计以及其他需要基于证据进行决策的管理类课程。该方案更广泛的意义在于其实用性:它为教师提供了一种可审计的方式,用以记录课程改进活动的实施、监控、评分、去标识化、分析及修订全过程。在管理教育中,体验式学习常因其真实性而受到重视,但其操作流程并不总是被充分详细地报告以供重复。本方案通过将实施保真度、评分一致性、数据治理和故障排除整合为一个可重复的单一过程,弥补了这一不足25

披露

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

作者声明无利益冲突。

致谢

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

作者感谢参与并支持课程内竞赛活动的学生和教学人员。作者还感谢科学技术学院珠海分校商学院为常规教学实施、课程协调和数据整理提供了非资金性的机构支持。本研究得到了2024年广东省本科高校教学质量与教学改革工程高等教育教学改革项目(项目编号:1174)的资助。

材料

本文使用的材料清单
姓名公司目录编号评论
人工智能使用披露表作者开发AI-Disclosure-v1.0;补充文件 1公开的记录显示,每项主要提交材料均披露了人工智能的使用情况
基线战略管理知识测试作者开发的SMKT-Pre-v1.0;补充文件1测量第1周基线知识
课堂观察检查表作者开发观察-v1.0;补充文件1记录课堂互动和教学过程质量
清洁记录作者开发清洁日志-v1.0;补充文件1记录数据核查、校正、排除及数据集锁定
竞赛手册作者开发手册-v1.0;补充文件1定义任务顺序、提交规则、评分标准、人工智能使用披露、口头考核、申诉流程及截止期限
数据字典作者开发的数据字典-v1.0;补充表2定义变量、编码范围、数据来源及缺失数据规则
去标识化数据集工作簿作者开发数据集-工作簿-v1.0;补充文件1存储学生层面、团队层面和课堂阶段层面的变量
企业或匿名病例包作者开发或企业批准CasePack-v1.0;补充文件 1提供战略决策背景
最终答辩幻灯片模板作者开发FSD-模板-v1.0;补充文件1指导任务3幻灯片结构
最终策略答辩评分表作者开发FSDSF-v1.0;补充文件1记录任务3评分员评分和Q&评估
IBM SPSS StatisticsIBM版本 27.0;机构或个人许可证描述性统计、组间比较、效应量及组内相关系数分析
个体病例分析任务表作者开发的ICATS-v1.0;补充文件1定义个案分析要求及评分维度
知识测试答案键作者开发SMKT-Key-v1.0;补充文件1支持知识测试评分
Microsoft Excel微软Excel 2021;机构或个人许可证数据录入、数据字典、清理日志、表格准备和源数据核查
口腔检查记录表作者开发Oral-Check-v1.0;补充文件1记录个人口头检查问题及回答
同行贡献表作者开发PCF-v1.0;补充文件1记录同行贡献及贡献不均衡情况
课程结束后学习情况调查作者开发PCLS-v1.0;补充文件1评估满意度、相关性、反馈的有用性、协作性、工作量以及感知到的改进程度
课程结束后战略管理知识测试作者开发的SMKT-Post-v1.0;补充文件 1使用等效形式测量课程结束后第16周的知识水平
评分员培训文件作者开发的评分员培训-v1.0;补充文件1提供校准文件、描述符、示例及常见评分错误
统计输出文件软件生成统计输出-v1.0;已归档并锁定分析文件夹将统计分析结果与分析文件及数据集版本一同存储
战略决策表作者开发SDS-v1.0;补充文件1指导任务2的决策输出
战略性诊断报告模板作者开发的SDR-模板-v1.0;补充文件 1指导任务1报告结构
学生代码关联文件作者开发的受限文件学生-代码关联-v1.0;由数据管理员单独存储将学生身份信息与研究代码关联,以便在去识别化之前进行管理
任务-评分标准对齐核对清单作者开发比对-v1.0;补充文件1检查学习成果、任务产出、评分标准与反馈要点之间的一致性
团队章程模板作者开发团队章程-v1.0;补充文件1记录角色分配、沟通规则、截止日期和贡献预期
团队过程日志作者开发的团队过程记录表-v1.0;补充文件1记录会议出勤情况、决策、进展、问题及后续行动
版本控制表作者开发的版本控制-v1.0;补充文件1记录版本号、日期、编辑者、修改原因及审批状态
问卷星在线调查平台文娟星基于网络的平台;机构或用户账户访问基线调查、课程后调查、同伴贡献表单及人工智能披露导出数据

参考文献

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,
  1. Porter ME. Competitive strategy: techniques for analyzing industries and competitors. Free Press; New York; 1980.
  2. Barney J. Firm resources and sustained competitive advantage. J Manage. 1991;17(1):99-120.
  3. Keys JB, Wolfe J. The role of management games and simulations in education and research. J Manage. 1990;16(2):307-36.
  4. Crookall D. Serious games, debriefing, and simulation/gaming as a discipline. Simul Gaming. 2010;41(6):898-920.
  5. Prince M. Does active learning work? A review of the research. J Eng Educ. 2004;93(3):223-31.
  6. Morris TH. Experiential learning: a systematic review and revision of Kolb’s model. Interact Learn Environ. 2020;28(8):1064-77.
  7. Greco M, Baldissin N, Nonino F. An exploratory taxonomy of business games. Simul Gaming. 2013;44(5):645-82.
  8. Vlachopoulos D, Makri A. The effect of games and simulations on higher education: a systematic literature review. Int J Educ Technol High Educ. 2017;14:22.
  9. Johnson DW, Johnson RT, Smith KA. Cooperative learning returns to college: what evidence is there that it works? Change. 1998;30(4):26-35.
  10. Martell K. Assessing student learning: are business schools making the grade? J Educ Bus. 2007;82(4):189-95.
  11. Hamari J, Koivisto J, Sarsa H. Does gamification work? A literature review of empirical studies on gamification. In: Proceedings of the 47th Hawaii International Conference on System Sciences. IEEE; 2014. p. 3025-34.
  12. Buckley P, Doyle E. Gamification and student motivation. Interact Learn Environ. 2016;24(6):1162-75.
  13. Biggs J, Tang C. Teaching for quality learning at university: what the student does. 4th ed. Open University Press; Maidenhead; 2011.
  14. Hattie J, Timperley H. The power of feedback. Rev Educ Res. 2007;77(1):81-112.
  15. Freeman S, et al. Active learning increases student performance in science, engineering, and mathematics. Proc Natl Acad Sci U S A. 2014;111(23):8410-5.
  16. Kolb DA. Experiential learning: experience as the source of learning and development. 2nd ed. Pearson FT Press; Upper Saddle River; 2014.
  17. Panadero E, Jonsson A. The use of scoring rubrics for formative assessment purposes revisited: a review. Educ Res Rev. 2013;9:129-44.
  18. Frye AW, Hemmer PA. Program evaluation models and related theories: AMEE Guide No. 67. Med Teach. 2012;34(5):e288-99.
  19. Garris R, Ahlers R, Driskell JE. Games, motivation, and learning: a research and practice model. Simul Gaming. 2002;33(4):441-67.
  20. Sitzmann T. A meta-analytic examination of the instructional effectiveness of computer-based simulation games. Pers Psychol. 2011;64(2):489-528.
  21. Shute VJ. Focus on formative feedback. Rev Educ Res. 2008;78(1):153-89.
  22. Jonsson A, Svingby G. The use of scoring rubrics: reliability, validity, and educational consequences. Educ Res Rev. 2007;2(2):130-44.
  23. O’Donnell CL. Defining, conceptualizing, and measuring fidelity of implementation and its relationship to outcomes in K-12 curriculum intervention research. Rev Educ Res. 2008;78(1):33-84.
  24. Marsden E, Torgerson CJ. Single group, pre- and post-test research designs: some methodological concerns. Oxf Rev Educ. 2012;38(5):583-616.
  25. Gosen J, Washbush J. A review of scholarship on assessing experiential learning effectiveness. Simul Gaming. 2004;35(2):270-93.

重印与许可

申请许可以重复使用本 JoVE 文章的文本或图表

申请许可

标签

相关文章