DeciViT-F 是一种结合了模糊逻辑与贝叶斯决策的混合深度学习模型,被用于膝关节骨关节炎的检测评估。在所有测试的卷积神经网络模型(包括 ViT-B/16 模型)中,该模型取得了最高的准确率(≈88%)、宏平均 F1 分数(0.85)和 AUC 值(0.95),并通过自注意力机制增强了上下文表征能力,但表现出中等程度的校准漂移。
DeciViT-F 是一种结合了模糊逻辑与贝叶斯决策的混合深度学习模型,被用于膝关节骨关节炎的检测评估。在所有测试的卷积神经网络模型(包括 ViT-B/16 模型)中,该模型取得了最高的准确率(≈88%)、宏平均 F1 分数(0.85)和 AUC 值(0.95),并通过自注意力机制增强了上下文表征能力,但表现出中等程度的校准漂移。
本文介绍了 DeciViT-Knee 2025 协议,这是一种混合深度学习工作流程,结合了视觉变换器(ViT-B/16)、贝叶斯决策树和第三层模糊推理系统,用于膝骨关节炎(KOA)的早期且可解释的检测。该流程首先在 PyTorch 2.x 和 Hugging Face Transformers 中配置支持 GPU 的运行环境。随后,从骨关节炎倡议项目(OAI)和多中心骨关节炎研究(MOST)获取放射影像和磁共振成像(MRI)数据集。在数据输入至经过微调的 ViT-B/16 模型以生成 768 维图像嵌入之前,需经过对比度增强、伪影去除和归一化处理。我们采用贝叶斯决策树分析这些嵌入向量,从而提供经过校准的概率分类结果。模糊推理层引入语言学推理,以“低风险”、“中风险”或“高风险”等术语表达诊断中的不确定性。该模型性能优于 CNN、ResNet-50 及仅使用 ViT 的基线模型,达到 92.4% 的准确率、0.964 的 AUC 值、0.891 的 F1 分数以及 0.088 的 Brier 分数。该协议展示了如何将基于变换器的全局特征提取、贝叶斯概率推理与模糊可解释性相结合,构建一个更清晰、可重复且便于临床医生使用的肌肉骨骼影像诊断框架。
膝骨关节炎(KOA)是一种长期进展性的关节疾病,是全球老年人致残的主要原因之一1。早期发现细微的结构改变对于有效干预至关重要;然而,传统的诊断工具,如Kellgren-Lawrence(KL)分级系统以及WOMAC等临床指数,受限于主观性和观察者间的变异性1。
随着OAI和MOST等大规模膝关节影像数据库的日益普及,用于客观评估膝骨关节炎(KOA)的计算方法已受到广泛关注2。早期基于手工设计特征描述符和统计分类的放射影像分析方法在处理高维影像数据时表现出有限的鲁棒性2。近年来,基于影像的建模框架在提高早期KOA检测敏感性方面有所改进,但在临床可解释性和决策透明度方面仍面临挑战。
由人工智能驱动的分析能够无创且早期地发现膝关节骨关节炎,从而减少重复X射线检查的需求,以及大规模影像学检查和纸质诊断所带来的环境影响3。迄今为止,机器学习模型(如决策树和随机森林)已能够预测WOMAC评分和KL分级的风险准确性(图1);然而,这些模型在处理高维成像数据时仍存在困难4。深度学习架构,尤其是卷积神经网络(CNNs)和ResNet网络,实现了自动特征提取并提高了准确性,但其模型可解释性较差。视觉Transformer(ViTs)则通过自注意力机制引入了全局上下文理解能力。
DeciViT-F 框架通过提供准确、可理解且经济实惠的医疗解决方案,支持可持续的临床实践。这有助于患有慢性残疾的人群,特别是老年人,改善其生活质量。其可解释的模糊贝叶斯逻辑促进了人工智能的伦理应用,确保临床决策中的信任性、包容性和透明性。最终,这一方法将为我们所有人带来更优质、更公平且更环保的未来。
DeciViT-Knee 2025 框架由此建立为一种混合型、可解释的流程,以解决上述问题。该框架采用 ViT-B/16 进行深度图像表征2,4,利用贝叶斯决策树实现清晰且具有概率性的分类,并通过模糊推理层5将不确定性转化为人们可理解的语言。这种三层融合机制提供了高诊断准确性、强校准性以及在临床医生层面可解释的结果。
文献综述
目前尚无研究将基于 ViT-B/16 的特征提取与贝叶斯决策树在多模态 KOA 数据上的概率推理完全结合。近期关于可解释性的研究表明,模糊逻辑有助于将精确数值与基于语言的推理相连接。模糊系统能够表示部分真值(例如轻度软骨损失或边缘性骨赘存在),这与放射学评估中常见的不确定性描述相一致。已有研究证明,将模糊推理层整合到深度网络中可降低观察者间的变异性,并提升临床可解释性5,6,7,8,9,10。在 ViT 嵌入之上添加模糊-贝叶斯层,可生成既具有概率性又具备语言意义的决策边界。这能将抽象的激活值转化为人类可理解的规则集,例如:若软骨变薄程度为中等且骨强度变异较高,则 KL 分级很可能 ≥ 2。
DeciViT-Knee 2025 旨在通过一种针对临床环境优化的 ViT-模糊-贝叶斯框架,实现膝骨关节炎(KOA)的早期、清晰且可重复的检测。这将有效弥合准确性、可解释性与语言透明度之间的差距。
以下方法从环境设置、数据集准备,到模型训练、测试和可视化,对每一步都提供了清晰且可重复的描述。这将有助于研究人员和临床医生重复并在此工作基础上进一步开展肌肉骨骼系统疾病的精确诊断研究
选择并设置模型
我们选择 Vision Transformer(ViT-B/16)作为主要的图像特征提取器,因为它能够利用多头自注意力机制对放射影像中的全局上下文关系进行建模2,4,11。ViT 结构能够同时分析细粒度的纹理变化和长距离的空间依赖关系,这对于区分 KL 分级 0–4 中细微的骨关节炎变化至关重要2,4,12。这与基于卷积神经网络(CNN)的架构不同,后者依赖于局部感受野11。
在变压器嵌入输出与概率分类器之间添加了一个模糊推理层(FIL),以应对放射学分级中的不确定性,特别是针对临界状态和早期膝骨关节炎(KOA)的情况(图2)13,14。FIL将连续的嵌入激活值转换为具有语言意义的模糊集合(例如,轻度、中度或重度软骨损失),并生成表示诊断不确定程度的隶属度7,8。该设计通过将数值预测与放射科医生常用的定性推理模式相对应,提高了模型的可解释性15。
采用贝叶斯决策树集成(BDTE)将模糊增强的特征嵌入转化为概率性分类结果,从而确保预测既准确又易于理解16,17,18,19。集成中的每棵决策树均可计算后验概率和置信区间,有助于建立校准良好的决策边界13。该方法结合了贝叶斯推断的统计准确性与基于规则的决策树的清晰性,使每个诊断输出既具有量化的确定性,又具备可解释的判断依据19。
通过比较进行基准测试
我们采用相同的训练集和验证集划分,系统地将混合 ViT + FIL + BDTE 流程与 CNN 和 ResNet-50 基线模型进行比较。我们使用分类准确率、AUC、Brier 得分以及由临床医生在五分制量表上评定的可解释性作为比较指标。采用多个基线模型使得能够在不同架构之间公平地测试模型的泛化能力、校准一致性和可解释性。
访问受限。请登录或开始试用以查看此内容。
本研究使用骨关节炎倡议(Osteoarthritis Initiative,OAI)和多中心骨关节炎研究(Multicenter Osteoarthritis Study,MOST)的数据进行训练和测试。验证则采用了来自印度印多尔国立阿育吠陀学院的500张X线片。已获得印度印多尔国立阿育吠陀学院伦理委员会的伦理批准。所使用的所有数据均已匿名化。
1. 模型结构
2. 模型基准测试
3. 数据分析
访问受限。请登录或开始试用以查看此内容。
性能评估
DeciViT-F(图3)取得了最高性能(准确率0.89,AUC 0.93,F1分数0.87),且Brier评分最低(0.082),表明其校准效果优于CNN、ResNet-50和仅使用ViT的模型,后者的不确定性相对较高。在两家骨科诊所开展的前瞻性评估显示,该模型尤其在膝关节炎(KOA)临界病例中的诊断信心有所提升,支持了所提出框架的临床稳健性和泛化能力(表1)。
混淆矩阵与精确率-召回率
各类别结果表明,DeciViT-F 在所有 KL 分级中均实现了最高的精确率和召回率,宏F1得分为0.85,优于CNN(0.66)、ResNet-50(0.70)、VGG16(0.78)和ViT-B/16(0.83;图4)。该模型在早期阶段检测(KL 0-1,精确率0.86,召回率0.78)中表现出显著提升,并在重度分级(KL 4,
访问受限。请登录或开始试用以查看此内容。
DeciViT-F 框架在膝关节骨关节炎(KOA)的诊断准确性和早期敏感性方面均取得了显著提升。定量评估显示,该模型的整体准确率达到 91.2%,宏平均 F1 分数为 0.88,AUC 为 0.968,显著优于 CNN、ResNet-50 和仅使用 ViT 的基线模型。该模型的 Brier 得分为 0.072,预期校准误差(ECE)为 0.041,反映出更优的置信度校准性能。尤为重要的是,早期 KOA(KL 0-1)的敏感性提高了超过 12%,能够在影像学表现出现之前更可靠地区分轻度软骨退变。视觉 Transformer 嵌入、模糊推理层与贝叶斯决策树的协同使用,确保了定量精度与解释透明性兼具(图 9)。这些结果证实,DeciViT-F 能够实现早期、可信且具有临床可解释性的 KOA 诊断,标志着向智能化肌肉骨骼影像系统迈出了决定性一步。本研究不仅提高了诊断的准确性与实用性,还契合社会福祉与可持续发展的目标。通过实现无创、早期发现膝关节骨关节炎,减少了不必要的医疗资源浪费和辐射暴露。DeciViT-F 框架最终促进了人工智能的伦理化部署,将有助于为全人类创造一个更美好、更公平且...
访问受限。请登录或开始试用以查看此内容。
作者声明不存在可能影响本研究的设计、实施或报告的冲突性财务利益、商业关系或个人关系。
作者们诚挚感谢印度中央邦印多尔市洛克曼亚纳加尔国家阿育吠陀学院院长Das Adhikari博士,他提供了约500份匿名的膝关节X光片,这些影像资料对本研究验证阶段起到了关键作用。作者们还感谢美国国立卫生研究院(NIH,美国)、骨关节炎倡议项目(OAI)以及多中心骨关节炎研究(MOST),这些机构提供了公开可用的数据集,对模型的训练与测试极为重要。DeciViT-Knee 2025方案的创建与实施未获得任何外部资金支持。
访问受限。请登录或开始试用以查看此内容。
| 姓名 | 公司 | 目录编号 | 评论 |
|---|---|---|---|
| NumPy | NumPy | https://numpy.org/ | |
| OpenCV | Open CV | https://opencv.org/ | |
| 骨关节炎倡议(OAI),MOST 数据库 | 美国国立卫生研究院 | https://nda.nih.gov/oai | |
| Python 3.9+ | Python | https://www.python.org/downloads/release/python-390/ | |
| PyTorch | Linux 基金会 | https://pytorch.org/ | |
| SciPy | GitHub | https://scipy.org/ | |
| TensorFlow | TensorFlow | https://www.tensorflow.org/ |
访问受限。请登录或开始试用以查看此内容。
申请许可以重复使用本 JoVE 文章的文本或图表
申请许可