本研究采用U-Net及其他深度学习算法对舌象图像进行分割,并比较分割结果,以探讨舌诊的客观化。
需要JoVE订阅才能观看此内容。 请登录或开始免费试用
本研究采用U-Net及其他深度学习算法对舌象图像进行分割,并比较分割结果,以探讨舌诊的客观化。
舌诊是中医诊断中的一项关键技术,通过图像处理技术实现舌象客观化的需求日益增长。本文综述了近十年来舌象客观化研究的进展,并对多种分割模型进行了比较。研究构建了多种深度学习模型,利用真实舌象图像数据集对算法进行验证与对比,分析了各模型的优缺点。结果表明,U-Net算法在精确度(PA)、召回率和平均交并比(MIoU)等指标上优于其他模型。然而,尽管在舌象图像采集与处理方面已取得显著进展,舌诊客观化的统一标准尚未建立。为了促进移动设备采集的舌象图像在舌诊客观化中的广泛应用,未来研究可进一步解决复杂环境下舌象图像采集所带来的挑战。
舌诊是传统中医民族医学中广泛使用的一种技术。舌的颜色和形态可以反映机体的生理状况以及各种疾病的性质、严重程度和预后。例如,在传统苗医中,通过舌色判断体温状况,舌色红或紫提示与热相关的病理因素。在藏医中,通过观察患者的舌象来判断病情,重点关注舌黏膜的颜色、形态和湿润度。例如,赫依病患者的舌头会变得红而粗糙,或黑而干燥1;赤巴病2患者表现为舌黄而干;而培根病3患者则表现为舌白、湿润且柔软4。这些观察结果揭示了舌象特征与生理、病理之间的密切关系。总体而言,舌的状态在疾病诊断、辨病以及治疗效果评估中具有重要作用。
同时,由于不同民族群体的生活环境和饮食习惯存在差异,舌象表现也呈现出明显区别。Lab 色彩模型是基于国际色彩判定标准建立的,由国际照明委员会(Commission International Eclairage, CIE)于1931年提出。1976年,该色彩模式经过修正并重新命名。Lab 色彩模型由三个要素组成:L 代表亮度,a 和 b 则为两个色度通道。a 通道涵盖从深绿色(低亮度值)经灰色(中等亮度值)到亮粉色(高亮度值)的颜色变化;b 通道则从亮蓝色(低亮度值)经灰色(中等亮度值)至黄色(高亮度值)变化。Yang 等人5通过比较五个民族群体舌色的 L × a × b 数值发现,苗族、回族、壮族、汉族和蒙古族的舌象特征彼此之间具有显著差异。例如,蒙古族人群舌体偏暗,舌苔呈黄色,而苗族人群舌体较浅,舌苔为白色,提示舌象特征可作为评估人群健康状况的诊断指标。此外,舌象还可作为民族医学临床研究中循证医学的评价指标。He 等人6以舌象为基础开展中医诊断,系统评价了丑灵丹丸(CLD 颗粒——在中医中用于治疗包括季节性流感在内的炎症性和发热性疾病)联合中西医治疗的安全性和有效性。研究结果证实了舌象作为临床研究评价指标的科学有效性。然而,传统医学 practitioners 通常依赖主观判断来观察舌象特征,并据此评估患者的生理与病理状态,亟需更为精确的量化指标。
互联网与人工智能技术的兴起为舌诊的数字化和客观化奠定了基础。该过程通过数学模型对舌象图像进行定性与客观描述,反映舌象图像的内容。该过程包括多个步骤:图像采集、光学补偿、色彩校正和几何变换。预处理后的图像随后输入算法模型,进行图像定位与分割、特征提取、模式识别等操作。该流程的输出结果是对舌象图像数据的高效且精确的诊断,从而实现舌诊的客观化、量化和信息化7。因此,实现了舌诊数据高效、高精度处理的目标。本研究基于舌诊知识与深度学习技术,利用计算机算法自动从舌象图像中分离舌体与舌苔,旨在为医生提取舌象的量化特征,提高诊断的可靠性与一致性,并为后续舌诊客观化研究提供方法支持89。
访问受限。请登录或开始试用以查看此内容。
本研究已获得国家自然科学基金项目“基于关联分析的中医面部图像动态变化规律构建”的批准。伦理批件号为2021KL-027,伦理委员会已批准按照以下批准文件开展临床研究:临床研究方案(2021.04.12,V2.0)、知情同意书(2021.04.12,V2.0)、受试者招募材料(2021.04.12,V2.0)、病例及/或病例报告、受试者日记卡及其他问卷(2021.04.12,V2.0)、临床试验参与人员名单、研究项目审批文件等。已获取参与研究患者的知情同意。本研究的主要实验方法是使用真实的舌象图像来验证并比较模型的分割效果。图1展示了舌诊客观化的组成部分。
1. 图像采集
2. 舌部分割
3. 舌象分类
访问受限。请登录或开始试用以查看此内容。
关于比较结果,请参见图12、图13和表1,其中本研究构建的环境使用相同的样本对算法模型进行训练与测试。MIoU指标:U-Net > Seg-Net > PSPNet > DeeplabV3;MPA指标:U-Net > Seg-Net > PSPNet > DeeplabV3;精确率指标:U-Net > Seg-Net > DeeplabV3 > PSPNet;召回率:U-Net > Seg-Net > PSPNet > DeeplabV3。指标值越大,分割准确率越高,模型性能越好。根据指标结果可分析得出,U-Net算法在MIoU、MPA、精确率和召回率方面均优于其他算法,其分割准确率也高于其他算法。因此,U-Net算法在四种不同算法中性能最优。PSPNet在MIoU、MPA和召回率方面优于DeeplabV3,而DeeplabV3模型在所有指标上均低于Seg-Net模型。因此,可以得出结论:在本研究环境中,Deepl...
访问受限。请登录或开始试用以查看此内容。
根据上述比较结果可以看出,所考虑的四种算法具有不同的特性,其各自的优缺点如下所述。U-Net结构基于全卷积网络的改进与扩展,通过收缩路径和对称的扩展路径获取上下文信息并实现精确定位。该算法通过对每个像素点进行分类,实现了较高的分割精度,并能利用训练好的模型更快速地完成图像分割。另一方面,Seg-Net算法由编码器和解码器组成的对称结构构成,在适应新问题方面具有优势,且在语音、语义、视觉和游戏等任务中表现良好。然而,该算法需要大量数据,对硬件配置要求较高,因此仅适用于部分任务。作为更为通用的框架,DeeplabV3算法的优势在于可对大多数网络的ASSP模块进行改进,并将其以级联或并行方式布局,从而提升整体性能。但其最终特征图需通过8倍和16倍的上采样获得,相对粗糙,仍有改进空间。此外,PSPNet模型最显著的特点是通过PSP模块聚合来自不同区域的上下文信息,从而增强对全局信息的获取能力,在多个数据集上均取得了良好效果。结果表明,在本研究环境下,U-Net模型具有最高的分割精度和最佳的分割效果。
U-Net 架构在医学图像分割中展现出其优越性12
访问受限。请登录或开始试用以查看此内容。
作者声明无利益冲突。
本工作得到中国国家自然科学基金(资助号:82004504)、中国科学技术部国家重点研发计划(资助号:2018YFC1707606)、四川省中医药管理局(资助号:2021MS199)和中国国家自然科学基金(资助号:82174236)的支持。
访问受限。请登录或开始试用以查看此内容。
| 姓名 | 公司 | 目录编号 | 评论 |
|---|---|---|---|
| 中央处理器 | Intel(R) Core(TM) i7-9700K | ||
| 图形处理器 | NVIDIA GeForce RTX 3070 Ti (8192MB) | ||
| 操作系统 | Microsoft Windows 10 专业版 (64 位) | ||
| 编程语言 | Python | ||
| 内存 | 16G |
访问受限。请登录或开始试用以查看此内容。