本研究提出了一种基于生成式人工智能的框架,整合了GAN、VAE和基于注意力的深度卷积网络,通过咳嗽音频信号检测COVID-19,提升了鲁棒性、数据平衡和跨数据集泛化性,实现可扩展、无创筛查。
访问受限。请登录或开始试用以查看此内容。
访问受限。请登录或开始试用以查看此内容。
访问受限。请登录或开始试用以查看此内容。
访问受限。请登录或开始试用以查看此内容。
访问受限。请登录或开始试用以查看此内容。
| 姓名 | 公司 | 目录编号 | 评论 |
|---|---|---|---|
| 咳嗽病毒数据集 | & Eacute;科尔理工学院Fé和可爱;洛桑联邦理工学院(EPFL) | 公开发行(2021年) | 众包咳嗽音频数据集,含自我报告元数据和部分医生注释;主要用于训练和数据增强。 |
| CUDA 工具包 | NVIDIA | 11.3 | GPU加速框架用于加速模型训练和推理。 |
| LibROSA | 开源 | 0.9 | 音频分析库,用于重采样、分割、MFCC提取和频谱特征计算。 |
| Linux 操作系统 | 正典 | Ubuntu 20.04 LTS | 操作系统用于所有实验和模型训练。 |
| Matplotlib | 开源 | 3.5 | 用于绘制数据集分布和评估结果的可视化库。 |
| 数字派 | 开源 | 1.21 | 用于数组操作和信号处理操作的数值计算库。 |
| NVIDIA GPU | NVIDIA | 特斯拉 / RTX 级别 | 用于训练深度和生成式模型的图形处理单元。 |
| Python 编程语言 | Python 软件基础 | 3.8 | 用于数据预处理、特征提取、模型开发和评估的核心编程环境。 |
| PyTorch | Meta(Facebook 人工智能研究) | 1.12 | 用于实现GAN、VAE、DCNN及基于注意力的DCNN模型的深度学习框架。 |
| Scikit-learn | 开源 | 1 | 用于数据拆分、类权重和性能指标计算的机器学习库。 |
| 科幻 | 开源 | 1.7 | 用于音频预处理和信号转换的科学计算库。 |
| Virufy 数据集 | 维鲁菲 | 公开发行(2021年) | 临床采集的咳嗽记录,使用RT-PCR–经过验证的COVID-19标签;仅用于外部验证和跨数据集评估。 |
访问受限。请登录或开始试用以查看此内容。
申请许可以重复使用本 JoVE 文章的文本或图表
申请许可