精选版:罕见神经系统疾病MRI数据集 📅 2026/8/5 6:31:20 摘要罕见神经系统疾病 MRI 精选版数据集包含 2,000 张质量精选的 MRI 图像JPG51 MB涵盖 5 种罕见神经系统疾病每类 400 张完美平衡使用三维自动化质量评估对比度 40%、清晰度 40%、亮度 20%从 Mendeley Benchmark MRI 数据集中筛选。数据集预分为训练/验证/测试1,400/300/300分层抽样配有 ORPHA 罕见病代码和临床元数据可直接用于 Keras/PyTorch支持多类别分类、少样本学习和医学 AI 公平性研究仅限研究和教育用途。数据集简介数据集概述罕见神经系统疾病 MRI 精选版数据集Rare Neurological Diseases MRI – Curated Edition是一个高质量、精心挑选的 MRI 数据集包含 5 种罕见神经系统疾病的 2,000 张图像JPG 格式约 51 MB从更大的集合中使用自动化质量评估筛选而来旨在解决机器学习研究中罕见疾病影像数据严重短缺的问题。数据集的核心优势包括质量精选使用对比度 40%、清晰度 40%、亮度平衡 20% 的加权自动评分选择顶级图像、完美类别平衡每种疾病精确 400 张图像无类别不平衡问题、ML 就绪预分为训练集 1,400 张/验证集 300 张/测试集 300 张70/15/15 比例采用分层抽样、Orphadata 官方关联包含 ORPHA 罕见病代码在元数据中、清晰结构简单文件夹层次可直接用于 Keras/PyTorch。数据集涵盖 5 种罕见神经系统疾病Walker-Warburg 综合征ORPHA:8991-9/1M、小脑发育不全性厚脑回ORPHA:25241/1M、烟雾病伴脑室内出血ORPHA:25731-5/100K、Hallervorden-Spatz 病/PKANORPHA:1578501-2/1M和福山型肌营养不良ORPHA:2721-5/100K仅限研究和教育用途。数据结构与模态特征据集采用标准的训练/验证/测试三层目录结构每个集合下包含 5 个疾病类别子目录训练集每类 280 张验证集和测试集各 60 张。数据精选流程包括五个严格步骤(1) 从 Mendeley Data 的 Benchmark Diagnostic MRI 数据集4,248 张图像40 种疾病中选择源数据(2) 聚焦 5 种样本充足的神经系统罕见病每种 592-1,064 张原始图像(3) 使用三维自动化质量评估对每张图像评分对比度 40% 权重测量像素强度标准差、清晰度 40% 权重使用拉普拉斯方差检测模糊、亮度平衡 20% 权重测量与最佳中值范围的距离(4) 选择每种疾病质量评分最高的 400 张图像占可用图像的 20-50%(5) 创建分层平衡的训练/验证/测试划分70/15/15保持类别分布。数据集提供两个核心元数据文件metadata.csv2,000 行包含文件名、疾病类别、划分、相对路径、ORPHA 代码、完整疾病名称、患病率、遗传模式、医学分类和受累系统和 disease_summary.csv5 行包含每种疾病的综合临床详情和 Orphadata 参考。应用价值与研究方向该数据集支持多个罕见病医学 AI 和深度学习研究方向。多类别分类训练 CNN 区分 5 种罕见神经系统疾病。少样本学习测试元学习算法原型网络、MAML、匹配网络在有限医学数据上的性能。迁移学习预训练模型用于其他神经影像任务。医学 AI 公平性解决罕见和代表性不足疾病的偏见问题。可解释 AI开发 GradCAM/注意力图等可解释模型用于临床决策支持。数据增强研究测试 GAN/扩散模型等罕见病合成数据生成技术。数据集已提供完整的快速启动代码示例Keras/TensorFlow 和 PyTorch 数据加载、元数据探索、EfficientNetB0 基线模型构建。潜在研究方向包括架构对比ResNet、EfficientNet、ConvNeXt、ViT、混合模型、领域适应从常见到罕见神经系统疾病的迁移、多模态学习结合临床文本、遗传数据、不确定性量化贝叶斯方法和类别不平衡技术泛化测试。数据集特别强调仅限研究和教育用途明确禁止用于临床诊断、治疗决策或未经验证的医疗设备开发和临床部署。数据集来源该数据集从 Mendeley Benchmark MRI 数据集20244,248 张图像中精选 2,000 张高质量图像5 种罕见神经系统疾病使用自动化质量评估筛选配有 ORPHA 代码和临床元数据由 Muhammad Ahsan 于 2026 年 2 月发布。由张家梁(Bob)整理并于2026年8月二次整理在7zcode平台公开发布。数据集信息免责声明与引用数据仅用于科研与教学用途。若用于商业场景请自行核验数据许可。如需引用请在论文或报告中注明数据集名称与版本号。作者信息作者Bob (张家梁)项目编号Datasets-75文件大小51M原创声明本数据集为整理作品