植物叶片疾病培训数据集
见 README_中文.md。
数据预览






数据交付
本条目提供数据和数据说明,暂未提供可运行教学案例。需要自行完成建模或实验。
数据集介绍
【数据集名称】植物叶片疾病培训数据集 【门类归属】植物与农业 / 病害识别 【数据类型与任务】图像;待核查 【数据规模】116147 张图像 【文件格式】JPG 图片(附标注/说明文件) 【压缩包大小】下载压缩包约 1.80 GB 【数据划分】未预先划分训练集/验证集/测试集,使用时可自行按比例划分;全部数据按 72 个类别文件夹存放,一个文件夹一个类别。 【标签或字段】有标签:每张图像存放在以类别名命名的文件夹里,文件夹名就是这张图的类别;完整的字段与类别说明见压缩包内的数据字典文件 data-dictionary.csv。 【类型关键参数】图像尺寸不统一:随机抽取 80 张实测,宽度 256~256 像素、高度 256~256 像素。标注方式:每张图片所在文件夹的名字就是它的类别,不需要额外的标注文件。 【目录结构】 plant-diseases-training-dataset.zip(解压后) ├── data/Apple___alternaria_leaf_spot/ —— .jpg×278 ├── data/Apple___black_rot/ —— .jpg×621 ├── data/Apple___brown_spot/ —— .jpg×215 ├── data/Apple___gray_spot/ —— .jpg×395 ├── data/Apple___healthy/ —— .jpg×2570 ├── data/Apple___rust/ —— .jpg×1241 └── …… 共 72 个子目录(完整清单见 file-manifest.csv) index.txt 【怎么使用】 图片已经按类别分好了文件夹,文件夹的名字就是图片的类别,不需要额外的标注文件。做深度学习的话,用 PyTorch 两行代码就能全部读入: from torchvision.datasets import ImageFolder ds = ImageFolder("data") # 72 个类别子目录,目录名即类别 print(len(ds.classes)) 每个类别有多少张图片,见压缩包内的 file-manifest.csv。 【数据体检结果】 · 数据体检未发现问题,可放心使用。
整理与使用信息
本站处理内容
本站已完成的工作: 1. 中文名称与用途说明整理(对照原站信息逐项核对); 2. 全量文件清点与 SHA256 校验(file-manifest.csv,可溯源); 3. 自动质检报告(quality-report.json:结构、编码、重复、标注一致性等); 4. 数据字典整理(data-dictionary.csv,字段/类别中英对照); 5. 预览样例抽取(preview/,供购买前判断内容)。
中文整理说明
门类:植物与农业 / 病害识别(依据《数据集中文分类体系》) 中文命名:植物叶片疾病培训数据集(原始名称 nirmalsankalana/plant-diseases-training-dataset) 已知问题:自动检查未发现问题(详见 quality-report.json) 配套文档:简明说明.md、README_中文.md、数据字典、文件清单、质检报告、预览样例(均随网盘下载包提供)。