← 返回数据集列表
动物 / 音频分类(猫叫声场景)

猫叫声音频分类数据集

猫在不同场景(喂食/隔离/陌生环境等)下的叫声音频,用于猫叫语境分类研究。

数据规模483 个 WAV 音频,合计约 5.8 分钟
文件格式WAV 音频
文件大小下载压缩包约 12.4 MB
猫叫声音频分类数据集预览

数据预览 · 音频试听

随机抽取的 4 段猫叫声,点击播放即可试听

样本 1
样本 2
样本 3
样本 4

数据交付

本条目提供数据和数据说明,暂未提供可运行教学案例。需要自行完成建模或实验。

数据集介绍

【数据集名称】猫叫声音频分类数据集 【门类归属】动物 / 哺乳动物 【数据类型与任务】音频;音频分类(猫叫声场景) 【数据规模】483 个 WAV 音频,合计约 5.8 分钟 【文件格式】WAV 音频 【压缩包大小】下载压缩包约 12.4 MB 【数据划分】未预先划分训练集/验证集/测试集,使用时可自行按比例划分。 【标签或字段】有标签:标签以编码形式写在每个音频文件名的开头(括号内为各编码的文件数量),各编码的具体含义见数据集内的原始说明;完整的字段与类别说明见压缩包内的数据字典文件 data-dictionary.csv。 【类型关键参数】共 483 个 WAV 音频文件;采样率 8000 Hz、16bit、单声道(以上信息从文件头实测);全部音频合计约 5.8 分钟;只有音频本身,没有配套的文字转写;每段音频的类别通过文件名开头的前缀区分。 【目录结构】 cat-meow-classification.zip(解压后) ├── dataset/dataset/ —— .wav×440 ├── extras/other_vocalizations/ —— .wav×13 └── extras/sequences/ —— .wav×30 【怎么使用】 全部是普通的 WAV 音频文件,电脑自带播放器就能直接播放试听。要做语音分析的话,用 Python 的 soundfile 或 librosa 库读取: import soundfile as sf # pip install soundfile;也可用 librosa wav, sr = sf.read("dataset/dataset/B_ANI01_MC_FN_SIM01_101.wav") # 8000 Hz 类别写在每个文件名开头的前缀里,前缀含义来自原始研究文档(建议使用前自行核对);各组数量见压缩包内的 data-dictionary.csv。 【数据体检结果】 · 数据体检未发现问题,可放心使用。

来源与使用许可

原作者:andrewmvd

许可证:CC BY-NC 4.0

查看原始数据集与作者说明 ↗

仅供免费非商业分享。0 积分不代表可以商用,请遵守原许可证;再次分享须保留作者、来源和许可声明。

整理与使用信息

原作者andrewmvd

本站处理内容

本站已完成的工作: 1. 中文名称与用途说明整理(对照原站信息逐项核对); 2. 全量文件清点与 SHA256 校验(file-manifest.csv,可溯源); 3. 自动质检报告(quality-report.json:结构、编码、重复、标注一致性等); 4. 数据字典整理(data-dictionary.csv,字段/类别中英对照); 5. 预览样例抽取(preview/,供购买前判断内容)。

中文整理说明

门类:动物 / 哺乳动物(依据《数据集中文分类体系》) 中文命名:猫叫声音频分类数据集(原始名称 andrewmvd/cat-meow-classification) 已知问题:自动检查未发现问题(详见 quality-report.json) 配套文档:简明说明.md、README_中文.md、数据字典、文件清单、质检报告、预览样例(均随网盘下载包提供)。