CSLU: Names Release 1.3数据集介绍,官网编号LDC2006S39
·
CSLU: Names Release 1.3 是由俄勒冈健康与科学大学口语理解中心(CSLU)构建、LDC 于 2009 年发布的英文姓名语音数据集(编号 LDC2006S39),核心用于姓名语音识别(ASR)、发音词典生成与说话人验证系统研发,包含大规模孤立姓名朗读语音及文本、发音标注,适配人名识别与口语交互场景的模型训练与评测。
核心基础信息
| 项目 | 详情 |
|---|---|
| 官网编号 | LDC2006S39 |
| 发布机构 | CSLU(构建)、LDC(发布 / 分发) |
| 发布时间 | 2006年 |
| 语种 | 英语 |
| 数据类型 | 孤立姓名朗读语音、文本转录、发音标注、元数据 |
| 核心用途 | 姓名 ASR 训练 / 测试、发音词典构建、说话人验证、口语交互系统优化 |
| 格式 | 音频(WAV,16kHz 16 位单声道)、文本(UTF - 8)、标注文件(HTK 格式) |
数据采集与规模
- 采集场景:实验室可控环境,桌面麦克风录制,音频信噪比高,无明显信道噪声,适配高精度声学模型训练。
- 数据规模
- 总语音 utterances 约 50,000 条,有效语音时长约 25 小时。
- 姓名库覆盖:含 10,000 个不同英文姓名(含名、姓及组合),兼顾常见与罕见姓名,适配开放域姓名识别需求。
- 重复采样:每个姓名由不同说话人朗读 2-5 次,适配模型泛化能力评估。
- 说话人分布:共 200 名说话人,覆盖多性别、多年龄段(18-65 岁)、多口音(美式、英式等),保证数据多样性与代表性。
数据内容与标注
- 音频数据
- 孤立姓名朗读:每条音频对应单个英文姓名,无上下文干扰,适配孤立词识别任务。
- 发音变体覆盖:包含同一姓名的不同发音方式(如 “Smith” 的不同重音读法),适配发音多样性建模需求。
- 文本标注
- 逐词转录:精准标注语音对应的英文姓名文本,区分大小写与连字符等格式。
- 发音标注:提供音素级发音标注,适配发音词典生成与声学模型优化。
- 有效性标注:标记无效样本(如发音错误、背景噪声),保证数据质量。
- 元数据:记录 utterance 时长、采样参数、说话人 ID(匿名化)、性别、年龄、口音标签、采集时间,支持分层实验设计。
更多推荐
所有评论(0)