qb-audio
收藏资源简介:
qb-audio是一个为quizbowl(知识竞赛)问题提供的文本转语音(TTS)朗读音频数据集。该数据集基于qbreader平台上的quizbowl题目(包括tossups和bonuses两类),为每个问题生成了对应的音频文件(Opus格式,24 kHz单声道),旨在支持quizbowl应用程序无需安装或API密钥即可集成听力练习功能。数据集采用动态生成方式,规模随时间增长(截至2026年7月仍在持续生成中)。数据组织上,音频文件按问题ID(qid)的最后两位十六进制字符分片存储,并附带JSON侧文件,其中包含音频块的时间戳和对应的文本内容,便于实现音频与文本的同步(如用于答题提示或节奏控制)。此外,数据集提供了audio_index.json清单文件,列出了已生成音频的问题ID列表。音频内容是对原始问题文本进行清理(如应用发音指导、去除标记和主持指令)后的合成朗读。音频合成采用Chatterbox TTS(MIT许可)完成,并经过Whisper ASR(MIT许可)验证以确保质量。数据集适用于quizbowl相关的听力训练、语音应用开发等场景,但请注意,问题文本版权归原作者所有,音频仅为合成朗读,数据集仅限在quizbowl社区规范下的学习和练习使用,无通用开放内容许可。
数据集名称
qb-audio
数据集描述
该数据集包含来自 qbreader 的问答比赛(quizbowl)问题的语音朗读音频,每个问题(tossup / bonus)对应一个 Opus 格式的音频文件。数据集旨在为问答比赛应用提供无需安装或 API 密钥的听力练习功能。生成工作正在进行中(截至 2026 年 7 月),数据集会随运行过程不断增长。
数据布局
- 音频文件:位于
tossups/{qid[-2:]}/{qid}.opus和bonuses/{qid[-2:]}/{qid}.opus,Opus 格式,24 kHz 单声道。文件名中的qid为问题的 qbreader_id,文件根据其最后两个十六进制字符分片存储。 - 辅助文件:位于
tossups/{qid[-2:]}/{qid}.json和bonuses/...,JSON 格式,包含时间戳偏移信息:- 字段
v:版本号,当前为 1。 - 字段
chunks:每个语音片段的起止时间(秒),格式为[[start_s, end_s], ...]。 - 字段
texts:每个语音片段对应的文本字符串列表。
- 字段
- 清单文件:位于根目录的
audio_index.json,格式为{"tossups": [qid, ...], "bonuses": [qid, ...]},列出已生成音频的所有问题 ID。使用时应先获取该清单,并仅对其中的问题进行请求。
语音内容说明
口语文本为问题文本的清洗版本(已应用发音指南,去除了标记和主持人指令),辅助文件中的 texts 字段即与音频实际朗读内容完全一致。
数据集构建方法
- 使用 Chatterbox TTS(MIT 许可证,由 Resemble AI 开发)进行语音合成,运行于单张 RTX 4090 显卡。
- 采用 ASR 验证机制(使用 OpenAI Whisper,MIT 许可证),对生成结果进行质量检查,重新生成剪辑或失控的音频片段。
- 流水线代码已开源,位于 qbsuite 组织下(MIT 许可证)。
许可与致谢
- 问题文本:由各锦标赛的包作者和编辑撰写,通过 qbreader 分发,该平台共享社区问题存档。音频为这些文本的合成朗读,原始问题的权利归其作者所有。
- 数据集许可:数据集依据问答比赛社区规范共享,仅用于学习和练习目的,不适用于其他用途(许可证标签为
other,无通用的开放内容许可)。 - 语音合成来源:Chatterbox TTS(MIT © Resemble AI),质量审核:Whisper(MIT © OpenAI)。
- 删除请求:如果您是所收录问题的作者或编辑,并希望移除相关内容,请在 qbsuite 任一仓库提交 issue,或使用数据集的社区选项卡,内容将被及时删除。
标签与语言
- 语言:英语(en)
- 标签:audio, text-to-speech, quizbowl, trivia
- 许可证:other(具体条款见社区规范链接 https://www.qbreader.org/)





