东莞市组织危险化学品的生产经营等单位负责人安全生产管理人员安全生产知识管理能力考核办件结果公示信息|安全生产考核数据集|政务服务数据数据集
收藏resume-conversations-llm-training
这是一个高质量的职业对话数据集,适用于构建能够理解简历、职业和职业成长的AI。数据集以结构化的JSONL格式提供,包含关于职业发展、技术趋势和专业技能的现实问答,非常适合开发者和AI实践者用于聊天机器人、职业咨询工具或LLM微调。
huggingface 收录
MIDV-500
该数据集包含使用移动设备拍摄的不同文档图像,这些图像通常具有投影变形。数据集分为训练和测试两部分,其中训练部分包含30种文档类型,测试部分包含20种,在应用神经网络之前,所有图像都被缩放到统一的宽度,宽度为400像素。该数据集的任务是进行消失点检测。
arXiv 收录
学生课堂行为数据集 (SCB-dataset3)
学生课堂行为数据集(SCB-dataset3)由成都东软学院创建,包含5686张图像和45578个标签,重点关注六种行为:举手、阅读、写作、使用手机、低头和趴桌。数据集覆盖从幼儿园到大学的不同场景,通过YOLOv5、YOLOv7和YOLOv8算法评估,平均精度达到80.3%。该数据集旨在为学生行为检测研究提供坚实基础,解决教育领域中学生行为数据集的缺乏问题。
arXiv 收录
鸣潮角色TTS数据集
鸣潮角色语音数据集是基于Bert-vits2开源项目制作的,包含了鸣潮游戏1.0至1.3版本的中、日、英、韩全角色语音。它提供了单角色包和完整包以满足不同用户的需求,每个语音文件都有对应的文本标注,方便进行语音识别和训练。数据集中的语音按类别整理,包括战斗语音、带变量语音等,分类清晰,便于查找和使用。用户可以在ModelScope平台直接下载数据集,无需登录。此数据集仅供个人欣赏和学习交流使用,不得用于商业用途或非法活动。鸣潮角色语音数据集旨在支持AI语音合成和识别技术的研究与开发,为用户提供了一个丰富的多角色、多语种的语音资源库。
魔搭社区 收录
O*NET
O*NET(Occupational Information Network)是一个综合性的职业信息数据库,提供了关于各种职业的详细描述,包括技能要求、工作活动、知识领域、工作环境等。该数据集被广泛用于职业分析、教育和劳动力市场研究。
www.onetonline.org 收录
