登录后查看消息通知
遇见数据集
数据堂(北京)科技股份有限公司

数据堂(北京)科技股份有限公司

企业

数据堂(北京)科技股份有限公司成立于2010年,属科技推广和应用服务业,主营技术开发、技术服务、基础软件服务、应用软件服务、市场调查等。面向内容安全、模型训练、自然语言处理等领域提供数据服务,开放大模型内容安全文本数据集(内容安全、模型训练)、高质量中文书籍数据集(自然语言处理、人工智能)、高质量中文问答数据集(自然语言处理、机器学习),支撑模型训练与算法优化。

内容安全模型训练自然语言处理科技推广服务高新技术企业
成立于 2010 年北京市https://www.datatang.com/guoyanzhen@datatang.com

数据概览

200
数据集总量
3,066
总浏览量
0
关注人数
2026-08-29
最近更新
分类统计

相关机构

  • 北
    北京知道创宇信息技术股份有限公司
    拥有数据集:11个
    企业
  • 安
    安徽数据堂科技有限公司
    拥有数据集:5个
    企业
  • 北
    北京瑞莱智慧科技有限公司
    拥有数据集:4个
    企业
  • 贵
    贵州耕云科技有限公司
    拥有数据集:3个
    企业
  • 北
    北京开普云信息科技有限公司
    拥有数据集:1个
    企业

数据集列表

驾驶员手势数据
驾驶舱手势识别
智能车载交互
用于训练 MobileNet 等轻量 CNN、CNN-LSTM 及时序 Transformer 模型,还有车载适配的多模态融合模型。可提升驾驶场景手势精准识别、语义匹配及复杂光线 / 姿态下的鲁棒性,避免误触发。服务于智能车载交互、驾驶安全辅助、车队智能管理、驾培手势规范考核等场景。
杭州数据交易所2026-08-04 更新30
体育运动视频采集数据
动作识别
体育视频分析
用于训练 3D CNN、CNN-LSTM、时序 Transformer 及姿态骨架模型。可提升运动动作精准识别、技术规范评分、轨迹追踪及损伤风险预判能力,适配不同运动的动作特点。服务于运动员训练辅助、赛事战术分析、体育教学纠错、运动康复评估、电竞动作捕捉等场景。
杭州数据交易所2026-08-04 更新10
理工科试题数据
理工科试题解析
教育大模型训练
用于大模型领域的训练,提升模型的知识准确性、逻辑推理、语言理解、跨学科综合、上下文学习等能力,常用于教育辅助、智能答题、知识增强等场景。
杭州数据交易所2026-08-04 更新10
驾驶员行为数据
驾驶行为识别
智能车载安全
用于训练 CNN、3D CNN、CNN-LSTM 及 YOLO 等模型,还有多模态融合模型。可提升危险驾驶行为识别、驾驶状态评估、风险预判及行为分类的精准度,适配复杂路况。服务于智能车载预警、物流车队安全管理、驾培考核、车险风控及自动驾驶辅助决策等场景。
杭州数据交易所2026-08-04 更新80
中文平均音色语音合成数据
中文语音合成
TTS模型训练
用于训练TTS,提升自然度与流畅度、情感表达、多场景适配、响应效率,增强对多音字、专业术语、长难句的稳健处理。服务于智能客服、智能语音助手、金融服务、内容创作、无障碍辅助、车载与智能家居等场景。
杭州数据交易所2026-08-04 更新10
中文女声客服语音合成数据
AI语音合成
智能客服语音交互
用于训练TTS,提升自然度与流畅度、情感表达、多场景适配、响应效率,增强对多音字、专业术语、长难句的稳健处理。服务于智能客服、智能语音助手、金融服务、内容创作、无障碍辅助、车载与智能家居等场景。
杭州数据交易所2026-08-04 更新10
新闻事件标注数据
新闻事件抽取
事件语义理解
用于训练BERT/RoBERTa、BiLSTM-CRF、事件触发词与元素分类器、ProxiModel、句子 - Transformer等。提升事件识别、实体抽取、关系与情感分析、多文档理解、关键词与摘要生成,增强对复杂句式、领域术语、长文本结构的鲁棒性。服务于新闻分析、舆情监控、智能检索、内容推荐、自动摘要、情报分析、内容合规与多语言传播等场景。
杭州数据交易所2026-08-04 更新20
交互场景中文意图文本数据
中文意图识别
对话系统
用于训练BERT/RoBERTa-wwm、LLM 微调、BiLSTM-Attention、意图 - 槽位联合模型、提示学习等。提升意图精准识别、上下文理解、隐含意图挖掘、多轮对话连贯性,增强对中文表达多样性、长难句、专业术语的鲁棒性。服务于智能客服、语音助手、智能家居、电商交互、医疗问诊、车载系统、教育平台等场景。
杭州数据交易所2026-08-04 更新10
高质量图像描述数据集
视觉语言预训练
图生成
用于多模态大模型训练,让模型学会将图像内容与对应文本描述精准对齐,加强对问生图或图生文应用的准确性。
杭州数据交易所2026-08-04 更新10
中文文本韵律标注语料数据
韵律建模
AI语音合成
用于训练BERT/TinyBERT、LSTM-Attention、CRF、Span-based、HPM、Conformer等。提升韵律边界预测、停顿 / 重音 / 语调精准生成、情感表达、长文本一致性,增强对诗词格律、专业术语、对话交互的稳健性。服务于TTS、智能客服、有声内容、ASR、语言教学、影视配音、心理健康评估等场景。
杭州数据交易所2026-06-29 更新170
关于我们
遇见数据集——让每个数据集都被发现,让每一次遇见都有价值。
数发科官网www.sfktec.com
联系我们
selectdataset@iotsh.com.cn
商业合作
数据驱动未来,携手共赢发展
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15沪公网安备31010402336585号
热门搜索