登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
D581_Taibetan_Social_Comment_Content_Data
D581_Taibetan_Social_Comment_Content_Data
收藏
OpenCSG
2026-03-04 更新
2026-03-14 收录
藏文处理
自然语言理解
数据链接:
https://opencsg.com/datasets/DatatangBeijing/D581_Taibetan_Social_Comment_Content_Data?tab=summary
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
在社交评论网站上对藏文内容数据的采集,收集的社交评论类内容数据条数为 50324 条,数据可用于自然语言理解、知识库构建等不同领域。
应用场景:
提供机构:
DatatangBeijing
创建时间:
2026-03-04
相关数据集
SIB-200
自然语言理解
多语言处理
SIB-200是一个大型开源基准数据集,用于200多种语言和方言的主题分类,旨在解决自然语言理解评估数据集的缺乏问题。该数据集基于Flores-200机器翻译语料库,首次为许多覆盖的语言提供了公开可用的NLU评估数据集。
arXiv
2024-03-07 更新
48
0
D204_English_Philippine_Spontaneous_Dialogue_Smartphone_speech_d
语音识别
多语种语音数据
菲律宾英语语音数据_对话(手机),基于30余个常见主题来模拟录制。此数据集标注了文本内容、句时间戳、说话人身份、性别等多种属性,由约400名来自不同地域和文化背景的菲律宾本土人录制,准确性高,为语音识别相关研究及应用提供了丰富的资源,经多家AI公司验证:有助于模型面对真实世界的多样性时能够表现出色。我们严格遵循数据保护法规和隐私规定,确保数据采集、存储和使用的过程中维护用户的隐私和合法权益,所有数
OpenCSG
2026-03-04 更新
15
0
D571_Hours_Italian_Speech_Data_Collected_by_Mobile_Phone
语音识别
意大利语
意大利意大利语语音数据_朗读(手机),基于给定的脚本朗读并模拟录制,涵盖通用类别。此数据集标注了文本内容等多种属性,由800名来自不同地域和文化背景的意大利人参与录制,男女均衡,口音正宗,文本经过人工校对,准确率高,为语音识别相关研究及应用提供了丰富的资源,经多家AI公司验证:有助于模型面对真实世界的多样性时能够表现出色。我们严格遵循数据保护法规和隐私规定,确保数据采集、存储和使用的过程中维护用户
OpenCSG
2026-03-04 更新
14
0
anli
自然语言处理
自然语言理解
# Dataset Card for "anli" ## Table of Contents - [Dataset Description](#dataset-description) - [Dataset Summary](#dataset-summary) - [Supported Tasks and Leaderboards](#supported-tasks-and-leade
魔搭社区
2026-06-22 更新
19
0
D426_Mongolian_China_Spontaneous_Speech_Data
蒙古语语音处理
语音识别
蒙古语语音数据_口语化。反映了真实世界的互动情境。此数据集标注了文本内容、说话人身份性别等多种属性,由来自不同地域和文化背景的蒙古族人录制,准确性高,易用性强,为语音识别相关研究及应用提供了丰富的资源,有助于模型面对真实世界的多样性时能够表现出色。我们严格遵循数据保护法规和隐私规定,确保数据采集、存储和使用的过程中维护用户的隐私和合法权益,所有数据均遵循GDPR, CCPA, PIPL。
OpenCSG
2026-03-04 更新
15
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广