登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
tartuNLP/EstSpeechMT
tartuNLP/EstSpeechMT
收藏
Hugging Face
2026-02-13 更新
2026-04-05 收录
数据链接:
https://hf-mirror.com/datasets/tartuNLP/EstSpeechMT
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
--- license: cc-by-4.0 ---
许可证:知识共享署名4.0(CC BY 4.0)
应用场景:
提供机构:
tartuNLP
相关数据集
tartuNLP/reddit-anhedonia
心理健康
文本分类
PRIMATE数据集专注于心理健康领域的兴趣或愉悦感缺失(anhedonia)的检测。通过心理健康专业人员的重新标注,该数据集提供了更精细的标签和文本证据,识别了大量假阳性案例,从而为anhedonia检测提供了更高质量的测试集。该研究强调了在心理健康数据集中解决标注质量问题的必要性,并倡导改进方法以提高NLP模型在心理健康评估中的可靠性。数据集的使用需要先获取PRIMATE数据集,并通过提供的代
Hugging Face
2024-07-01 更新
116
0
tartuNLP/smugri-mt-bench
语言模型评估
芬兰-乌戈尔语系处理
SMUGRI-MT-Bench是一个芬兰-乌戈尔语版的多轮对话和指令遵循能力评估数据集,包含4种极低资源语言:爱沙尼亚语、利沃尼亚语、科米语和沃罗语。该数据集由80个单轮和多云问题组成,涵盖数学、推理、写作和一般知识四个主题。这些问题由这些语言的流利使用者从LMSYS-Chat-1M数据集中挑选并手动翻译。此外,数据集还包括每个语言20个有害提示,用于研究极低资源场景下语言模型的潜在漏洞和偏见。
Hugging Face
2025-01-02 更新
10
0
tartuNLP/fineweb-c-combined-resample
文本分类
机器学习
这是一个包含文本和标签的数据集,文本字段包含了文本内容,标签字段则包含了相应的标签。数据集还包含了文本的token数量、语言代码、数据来源和原始注释等信息。数据集分为训练集和验证集,适用于模型训练和验证。
Hugging Face
2025-09-14 更新
9
0
tartuNLP/finetranslations-et
机器翻译
自然语言处理
FineTranslations-et是HuggingFaceFW/finetranslations数据集的爱沙尼亚语子集,为便于访问而重新上传。该数据集包含翻译文本、原始文本块、语言分数和质量指标等特征,适用于翻译和文本生成任务。数据集发布在Open Data Commons Attribution License (ODC-By) v1.0许可下,并受CommonCrawl使用条款约束。
Hugging Face
2026-01-10 更新
17
0
tartuNLP/word_meanings_et_multiple_choice
自然语言理解
机器学习
该数据集包含了三个字段:定义(definition)、选项(choices)和标签(label),均为字符串类型。数据集被划分为训练集,共有997个样本,总文件大小为124412.0字节。具体的数据集内容描述未在README中提供。
Hugging Face
2025-09-12 更新
10
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广