登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
GreenNode/TVPL-Retrieval
GreenNode/TVPL-Retrieval
收藏
Hugging Face
2025-12-14 更新
2026-01-03 收录
数据链接:
https://hf-mirror.com/datasets/GreenNode/TVPL-Retrieval
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
--- license: cc-by-nc-sa-4.0 ---
应用场景:
提供机构:
GreenNode
相关数据集
GreenNode/nano-hotpotqa-vn
问答系统
文本嵌入
NanoHotpotQA-VN是一个从HotpotQA翻译而来的问答数据集,属于MTEB(大规模文本嵌入基准)的一部分。该数据集包含自然、多跳问题,并提供支持事实的强监督,以支持更可解释的问答系统。数据集的创建过程使用了大型语言模型(如Coherence的Aya模型)进行翻译,并应用了先进的嵌入模型进行过滤和质量评分。数据集的语言为越南语(vie),许可证为cc-by-sa-4.0。数据集包含三个
Hugging Face
2025-12-30 更新
18
0
GreenNode/nfcorpus-vn
文本检索
嵌入模型评估
这是一个越南语的文本检索数据集,包含文档的标题和文本,以及用于评估的查询和分数信息。数据集是从mteb/nfcorpus派生出来的,并且是多语言翻译的。
Hugging Face
2026-01-08 更新
15
0
GreenNode/msmarco-vn
文本检索
越南语处理
这是一个越南语的文本检索数据集,包含corpus、default和queries三个配置。corpus配置有标题、文本等字段,default配置包含查询ID、语料库ID和分数等字段,queries配置包含文本和原始文本字段。数据集分为训练、开发和测试集,来源于mteb/msmarco数据集,并可以使用mteb库进行模型评估。
Hugging Face
2026-01-08 更新
11
0
GreenNode/toxic-conversations-50k-vn
有毒内容检测
自然语言处理
该数据集包含文本数据,每个样本包括文本内容、标签、标签文本和原始文本四个特征。数据集分为训练集和测试集,各包含50,000个样本。数据集的下载大小为46,001,711字节,总大小为78,105,914字节。
Hugging Face
2024-10-21 更新
15
0
GreenNode/quora-vn
文本检索
越南语
这是一个适用于文本检索任务的越南语数据集,包含三个配置:corpus、default和queries。corpus配置包含文档的标题和文本,default配置包含查询ID、语料库ID和分数,queries配置包含查询文本和原始文本。数据集分为训练、测试和开发集,支持多语言翻译。
Hugging Face
2026-01-08 更新
12
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广