登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
dived42/fact-checking-embedding-data
dived42/fact-checking-embedding-data
收藏
Hugging Face
2026-05-19 更新
2026-05-31 收录
事实核查
文本嵌入
数据链接:
https://hf-mirror.com/datasets/dived42/fact-checking-embedding-data
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
--- license: apache-2.0 ---
应用场景:
提供机构:
dived42
相关数据集
tdiggelm/climate_fever
气候变化
事实核查
--- annotations_creators: - crowdsourced - expert-generated language_creators: - found language: - en license: - unknown multilinguality: - monolingual size_categories: - 1K<n<10K source_datasets: - e
Hugging Face
2024-01-18 更新
54
0
ViFactCheck
事实核查
越南语处理
ViFactCheck是第一个公开的越南语事实核查基准数据集,专门为越南语事实核查设计,包含7,232个人工标注的声明-证据对,涵盖了12个不同的主题。
github
2025-03-22 更新
25
0
pageman/philippine-budget-2025-embeddings-minilm
政府预算
文本嵌入
菲律宾2025年人民预算的向量嵌入数据集
Hugging Face
2025-10-18 更新
6
0
FaMTEB
波斯语处理
文本嵌入
FaMTEB是一个大规模的波斯语文本嵌入基准,由Sharif University of Technology创建。该数据集包含63个数据集,涵盖7个任务,包括分类、聚类、成对分类、重排、检索、摘要检索和语义文本相似度。数据集由现有数据、翻译数据和通过大型语言模型生成的新合成数据组合而成,为波斯语语言模型提供了多样化的评估框架。
arXiv
2025-02-17 更新
34
0
argilla-warehouse/personahub-fineweb-edu-4-embeddings
自然语言处理
文本嵌入
该数据集通过使用Alibaba-NLP/gte-large-en-v1.5模型从句子转换器中获取了argilla-warehouse/personahub-fineweb-edu-4-dedup数据集的嵌入。数据集包含一个pipeline.yaml文件,可用于在distilabel中使用distilabel CLI重现生成数据集的管道。数据集的特征包括id、persona、model_name_e
Hugging Face
2024-09-10 更新
16
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广