登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
traintogpb/aihub-flores-koen-integrated-sparta-30k
traintogpb/aihub-flores-koen-integrated-sparta-30k
收藏
Hugging Face
2024-03-14 更新
2024-04-19 收录
自然语言处理
机器翻译
数据链接:
https://hf-mirror.com/datasets/traintogpb/aihub-flores-koen-integrated-sparta-30k
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
AI Hub의 한-영 번역 데이터셋과 FLoRes 한-영 번역 데이터셋의 합본입니다.
应用场景:
提供机构:
traintogpb
原始信息汇总
数据集概述
本数据集是AI Hub的韩-英翻译数据集与FLoRes韩-英翻译数据集的合并版本。
相关数据集
ZixuanKe/trade_the_event_sup_dpo_binarized
机器学习
自然语言处理
该数据集包含三个主要特征:prompt(提示)、ground_truth_chosen(选择的真实答案)和v1_rejected(被拒绝的答案)。数据集分为训练集和验证集,训练集包含243,425个样本,验证集包含12,812个样本。数据集的总下载大小为793,179,358字节,总大小为1,462,984,900字节。
Hugging Face
2024-11-04 更新
7
0
ferrazzipietro/IK_llama3.1-8b_diann_32_32_0.01
自然语言处理
机器学习
该数据集包含四个主要特征:推理提示(inference_prompt)、句子(sentence)、模型响应(model_responses)和真实值(ground_truth),所有特征的数据类型均为字符串。数据集分为验证集和测试集,验证集包含364个样本,测试集包含480个样本。文件总大小为1573275字节,下载大小为675584字节。
Hugging Face
2024-12-13 更新
6
0
khairi/pubmed-text-04
生物医学文献索引
自然语言处理
该数据集包含来自PubMed的文章数据,每篇文章包括PubMed ID、标题和摘要。数据集分为训练集、测试集和验证集,分别包含2,345,417、1,027和500个样本。训练集的大小为2,416,644,748字节,测试集为1,051,271字节,验证集为522,261字节。总下载大小为1,400,588,219字节,数据集总大小为2,418,218,280字节。
Hugging Face
2024-12-02 更新
4
0
tellarin-ai/ntx_llm_inst_french
自然语言处理
时间表达式
--- license: cc-by-sa-4.0 language: - fr task_categories: - token-classification --- # Dataset Card for NTX v1 in the Aya format - French subset This dataset is a format conversion for the French
Hugging Face
2023-12-20 更新
7
0
37channel/news-qa-dataset-made-by-llm-a-step-1-debug-2
问答系统
自然语言处理
--- dataset_info: features: - name: A dtype: string - name: Q dtype: string - name: chosen dtype: string - name: chosen-1 dtype: string - name: content dtype: string
Hugging Face
2024-06-25 更新
4
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广